datapath: Replace __force type cast with rcu_dereference_raw().
[cascardo/ovs.git] / datapath / flow_table.c
index cc0eaf2..9656cfe 100644 (file)
@@ -47,6 +47,7 @@
 #include "vlan.h"
 
 #define TBL_MIN_BUCKETS                1024
+#define MASK_ARRAY_SIZE_MIN    16
 #define REHASH_INTERVAL                (10 * 60 * HZ)
 
 #define MC_HASH_SHIFT          8
@@ -113,7 +114,7 @@ err:
        return ERR_PTR(-ENOMEM);
 }
 
-int ovs_flow_tbl_count(struct flow_table *table)
+int ovs_flow_tbl_count(const struct flow_table *table)
 {
        return table->count;
 }
@@ -145,11 +146,11 @@ static void flow_free(struct sw_flow *flow)
 {
        int node;
 
-       kfree((struct sw_flow_actions __force *)flow->sf_acts);
+       kfree(rcu_dereference_raw(flow->sf_acts));
        for_each_node(node)
                if (flow->stats[node])
                        kmem_cache_free(flow_stats_cache,
-                                       (struct flow_stats __force *)flow->stats[node]);
+                                       rcu_dereference_raw(flow->stats[node]));
        kmem_cache_free(flow_cache, flow);
 }
 
@@ -211,26 +212,86 @@ static struct table_instance *table_instance_alloc(int new_size)
        return ti;
 }
 
+static void mask_array_rcu_cb(struct rcu_head *rcu)
+{
+       struct mask_array *ma = container_of(rcu, struct mask_array, rcu);
+
+       kfree(ma);
+}
+
+static struct mask_array *tbl_mask_array_alloc(int size)
+{
+       struct mask_array *new;
+
+       size = max(MASK_ARRAY_SIZE_MIN, size);
+       new = kzalloc(sizeof(struct mask_array) +
+                     sizeof(struct sw_flow_mask *) * size, GFP_KERNEL);
+       if (!new)
+               return NULL;
+
+       new->count = 0;
+       new->max = size;
+
+       return new;
+}
+
+static int tbl_mask_array_realloc(struct flow_table *tbl, int size)
+{
+       struct mask_array *old;
+       struct mask_array *new;
+
+       new = tbl_mask_array_alloc(size);
+       if (!new)
+               return -ENOMEM;
+
+       old = ovsl_dereference(tbl->mask_array);
+       if (old) {
+               int i, count = 0;
+
+               for (i = 0; i < old->max; i++) {
+                       if (ovsl_dereference(old->masks[i]))
+                               new->masks[count++] = old->masks[i];
+               }
+
+               new->count = count;
+       }
+       rcu_assign_pointer(tbl->mask_array, new);
+
+       if (old)
+               call_rcu(&old->rcu, mask_array_rcu_cb);
+
+       return 0;
+}
+
 int ovs_flow_tbl_init(struct flow_table *table)
 {
        struct table_instance *ti;
+       struct mask_array *ma;
 
        table->mask_cache = __alloc_percpu(sizeof(struct mask_cache_entry) *
                                          MC_HASH_ENTRIES, __alignof__(struct mask_cache_entry));
        if (!table->mask_cache)
                return -ENOMEM;
 
+       ma = tbl_mask_array_alloc(MASK_ARRAY_SIZE_MIN);
+       if (!ma)
+               goto free_mask_cache;
+
        ti = table_instance_alloc(TBL_MIN_BUCKETS);
-       if (!ti) {
-               free_percpu(table->mask_cache);
-               return -ENOMEM;
-       }
+       if (!ti)
+               goto free_mask_array;
 
        rcu_assign_pointer(table->ti, ti);
-       INIT_LIST_HEAD(&table->mask_list);
+       rcu_assign_pointer(table->mask_array, ma);
        table->last_rehash = jiffies;
        table->count = 0;
        return 0;
+
+free_mask_array:
+       kfree(ma);
+free_mask_cache:
+       free_percpu(table->mask_cache);
+       return -ENOMEM;
 }
 
 static void flow_tbl_destroy_rcu_cb(struct rcu_head *rcu)
@@ -273,9 +334,10 @@ skip_flows:
  * error path. */
 void ovs_flow_tbl_destroy(struct flow_table *table)
 {
-       struct table_instance *ti = (struct table_instance __force *)table->ti;
+       struct table_instance *ti = rcu_dereference_raw(table->ti);
 
        free_percpu(table->mask_cache);
+       kfree(rcu_dereference_raw(table->mask_array));
        table_instance_destroy(ti, false);
 }
 
@@ -420,7 +482,7 @@ static bool flow_cmp_masked_key(const struct sw_flow *flow,
 }
 
 bool ovs_flow_cmp_unmasked_key(const struct sw_flow *flow,
-                              struct sw_flow_match *match)
+                              const struct sw_flow_match *match)
 {
        struct sw_flow_key *key = match->key;
        int key_start = flow_key_start(key);
@@ -431,7 +493,7 @@ bool ovs_flow_cmp_unmasked_key(const struct sw_flow *flow,
 
 static struct sw_flow *masked_flow_lookup(struct table_instance *ti,
                                          const struct sw_flow_key *unmasked,
-                                         struct sw_flow_mask *mask,
+                                         const struct sw_flow_mask *mask,
                                          u32 *n_mask_hit)
 {
        struct sw_flow *flow;
@@ -454,20 +516,45 @@ static struct sw_flow *masked_flow_lookup(struct table_instance *ti,
        return NULL;
 }
 
-
+/* Flow lookup does full lookup on flow table. It starts with
+ * mask from index passed in *index.
+ */
 static struct sw_flow *flow_lookup(struct flow_table *tbl,
                                   struct table_instance *ti,
+                                  const struct mask_array *ma,
                                   const struct sw_flow_key *key,
-                                  u32 *n_mask_hit)
+                                  u32 *n_mask_hit,
+                                  u32 *index)
 {
        struct sw_flow_mask *mask;
        struct sw_flow *flow;
+       int i;
+
+       if (*index < ma->max) {
+               mask = rcu_dereference_ovsl(ma->masks[*index]);
+               if (mask) {
+                       flow = masked_flow_lookup(ti, key, mask, n_mask_hit);
+                       if (flow)
+                               return flow;
+               }
+       }
+
+       for (i = 0; i < ma->max; i++)  {
+
+               if (i == *index)
+                       continue;
+
+               mask = rcu_dereference_ovsl(ma->masks[i]);
+               if (!mask)
+                       continue;
 
-       list_for_each_entry_rcu(mask, &tbl->mask_list, list) {
                flow = masked_flow_lookup(ti, key, mask, n_mask_hit);
-               if (flow)  /* Found */
+               if (flow) { /* Found */
+                       *index = i;
                        return flow;
+               }
        }
+
        return NULL;
 }
 
@@ -483,57 +570,48 @@ struct sw_flow *ovs_flow_tbl_lookup_stats(struct flow_table *tbl,
                                          u32 skb_hash,
                                          u32 *n_mask_hit)
 {
-       struct table_instance *ti = rcu_dereference_ovsl(tbl->ti);
-       struct mask_cache_entry  *entries, *ce, *del;
+       struct mask_array *ma = rcu_dereference(tbl->mask_array);
+       struct table_instance *ti = rcu_dereference(tbl->ti);
+       struct mask_cache_entry *entries, *ce;
        struct sw_flow *flow;
        u32 hash = skb_hash;
        int seg;
 
        *n_mask_hit = 0;
-       if (unlikely(!skb_hash))
-               return flow_lookup(tbl, ti, key, n_mask_hit);
+       if (unlikely(!skb_hash)) {
+               u32 mask_index = 0;
 
-       del = NULL;
+               return flow_lookup(tbl, ti, ma, key, n_mask_hit, &mask_index);
+       }
+
+       ce = NULL;
        entries = this_cpu_ptr(tbl->mask_cache);
 
+       /* Find the cache entry 'ce' to operate on. */
        for (seg = 0; seg < MC_HASH_SEGS; seg++) {
-               int index;
-
-               index = hash & (MC_HASH_ENTRIES - 1);
-               ce = &entries[index];
-
-               if (ce->skb_hash == skb_hash) {
-                       struct sw_flow_mask *mask;
-                       int i;
-
-                       i = 0;
-                       list_for_each_entry_rcu(mask, &tbl->mask_list, list) {
-                               if (ce->mask_index == i++) {
-                                       flow = masked_flow_lookup(ti, key, mask,
-                                                                 n_mask_hit);
-                                       if (flow)  /* Found */
-                                               return flow;
-
-                                       break;
-                               }
-                       }
-                       del = ce;
-                       break;
+               int index = hash & (MC_HASH_ENTRIES - 1);
+               struct mask_cache_entry *e;
+
+               e = &entries[index];
+               if (e->skb_hash == skb_hash) {
+                       flow = flow_lookup(tbl, ti, ma, key, n_mask_hit,
+                                          &e->mask_index);
+                       if (!flow)
+                               e->skb_hash = 0;
+                       return flow;
                }
 
-               if (!del || (del->skb_hash && !ce->skb_hash)) {
-                       del = ce;
-               }
+               if (!ce || e->skb_hash < ce->skb_hash)
+                       ce = e;  /* A better replacement cache candidate. */
 
                hash >>= MC_HASH_SHIFT;
        }
 
-       flow = flow_lookup(tbl, ti, key, n_mask_hit);
+       /* Cache miss, do full lookup. */
+       flow = flow_lookup(tbl, ti, ma, key, n_mask_hit, &ce->mask_index);
+       if (flow)
+               ce->skb_hash = skb_hash;
 
-       if (flow) {
-               del->skb_hash = skb_hash;
-               del->mask_index = (*n_mask_hit - 1);
-       }
        return flow;
 }
 
@@ -541,21 +619,42 @@ struct sw_flow *ovs_flow_tbl_lookup(struct flow_table *tbl,
                                    const struct sw_flow_key *key)
 {
        struct table_instance *ti = rcu_dereference_ovsl(tbl->ti);
+       struct mask_array *ma = rcu_dereference_ovsl(tbl->mask_array);
        u32 __always_unused n_mask_hit;
+       u32 index = 0;
 
-       n_mask_hit = 0;
-       return flow_lookup(tbl, ti, key, &n_mask_hit);
+       return flow_lookup(tbl, ti, ma, key, &n_mask_hit, &index);
 }
 
-int ovs_flow_tbl_num_masks(const struct flow_table *table)
+struct sw_flow *ovs_flow_tbl_lookup_exact(struct flow_table *tbl,
+                                         const struct sw_flow_match *match)
 {
-       struct sw_flow_mask *mask;
-       int num = 0;
+       struct mask_array *ma = ovsl_dereference(tbl->mask_array);
+       int i;
 
-       list_for_each_entry(mask, &table->mask_list, list)
-               num++;
+       /* Always called under ovs-mutex. */
+       for (i = 0; i < ma->max; i++) {
+               struct table_instance *ti = ovsl_dereference(tbl->ti);
+               u32 __always_unused n_mask_hit;
+               struct sw_flow_mask *mask;
+               struct sw_flow *flow;
 
-       return num;
+               mask = ovsl_dereference(ma->masks[i]);
+               if (!mask)
+                       continue;
+               flow = masked_flow_lookup(ti, match->key, mask, &n_mask_hit);
+               if (flow && ovs_flow_cmp_unmasked_key(flow, match))
+                       return flow;
+       }
+       return NULL;
+}
+
+int ovs_flow_tbl_num_masks(const struct flow_table *table)
+{
+       struct mask_array *ma;
+
+       ma = rcu_dereference_ovsl(table->mask_array);
+       return ma->count;
 }
 
 static struct table_instance *table_instance_expand(struct table_instance *ti)
@@ -563,6 +662,23 @@ static struct table_instance *table_instance_expand(struct table_instance *ti)
        return table_instance_rehash(ti, ti->n_buckets * 2);
 }
 
+static void tbl_mask_array_delete_mask(struct mask_array *ma,
+                                      struct sw_flow_mask *mask)
+{
+       int i;
+
+       /* Remove the deleted mask pointers from the array */
+       for (i = 0; i < ma->max; i++) {
+               if (mask == ovsl_dereference(ma->masks[i])) {
+                       RCU_INIT_POINTER(ma->masks[i], NULL);
+                       ma->count--;
+                       call_rcu(&mask->rcu, rcu_free_sw_flow_mask_cb);
+                       return;
+               }
+       }
+       BUG();
+}
+
 /* Remove 'mask' from the mask list, if it is not needed any more. */
 static void flow_mask_remove(struct flow_table *tbl, struct sw_flow_mask *mask)
 {
@@ -575,8 +691,16 @@ static void flow_mask_remove(struct flow_table *tbl, struct sw_flow_mask *mask)
                mask->ref_count--;
 
                if (!mask->ref_count) {
-                       list_del_rcu(&mask->list);
-                       call_rcu(&mask->rcu, rcu_free_sw_flow_mask_cb);
+                       struct mask_array *ma;
+
+                       ma = ovsl_dereference(tbl->mask_array);
+                       tbl_mask_array_delete_mask(ma, mask);
+
+                       /* Shrink the mask array if necessary. */
+                       if (ma->max >= (MASK_ARRAY_SIZE_MIN * 2) &&
+                           ma->count <= (ma->max / 3))
+                               tbl_mask_array_realloc(tbl, ma->max / 2);
+
                }
        }
 }
@@ -620,13 +744,16 @@ static bool mask_equal(const struct sw_flow_mask *a,
 static struct sw_flow_mask *flow_mask_find(const struct flow_table *tbl,
                                           const struct sw_flow_mask *mask)
 {
-       struct list_head *ml;
+       struct mask_array *ma;
+       int i;
+
+       ma = ovsl_dereference(tbl->mask_array);
+       for (i = 0; i < ma->max; i++) {
+               struct sw_flow_mask *t;
 
-       list_for_each(ml, &tbl->mask_list) {
-               struct sw_flow_mask *m;
-               m = container_of(ml, struct sw_flow_mask, list);
-               if (mask_equal(mask, m))
-                       return m;
+               t = ovsl_dereference(ma->masks[i]);
+               if (t && mask_equal(mask, t))
+                       return t;
        }
 
        return NULL;
@@ -634,18 +761,48 @@ static struct sw_flow_mask *flow_mask_find(const struct flow_table *tbl,
 
 /* Add 'mask' into the mask list, if it is not already there. */
 static int flow_mask_insert(struct flow_table *tbl, struct sw_flow *flow,
-                           struct sw_flow_mask *new)
+                           const struct sw_flow_mask *new)
 {
        struct sw_flow_mask *mask;
+
        mask = flow_mask_find(tbl, new);
        if (!mask) {
+               struct mask_array *ma;
+               int i;
+
                /* Allocate a new mask if none exsits. */
                mask = mask_alloc();
                if (!mask)
                        return -ENOMEM;
+
                mask->key = new->key;
                mask->range = new->range;
-               list_add_tail_rcu(&mask->list, &tbl->mask_list);
+
+               /* Add mask to mask-list. */
+               ma = ovsl_dereference(tbl->mask_array);
+               if (ma->count >= ma->max) {
+                       int err;
+
+                       err = tbl_mask_array_realloc(tbl, ma->max +
+                                                         MASK_ARRAY_SIZE_MIN);
+                       if (err) {
+                               kfree(mask);
+                               return err;
+                       }
+                       ma = ovsl_dereference(tbl->mask_array);
+               }
+
+               for (i = 0; i < ma->max; i++) {
+                       struct sw_flow_mask *t;
+
+                       t = ovsl_dereference(ma->masks[i]);
+                       if (!t) {
+                               rcu_assign_pointer(ma->masks[i], mask);
+                               ma->count++;
+                               break;
+                       }
+               }
+
        } else {
                BUG_ON(!mask->ref_count);
                mask->ref_count++;
@@ -657,7 +814,7 @@ static int flow_mask_insert(struct flow_table *tbl, struct sw_flow *flow,
 
 /* Must be called with OVS mutex held. */
 int ovs_flow_tbl_insert(struct flow_table *table, struct sw_flow *flow,
-                       struct sw_flow_mask *mask)
+                       const struct sw_flow_mask *mask)
 {
        struct table_instance *new_ti = NULL;
        struct table_instance *ti;