bpf: Don't refcount LISTEN sockets in sk_assign()
authorJoe Stringer <joe@wand.net.nz>
Sun, 29 Mar 2020 22:53:40 +0000 (15:53 -0700)
committerAlexei Starovoitov <ast@kernel.org>
Mon, 30 Mar 2020 20:45:05 +0000 (13:45 -0700)
Avoid taking a reference on listen sockets by checking the socket type
in the sk_assign and in the corresponding skb_steal_sock() code in the
the transport layer, and by ensuring that the prefetch free (sock_pfree)
function uses the same logic to check whether the socket is refcounted.

Suggested-by: Martin KaFai Lau <kafai@fb.com>
Signed-off-by: Joe Stringer <joe@wand.net.nz>
Signed-off-by: Alexei Starovoitov <ast@kernel.org>
Acked-by: Martin KaFai Lau <kafai@fb.com>
Link: https://lore.kernel.org/bpf/20200329225342.16317-4-joe@wand.net.nz
include/net/sock.h
net/core/filter.c
net/core/sock.c

index f81d528845f6e830be771d613fa845ddaded4872..6d84784d33fa007d91836dc9c51532a23048cf08 100644 (file)
@@ -2537,6 +2537,21 @@ skb_sk_is_prefetched(struct sk_buff *skb)
 #endif /* CONFIG_INET */
 }
 
+/* This helper checks if a socket is a full socket,
+ * ie _not_ a timewait or request socket.
+ */
+static inline bool sk_fullsock(const struct sock *sk)
+{
+       return (1 << sk->sk_state) & ~(TCPF_TIME_WAIT | TCPF_NEW_SYN_RECV);
+}
+
+static inline bool
+sk_is_refcounted(struct sock *sk)
+{
+       /* Only full sockets have sk->sk_flags. */
+       return !sk_fullsock(sk) || !sock_flag(sk, SOCK_RCU_FREE);
+}
+
 /**
  * skb_steal_sock
  * @skb to steal the socket from
@@ -2549,6 +2564,8 @@ skb_steal_sock(struct sk_buff *skb, bool *refcounted)
                struct sock *sk = skb->sk;
 
                *refcounted = true;
+               if (skb_sk_is_prefetched(skb))
+                       *refcounted = sk_is_refcounted(sk);
                skb->destructor = NULL;
                skb->sk = NULL;
                return sk;
@@ -2557,14 +2574,6 @@ skb_steal_sock(struct sk_buff *skb, bool *refcounted)
        return NULL;
 }
 
-/* This helper checks if a socket is a full socket,
- * ie _not_ a timewait or request socket.
- */
-static inline bool sk_fullsock(const struct sock *sk)
-{
-       return (1 << sk->sk_state) & ~(TCPF_TIME_WAIT | TCPF_NEW_SYN_RECV);
-}
-
 /* Checks if this SKB belongs to an HW offloaded socket
  * and whether any SW fallbacks are required based on dev.
  * Check decrypted mark in case skb_orphan() cleared socket.
index ac5c1633f8d2723b32d7d1d32adb5d8cd9436a41..7628b947dbc3aabd289fd6f282c82a7faf8e3256 100644 (file)
@@ -5401,8 +5401,7 @@ static const struct bpf_func_proto bpf_sk_lookup_udp_proto = {
 
 BPF_CALL_1(bpf_sk_release, struct sock *, sk)
 {
-       /* Only full sockets have sk->sk_flags. */
-       if (!sk_fullsock(sk) || !sock_flag(sk, SOCK_RCU_FREE))
+       if (sk_is_refcounted(sk))
                sock_gen_put(sk);
        return 0;
 }
@@ -5928,7 +5927,8 @@ BPF_CALL_3(bpf_sk_assign, struct sk_buff *, skb, struct sock *, sk, u64, flags)
                return -ENETUNREACH;
        if (unlikely(sk->sk_reuseport))
                return -ESOCKTNOSUPPORT;
-       if (unlikely(!refcount_inc_not_zero(&sk->sk_refcnt)))
+       if (sk_is_refcounted(sk) &&
+           unlikely(!refcount_inc_not_zero(&sk->sk_refcnt)))
                return -ENOENT;
 
        skb_orphan(skb);
index 87e3a03c905631b336d164d5fbf35318376e6c1f..da32d9b6d09f86172ba5e40a1fdd053d505ec445 100644 (file)
@@ -2077,7 +2077,8 @@ EXPORT_SYMBOL(sock_efree);
 #ifdef CONFIG_INET
 void sock_pfree(struct sk_buff *skb)
 {
-       sock_gen_put(skb->sk);
+       if (sk_is_refcounted(skb->sk))
+               sock_gen_put(skb->sk);
 }
 EXPORT_SYMBOL(sock_pfree);
 #endif /* CONFIG_INET */