locking/spinlock, arch: Update and fix spin_unlock_wait() implementations

author Peter Zijlstra <peterz@infradead.org>

Thu, 26 May 2016 08:35:03 +0000 (10:35 +0200)

committer Ingo Molnar <mingo@kernel.org>

Tue, 14 Jun 2016 09:55:15 +0000 (11:55 +0200)
author Peter Zijlstra <peterz@infradead.org>
Thu, 26 May 2016 08:35:03 +0000 (10:35 +0200)
committer Ingo Molnar <mingo@kernel.org>
Tue, 14 Jun 2016 09:55:15 +0000 (11:55 +0200)
diff --git a/arch/alpha/include/asm/spinlock.h b/arch/alpha/include/asm/spinlock.h

index fed9c6f..a40b9fc 100644 (file)
--- a/arch/alpha/include/asm/spinlock.h
+++ b/arch/alpha/include/asm/spinlock.h
@@ -3,6 +3,8 @@
  
  #include <linux/kernel.h>
  #include <asm/current.h>
+#include <asm/barrier.h>
+#include <asm/processor.h>
  
  /*
   * Simple spin lock operations.  There are two variants, one clears IRQ's
@@ -13,8 +15,11 @@
  
  #define arch_spin_lock_flags(lock, flags) arch_spin_lock(lock)
  #define arch_spin_is_locked(x) ((x)->lock != 0)
-#define arch_spin_unlock_wait(x) \
-               do { cpu_relax(); } while ((x)->lock)
+
+static inline void arch_spin_unlock_wait(arch_spinlock_t *lock)
+{
+       smp_cond_load_acquire(&lock->lock, !VAL);
+}
  
  static inline int arch_spin_value_unlocked(arch_spinlock_t lock)
  {
diff --git a/arch/arc/include/asm/spinlock.h b/arch/arc/include/asm/spinlock.h

index cded4a9..233d5ff 100644 (file)
--- a/arch/arc/include/asm/spinlock.h
+++ b/arch/arc/include/asm/spinlock.h
@@ -15,8 +15,11 @@
  
  #define arch_spin_is_locked(x) ((x)->slock != __ARCH_SPIN_LOCK_UNLOCKED__)
  #define arch_spin_lock_flags(lock, flags)      arch_spin_lock(lock)
-#define arch_spin_unlock_wait(x) \
-       do { while (arch_spin_is_locked(x)) cpu_relax(); } while (0)
+
+static inline void arch_spin_unlock_wait(arch_spinlock_t *lock)
+{
+       smp_cond_load_acquire(&lock->slock, !VAL);
+}
  
  #ifdef CONFIG_ARC_HAS_LLSC
  
diff --git a/arch/arm/include/asm/spinlock.h b/arch/arm/include/asm/spinlock.h

index 0fa4184..4bec454 100644 (file)
--- a/arch/arm/include/asm/spinlock.h
+++ b/arch/arm/include/asm/spinlock.h
@@ -6,6 +6,8 @@
  #endif
  
  #include <linux/prefetch.h>
+#include <asm/barrier.h>
+#include <asm/processor.h>
  
  /*
   * sev and wfe are ARMv6K extensions.  Uniprocessor ARMv6 may not have the K
@@ -50,8 +52,21 @@ static inline void dsb_sev(void)
   * memory.
   */
  
-#define arch_spin_unlock_wait(lock) \
-       do { while (arch_spin_is_locked(lock)) cpu_relax(); } while (0)
+static inline void arch_spin_unlock_wait(arch_spinlock_t *lock)
+{
+       u16 owner = READ_ONCE(lock->tickets.owner);
+
+       for (;;) {
+               arch_spinlock_t tmp = READ_ONCE(*lock);
+
+               if (tmp.tickets.owner == tmp.tickets.next ||
+                   tmp.tickets.owner != owner)
+                       break;
+
+               wfe();
+       }
+       smp_acquire__after_ctrl_dep();
+}
  
  #define arch_spin_lock_flags(lock, flags) arch_spin_lock(lock)
  
diff --git a/arch/blackfin/include/asm/spinlock.h b/arch/blackfin/include/asm/spinlock.h

index 490c7ca..c58f4a8 100644 (file)
--- a/arch/blackfin/include/asm/spinlock.h
+++ b/arch/blackfin/include/asm/spinlock.h
@@ -12,6 +12,8 @@
  #else
  
  #include <linux/atomic.h>
+#include <asm/processor.h>
+#include <asm/barrier.h>
  
  asmlinkage int __raw_spin_is_locked_asm(volatile int *ptr);
  asmlinkage void __raw_spin_lock_asm(volatile int *ptr);
@@ -48,8 +50,7 @@ static inline void arch_spin_unlock(arch_spinlock_t *lock)
  
  static inline void arch_spin_unlock_wait(arch_spinlock_t *lock)
  {
-       while (arch_spin_is_locked(lock))
-               cpu_relax();
+       smp_cond_load_acquire(&lock->lock, !VAL);
  }
  
  static inline int arch_read_can_lock(arch_rwlock_t *rw)
diff --git a/arch/hexagon/include/asm/spinlock.h b/arch/hexagon/include/asm/spinlock.h

index 12ca4eb..a1c5578 100644 (file)
--- a/arch/hexagon/include/asm/spinlock.h
+++ b/arch/hexagon/include/asm/spinlock.h
@@ -23,6 +23,8 @@
  #define _ASM_SPINLOCK_H
  
  #include <asm/irqflags.h>
+#include <asm/barrier.h>
+#include <asm/processor.h>
  
  /*
   * This file is pulled in for SMP builds.
@@ -176,8 +178,12 @@ static inline unsigned int arch_spin_trylock(arch_spinlock_t *lock)
   * SMP spinlocks are intended to allow only a single CPU at the lock
   */
  #define arch_spin_lock_flags(lock, flags) arch_spin_lock(lock)
-#define arch_spin_unlock_wait(lock) \
-       do {while (arch_spin_is_locked(lock)) cpu_relax(); } while (0)
+
+static inline void arch_spin_unlock_wait(arch_spinlock_t *lock)
+{
+       smp_cond_load_acquire(&lock->lock, !VAL);
+}
+
  #define arch_spin_is_locked(x) ((x)->lock != 0)
  
  #define arch_read_lock_flags(lock, flags) arch_read_lock(lock)
diff --git a/arch/ia64/include/asm/spinlock.h b/arch/ia64/include/asm/spinlock.h

index 45698cd..ca9e761 100644 (file)
--- a/arch/ia64/include/asm/spinlock.h
+++ b/arch/ia64/include/asm/spinlock.h
@@ -15,6 +15,8 @@
  
  #include <linux/atomic.h>
  #include <asm/intrinsics.h>
+#include <asm/barrier.h>
+#include <asm/processor.h>
  
  #define arch_spin_lock_init(x)                 ((x)->lock = 0)
  
@@ -86,6 +88,8 @@ static __always_inline void __ticket_spin_unlock_wait(arch_spinlock_t *lock)
                         return;
                 cpu_relax();
         }
+
+       smp_acquire__after_ctrl_dep();
  }
  
  static inline int __ticket_spin_is_locked(arch_spinlock_t *lock)
diff --git a/arch/m32r/include/asm/spinlock.h b/arch/m32r/include/asm/spinlock.h

index fa13694..323c7fc 100644 (file)
--- a/arch/m32r/include/asm/spinlock.h
+++ b/arch/m32r/include/asm/spinlock.h
@@ -13,6 +13,8 @@
  #include <linux/atomic.h>
  #include <asm/dcache_clear.h>
  #include <asm/page.h>
+#include <asm/barrier.h>
+#include <asm/processor.h>
  
  /*
   * Your basic SMP spinlocks, allowing only a single CPU anywhere
@@ -27,8 +29,11 @@
  
  #define arch_spin_is_locked(x)         (*(volatile int *)(&(x)->slock) <= 0)
  #define arch_spin_lock_flags(lock, flags) arch_spin_lock(lock)
-#define arch_spin_unlock_wait(x) \
-               do { cpu_relax(); } while (arch_spin_is_locked(x))
+
+static inline void arch_spin_unlock_wait(arch_spinlock_t *lock)
+{
+       smp_cond_load_acquire(&lock->slock, VAL > 0);
+}
  
  /**
   * arch_spin_trylock - Try spin lock and return a result
diff --git a/arch/metag/include/asm/spinlock.h b/arch/metag/include/asm/spinlock.h

index 86a7cf3..c0c7a22 100644 (file)
--- a/arch/metag/include/asm/spinlock.h
+++ b/arch/metag/include/asm/spinlock.h
@@ -1,14 +1,24 @@
  #ifndef __ASM_SPINLOCK_H
  #define __ASM_SPINLOCK_H
  
+#include <asm/barrier.h>
+#include <asm/processor.h>
+
  #ifdef CONFIG_METAG_ATOMICITY_LOCK1
  #include <asm/spinlock_lock1.h>
  #else
  #include <asm/spinlock_lnkget.h>
  #endif
  
-#define arch_spin_unlock_wait(lock) \
-       do { while (arch_spin_is_locked(lock)) cpu_relax(); } while (0)
+/*
+ * both lock1 and lnkget are test-and-set spinlocks with 0 unlocked and 1
+ * locked.
+ */
+
+static inline void arch_spin_unlock_wait(arch_spinlock_t *lock)
+{
+       smp_cond_load_acquire(&lock->lock, !VAL);
+}
  
  #define arch_spin_lock_flags(lock, flags) arch_spin_lock(lock)
  
diff --git a/arch/mips/include/asm/spinlock.h b/arch/mips/include/asm/spinlock.h

index 40196be..f485afe 100644 (file)
--- a/arch/mips/include/asm/spinlock.h
+++ b/arch/mips/include/asm/spinlock.h
@@ -12,6 +12,7 @@
  #include <linux/compiler.h>
  
  #include <asm/barrier.h>
+#include <asm/processor.h>
  #include <asm/compiler.h>
  #include <asm/war.h>
  
@@ -48,8 +49,22 @@ static inline int arch_spin_value_unlocked(arch_spinlock_t lock)
  }
  
  #define arch_spin_lock_flags(lock, flags) arch_spin_lock(lock)
-#define arch_spin_unlock_wait(x) \
-       while (arch_spin_is_locked(x)) { cpu_relax(); }
+
+static inline void arch_spin_unlock_wait(arch_spinlock_t *lock)
+{
+       u16 owner = READ_ONCE(lock->h.serving_now);
+       smp_rmb();
+       for (;;) {
+               arch_spinlock_t tmp = READ_ONCE(*lock);
+
+               if (tmp.h.serving_now == tmp.h.ticket ||
+                   tmp.h.serving_now != owner)
+                       break;
+
+               cpu_relax();
+       }
+       smp_acquire__after_ctrl_dep();
+}
  
  static inline int arch_spin_is_contended(arch_spinlock_t *lock)
  {
diff --git a/arch/mn10300/include/asm/spinlock.h b/arch/mn10300/include/asm/spinlock.h

index 1ae580f..9c7b8f7 100644 (file)
--- a/arch/mn10300/include/asm/spinlock.h
+++ b/arch/mn10300/include/asm/spinlock.h
@@ -12,6 +12,8 @@
  #define _ASM_SPINLOCK_H
  
  #include <linux/atomic.h>
+#include <asm/barrier.h>
+#include <asm/processor.h>
  #include <asm/rwlock.h>
  #include <asm/page.h>
  
@@ -23,7 +25,11 @@
   */
  
  #define arch_spin_is_locked(x) (*(volatile signed char *)(&(x)->slock) != 0)
-#define arch_spin_unlock_wait(x) do { barrier(); } while (arch_spin_is_locked(x))
+
+static inline void arch_spin_unlock_wait(arch_spinlock_t *lock)
+{
+       smp_cond_load_acquire(&lock->slock, !VAL);
+}
  
  static inline void arch_spin_unlock(arch_spinlock_t *lock)
  {
diff --git a/arch/parisc/include/asm/spinlock.h b/arch/parisc/include/asm/spinlock.h

index 64f2992..e32936c 100644 (file)
--- a/arch/parisc/include/asm/spinlock.h
+++ b/arch/parisc/include/asm/spinlock.h
@@ -13,8 +13,13 @@ static inline int arch_spin_is_locked(arch_spinlock_t *x)
  }
  
  #define arch_spin_lock(lock) arch_spin_lock_flags(lock, 0)
-#define arch_spin_unlock_wait(x) \
-               do { cpu_relax(); } while (arch_spin_is_locked(x))
+
+static inline void arch_spin_unlock_wait(arch_spinlock_t *x)
+{
+       volatile unsigned int *a = __ldcw_align(x);
+
+       smp_cond_load_acquire(a, VAL);
+}
  
  static inline void arch_spin_lock_flags(arch_spinlock_t *x,
                                          unsigned long flags)
diff --git a/arch/s390/include/asm/spinlock.h b/arch/s390/include/asm/spinlock.h

index 63ebf37..7e9e09f 100644 (file)
--- a/arch/s390/include/asm/spinlock.h
+++ b/arch/s390/include/asm/spinlock.h
@@ -10,6 +10,8 @@
  #define __ASM_SPINLOCK_H
  
  #include <linux/smp.h>
+#include <asm/barrier.h>
+#include <asm/processor.h>
  
  #define SPINLOCK_LOCKVAL (S390_lowcore.spinlock_lockval)
  
@@ -97,6 +99,7 @@ static inline void arch_spin_unlock_wait(arch_spinlock_t *lock)
  {
         while (arch_spin_is_locked(lock))
                 arch_spin_relax(lock);
+       smp_acquire__after_ctrl_dep();
  }
  
  /*
diff --git a/arch/sh/include/asm/spinlock.h b/arch/sh/include/asm/spinlock.h

index bdc0f3b..416834b 100644 (file)
--- a/arch/sh/include/asm/spinlock.h
+++ b/arch/sh/include/asm/spinlock.h
@@ -19,14 +19,20 @@
  #error "Need movli.l/movco.l for spinlocks"
  #endif
  
+#include <asm/barrier.h>
+#include <asm/processor.h>
+
  /*
   * Your basic SMP spinlocks, allowing only a single CPU anywhere
   */
  
  #define arch_spin_is_locked(x)         ((x)->lock <= 0)
  #define arch_spin_lock_flags(lock, flags) arch_spin_lock(lock)
-#define arch_spin_unlock_wait(x) \
-       do { while (arch_spin_is_locked(x)) cpu_relax(); } while (0)
+
+static inline void arch_spin_unlock_wait(arch_spinlock_t *lock)
+{
+       smp_cond_load_acquire(&lock->lock, VAL > 0);
+}
  
  /*
   * Simple spin lock operations.  There are two variants, one clears IRQ's
diff --git a/arch/sparc/include/asm/spinlock_32.h b/arch/sparc/include/asm/spinlock_32.h

index bcc98fc..d9c5876 100644 (file)
--- a/arch/sparc/include/asm/spinlock_32.h
+++ b/arch/sparc/include/asm/spinlock_32.h
@@ -9,12 +9,15 @@
  #ifndef __ASSEMBLY__
  
  #include <asm/psr.h>
+#include <asm/barrier.h>
  #include <asm/processor.h> /* for cpu_relax */
  
  #define arch_spin_is_locked(lock) (*((volatile unsigned char *)(lock)) != 0)
  
-#define arch_spin_unlock_wait(lock) \
-       do { while (arch_spin_is_locked(lock)) cpu_relax(); } while (0)
+static inline void arch_spin_unlock_wait(arch_spinlock_t *lock)
+{
+       smp_cond_load_acquire(&lock->lock, !VAL);
+}
  
  static inline void arch_spin_lock(arch_spinlock_t *lock)
  {
diff --git a/arch/sparc/include/asm/spinlock_64.h b/arch/sparc/include/asm/spinlock_64.h

index 9689176..87990b7 100644 (file)
--- a/arch/sparc/include/asm/spinlock_64.h
+++ b/arch/sparc/include/asm/spinlock_64.h
@@ -8,6 +8,9 @@
  
  #ifndef __ASSEMBLY__
  
+#include <asm/processor.h>
+#include <asm/barrier.h>
+
  /* To get debugging spinlocks which detect and catch
   * deadlock situations, set CONFIG_DEBUG_SPINLOCK
   * and rebuild your kernel.
@@ -23,9 +26,10 @@
  
  #define arch_spin_is_locked(lp)        ((lp)->lock != 0)
  
-#define arch_spin_unlock_wait(lp)      \
-       do {    rmb();                  \
-       } while((lp)->lock)
+static inline void arch_spin_unlock_wait(arch_spinlock_t *lock)
+{
+       smp_cond_load_acquire(&lock->lock, !VAL);
+}
  
  static inline void arch_spin_lock(arch_spinlock_t *lock)
  {
diff --git a/arch/tile/lib/spinlock_32.c b/arch/tile/lib/spinlock_32.c

index 88c2a53..076c6cc 100644 (file)
--- a/arch/tile/lib/spinlock_32.c
+++ b/arch/tile/lib/spinlock_32.c
@@ -76,6 +76,12 @@ void arch_spin_unlock_wait(arch_spinlock_t *lock)
         do {
                 delay_backoff(iterations++);
         } while (READ_ONCE(lock->current_ticket) == curr);
+
+       /*
+        * The TILE architecture doesn't do read speculation; therefore
+        * a control dependency guarantees a LOAD->{LOAD,STORE} order.
+        */
+       barrier();
  }
  EXPORT_SYMBOL(arch_spin_unlock_wait);
  
diff --git a/arch/tile/lib/spinlock_64.c b/arch/tile/lib/spinlock_64.c

index c8d1f94..a4b5b2c 100644 (file)
--- a/arch/tile/lib/spinlock_64.c
+++ b/arch/tile/lib/spinlock_64.c
@@ -76,6 +76,12 @@ void arch_spin_unlock_wait(arch_spinlock_t *lock)
         do {
                 delay_backoff(iterations++);
         } while (arch_spin_current(READ_ONCE(lock->lock)) == curr);
+
+       /*
+        * The TILE architecture doesn't do read speculation; therefore
+        * a control dependency guarantees a LOAD->{LOAD,STORE} order.
+        */
+       barrier();
  }
  EXPORT_SYMBOL(arch_spin_unlock_wait);
  
diff --git a/arch/xtensa/include/asm/spinlock.h b/arch/xtensa/include/asm/spinlock.h

index 1d95fa5..a36221c 100644 (file)
--- a/arch/xtensa/include/asm/spinlock.h
+++ b/arch/xtensa/include/asm/spinlock.h
@@ -11,6 +11,9 @@
  #ifndef _XTENSA_SPINLOCK_H
  #define _XTENSA_SPINLOCK_H
  
+#include <asm/barrier.h>
+#include <asm/processor.h>
+
  /*
   * spinlock
   *
@@ -29,8 +32,11 @@
   */
  
  #define arch_spin_is_locked(x) ((x)->slock != 0)
-#define arch_spin_unlock_wait(lock) \
-       do { while (arch_spin_is_locked(lock)) cpu_relax(); } while (0)
+
+static inline void arch_spin_unlock_wait(arch_spinlock_t *lock)
+{
+       smp_cond_load_acquire(&lock->slock, !VAL);
+}
  
  #define arch_spin_lock_flags(lock, flags) arch_spin_lock(lock)
  
diff --git a/include/asm-generic/barrier.h b/include/asm-generic/barrier.h

index ab7b0bd..fe297b5 100644 (file)
--- a/include/asm-generic/barrier.h
+++ b/include/asm-generic/barrier.h
@@ -194,7 +194,7 @@ do {                                                                        \
  })
  #endif
  
-#endif
+#endif /* CONFIG_SMP */
  
  /* Barriers for virtual machine guests when talking to an SMP host */
  #define virt_mb() __smp_mb()
diff --git a/include/linux/spinlock_up.h b/include/linux/spinlock_up.h

index 8b3ac0d..0d9848d 100644 (file)
--- a/include/linux/spinlock_up.h
+++ b/include/linux/spinlock_up.h
@@ -6,6 +6,7 @@
  #endif
  
  #include <asm/processor.h>     /* for cpu_relax() */
+#include <asm/barrier.h>
  
  /*
   * include/linux/spinlock_up.h - UP-debug version of spinlocks.
@@ -25,6 +26,11 @@
  #ifdef CONFIG_DEBUG_SPINLOCK
  #define arch_spin_is_locked(x)         ((x)->slock == 0)
  
+static inline void arch_spin_unlock_wait(arch_spinlock_t *lock)
+{
+       smp_cond_load_acquire(&lock->slock, VAL);
+}
+
  static inline void arch_spin_lock(arch_spinlock_t *lock)
  {
         lock->slock = 0;
@@ -67,6 +73,7 @@ static inline void arch_spin_unlock(arch_spinlock_t *lock)
  
  #else /* DEBUG_SPINLOCK */
  #define arch_spin_is_locked(lock)      ((void)(lock), 0)
+#define arch_spin_unlock_wait(lock)    do { barrier(); (void)(lock); } while (0)
  /* for sched/core.c and kernel_lock.c: */
  # define arch_spin_lock(lock)          do { barrier(); (void)(lock); } while (0)
  # define arch_spin_lock_flags(lock, flags)     do { barrier(); (void)(lock); } while (0)
@@ -79,7 +86,4 @@ static inline void arch_spin_unlock(arch_spinlock_t *lock)
  #define arch_read_can_lock(lock)       (((void)(lock), 1))
  #define arch_write_can_lock(lock)      (((void)(lock), 1))
  
-#define arch_spin_unlock_wait(lock) \
-               do { cpu_relax(); } while (arch_spin_is_locked(lock))
-
  #endif /* __LINUX_SPINLOCK_UP_H */
author	Peter Zijlstra <peterz@infradead.org>
	Thu, 26 May 2016 08:35:03 +0000 (10:35 +0200)
committer	Ingo Molnar <mingo@kernel.org>
	Tue, 14 Jun 2016 09:55:15 +0000 (11:55 +0200)
arch/alpha/include/asm/spinlock.h		patch \| blob \| history
arch/arc/include/asm/spinlock.h		patch \| blob \| history
arch/arm/include/asm/spinlock.h		patch \| blob \| history
arch/blackfin/include/asm/spinlock.h		patch \| blob \| history
arch/hexagon/include/asm/spinlock.h		patch \| blob \| history
arch/ia64/include/asm/spinlock.h		patch \| blob \| history
arch/m32r/include/asm/spinlock.h		patch \| blob \| history
arch/metag/include/asm/spinlock.h		patch \| blob \| history
arch/mips/include/asm/spinlock.h		patch \| blob \| history
arch/mn10300/include/asm/spinlock.h		patch \| blob \| history
arch/parisc/include/asm/spinlock.h		patch \| blob \| history
arch/s390/include/asm/spinlock.h		patch \| blob \| history
arch/sh/include/asm/spinlock.h		patch \| blob \| history
arch/sparc/include/asm/spinlock_32.h		patch \| blob \| history
arch/sparc/include/asm/spinlock_64.h		patch \| blob \| history
arch/tile/lib/spinlock_32.c		patch \| blob \| history
arch/tile/lib/spinlock_64.c		patch \| blob \| history
arch/xtensa/include/asm/spinlock.h		patch \| blob \| history
include/asm-generic/barrier.h		patch \| blob \| history
include/linux/spinlock_up.h		patch \| blob \| history