【深入理解Linux内核锁】|原子操作

原创 嵌入式艺术 2023-06-07 11:30

【深入理解Linux内核锁】三、原子操作

1、原子操作思想

原子操作(atomic operation),不可分割的操作。其通过原子变量来实现,以保证单个CPU周期内,读写该变量,不能被打断,进而判断该变量的值,来解决并发引起的互斥。

Atomic类型的函数可以在执行期间禁止中断,并保证在访问变量时的原子性。

同时,Linux内核提供了两类原子操作的接口,分别是针对整型变量的原子操作。    

2、整型变量原子操作

2.1 API接口

对于整形变量的原子操作,内核提供了一系列的 API接口

/*设置原子变量的值*/
atomic_t v = ATOMIC_INIT(0);            /* 定义原子变量v并初始化为0 */
void atomic_set(atomic_t *v, int i);    /* 设置原子变量的值为i */

/*获取原子变量的值*/
atomic_read(atomic_t *v);          /* 返回原子变量的值*/

/*原子变量的加减*/
void atomic_add(int i, atomic_t *v);      /* 原子变量增加i */
void atomic_sub(int i, atomic_t *v);      /* 原子变量减少i */

/*原子变量的自增,自减*/
void atomic_inc(atomic_t *v);    /* 原子变量增加1 */
void atomic_dec(atomic_t *v);        /* 原子变量减少1 */

/*原子变量的操作并测试*/
int atomic_inc_and_test(atomic_t *v);  /*进行对应操作后,测试原子变量值是否为0*/
int atomic_dec_and_test(atomic_t *v);
int atomic_sub_and_test(int i, atomic_t *v);

/*原子变量的操作并返回*/
int atomic_add_return(int i, atomic_t *v)/*进行对应操作后,返回新的值*/
int atomic_sub_return(int i, atomic_t *v);
int atomic_inc_return(atomic_t *v);
int atomic_dec_return(atomic_t *v);

2.2 API实现

我们下面就介绍几个稍微有代表性的接口实现

以下基于Linux内核源码4.19,刚看是看的时候,有点摸不着头脑,因为定义的地方和引用的地方较多,不太容易找到,后来才慢慢得窥门径。

2.2.1 原子变量结构体

typedef struct {
    int counter;
atomic_t;

结构体名称atomic_t

文件位置include/linux/types.h

主要作用:原子变量结构体,该结构体只包含一个整型成员变量counter,用于存储原子变量的值。

2.2.2 设置原子变量操作

2.2.2.1 ATOMIC_INIT
#define ATOMIC_INIT(i) { (i) }

函数介绍:定义了一个ATOMIC类型的变量,并初始化为给定的值。

文件位置arch/arm/include/asm/atomic.h,由include/linux/atomic.h引用

实现方法:这个宏定义比较简单,通过大括号将值包裹起来作为一个结构体,结构体的第一个成员就用就是给定的该值。

2.2.2.2 atomic_set
#define atomic_set(v,i) WRITE_ONCE(((v)->counter), (i))

#define WRITE_ONCE(x, val) \
({       \
    union { typeof(x) __val; char __c[1]; } __u = \
        { .__val = (__force typeof(x)) (val) }; \
    __write_once_size(&(x), __u.__c, sizeof(x)); \
    __u.__val;     \
})


static __always_inline void __write_once_size(volatile void *p, void *res, int size)
{
    switch (size) {
    case 1: *(volatile __u8 *)p = *(__u8 *)res; break;
    case 2: *(volatile __u16 *)p = *(__u16 *)res; break;
    case 4: *(volatile __u32 *)p = *(__u32 *)res; break;
    case 8: *(volatile __u64 *)p = *(__u64 *)res; break;
    default:
        barrier();
        __builtin_memcpy((void *)p, (const void *)res, size);
        barrier();
    }
}

函数介绍:该函数也用作初始化原子变量

文件位置:由include/linux/atomic.h引用arch/arm/include/asm/atomic.h,再引用include/linux/compiler.h

实现方式:通过调用WRITE_ONCE来实现,其中WRITE_ONCE宏实现了一些屏蔽编译器优化的技巧,确保写入操作是原子的。

  1. atomic_set调用WRITE_ONCEi的值写入原子变量(v)->counter中,WRITE_ONCE以保证操作的原子性
  2. WRITE_ONCE用来保证操作的原子性
    1. 创建union联合体,包括__val__C成员变量
    2. 定义一个__U变量,使用强制转换将参数__val转换为typeof(x)类型,传递给联合体变量__u.__val
    3. 调用__write_once_size函数,将__c的值写入到x指向的内存地址中。
    4. 函数返回__u.__val。
  3. union联合体
    1. 它的特点是存储多种数据类型的值,但是所有成员共享同一个内存空间,这样可以节省内存空间。
    2. 主要作用是将一个非字符类型的数据x强制转换为一个字符类型的数据,以字符类型数据来访问该区块的内存单元。
  4. __write_once_size函数实现了操作的原子性,核心有以下几点:
    1. 该函数在向内存写入数据时使用了volatile关键字,告诉编译器不要进行优化,每次操作都从内存中读取最新的值。
    2. 函数中的switch语句保证了对不同大小的数据类型使用不同的存储方式,可以保证内存访问的原子性。
    3. 对于默认情况,则使用了__builtin_memcpy函数进行复制,而这个函数具有原子性。
    4. barrier()函数指示CPU要完成所有之前的内存操作,以及确保执行顺序与其他指令不发生重排。

2.2.3 原子变量的加减

2.2.3.1 ATOMIC_OPS
/*
 * ARMv6 UP and SMP safe atomic ops.  We use load exclusive and
 * store exclusive to ensure that these are atomic.  We may loop
 * to ensure that the update happens.
 */


#define ATOMIC_OP(op, c_op, asm_op)     \
static inline void atomic_##op(int i, atomic_t *v)   \
{         \
    unsigned long tmp;      \
    int result;       \
                                    \
    prefetchw(&v->counter);      \
    __asm__ __volatile__("@ atomic_" #op "\n"   \
"1: ldrex %0, [%3]\n"      \
" " #asm_op " %0, %0, %4\n"     \
" strex %1, %0, [%3]\n"      \
" teq %1, #0\n"      \
" bne 1b"       \
    : "=&r" (result), "=&r" (tmp), "+Qo" (v->counter)  \
    : "r" (&v->counter), "Ir" (i)     \
    : "cc");       \
}         \

#define ATOMIC_OP_RETURN(op, c_op, asm_op)    \
static inline int atomic_##op##_return_relaxed(int i, atomic_t *v) \
{         \
    unsigned long tmp;      \
    int result;       \
                                    \
    prefetchw(&v->counter);      \
                                    \
    __asm__ __volatile__("@ atomic_" #op "_return\n"  \
"1: ldrex %0, [%3]\n"      \
" " #asm_op " %0, %0, %4\n"     \
" strex %1, %0, [%3]\n"      \
" teq %1, #0\n"      \
" bne 1b"       \
    : "=&r" (result), "=&r" (tmp), "+Qo" (v->counter)  \
    : "r" (&v->counter), "Ir" (i)     \
    : "cc");       \
                                    \
    return result;       \
}


#define ATOMIC_FETCH_OP(op, c_op, asm_op)    \
static inline int atomic_fetch_##op##_relaxed(int i, atomic_t *v) \
{         \
    unsigned long tmp;      \
    int result, val;      \
                                    \
    prefetchw(&v->counter);      \
                                    \
    __asm__ __volatile__("@ atomic_fetch_" #op "\n"   \
"1: ldrex %0, [%4]\n"      \
" " #asm_op " %1, %0, %5\n"     \
" strex %2, %1, [%4]\n"      \
" teq %2, #0\n"      \
" bne 1b"       \
    : "=&r" (result), "=&r" (val), "=&r" (tmp), "+Qo" (v->counter) \
    : "r" (&v->counter), "Ir" (i)     \
    : "cc");       \
                                    \
    return result;       \
}


#define ATOMIC_OPS(op, c_op, asm_op)     \
    ATOMIC_OP(op, c_op, asm_op)     \
    ATOMIC_OP_RETURN(op, c_op, asm_op)    \
    ATOMIC_FETCH_OP(op, c_op, asm_op)

atomic_add找半天,还找到了不同的架构下面。:(

原来内核通过各种宏定义将其操作全部管理起来,宏定义在内核中的使用也是非常广泛了。

函数作用:通过一些列宏定义,来实现原子变量的addsubandor等原子变量操作

文件位置arch/arm/include/asm/atomic.h

实现方式

我们以atomic_##op为例来介绍,其他大同小异!

#define ATOMIC_OP(op, c_op, asm_op)     \
static inline void atomic_##op(int i, atomic_t *v)   \
{         \
    unsigned long tmp;      \
    int result;       \
                                    \
    prefetchw(&v->counter);      \
    __asm__ __volatile__("@ atomic_" #op "\n"   \
"1: ldrex %0, [%3]\n"      \
" " #asm_op " %0, %0, %4\n"     \
" strex %1, %0, [%3]\n"      \
" teq %1, #0\n"      \
" bne 1b"       \
    : "=&r" (result), "=&r" (tmp), "+Qo" (v->counter)  \
    : "r" (&v->counter), "Ir" (i)     \
    : "cc");       \
}  

  1. 首先是函数名称atomic_##op,通过##来实现字符串的拼接,使函数名称可变,如atomic_addatomic_sub
  2. 调用prefetchw函数,预取数据到L1缓存,方便操作,提高程序性能,但是不要滥用。
  3. __asm__ __volatile__:表示汇编指令
  4. "@ atomic_" #op "\n":为汇编注释
  5. "1: ldrex %0, [%3]\n":将%3存储地址的数据,读入到%0地址中,ldrex为独占式的读取操作。
  6. " " #asm_op " %0, %0, %4\n"" #asm_op "表示作为宏定义传进来的参数,表示不同的操作码addsub等,操作%0%4对应的地址的值,并将结果返回到%0地址处
  7. " strex %1, %0, [%3]\n" :表示将%0地址处的值写入%3地址处,strex为独占式的写操作,写入的结果会返回到%1地址中
  8. " teq %1, #0\n":测试%1寄存器的值是否为0,如果不等于0,则执行下面的" bne 1b" 操作,跳转到1代码标签的位置,也就是ldrex前面的1的位置
  9. : "=&r" (result), "=&r" (tmp), "+Qo" (v->counter):根据汇编语法,前两个为输出操作数,第三个为输入输出操作数
  10. : "r" (&v->counter), "Ir" (i):根据汇编语法,这两个为输入操作数
  11. : "cc":表示可能会修改条件码寄存器,编译期间需要优化。

通过ldrexstrex两个独占式的操作,保证了读写的原子性。

2.2.3.2 atomic_add和atomic_sub定义
ATOMIC_OPS(add, +=, add)
ATOMIC_OPS(sub, -=, sub)

通过宏定义来实现atomic_addatomic_sub的定义,下面我们就不一一分析了,原理都是通过ARM提供的ldrex strex也就是我们常说的LoadStore指令实现读取操作,确保操作的原子性。

3、位原子操作

3.1 API接口

void set_bit(nr, void *addr);  // 设置位:设置addr地址的第nr位,所谓设置位即是将位写为1
void clear_bit(nr, void *addr);  // 清除位:清除addr地址的第nr位,所谓清除位即是将位写为0
void change_bit(nr, void *addr)// 改变位:对addr地址的第nr位进行反置。
test_bit(nr, void *addr);   // 测试位:返回addr地址的第nr位。
int test_and_set_bit(nr, void *addr);// 测试并设置位
int test_and_clear_bit(nr, void *addr)// 测试并清除位
int test_and_change_bit(nr, void *addr);// 测试并改变位

3.2 API实现

同样,我们还是简单介绍几个接口,其他核心实现原理相同

3.2.1 set_bit

#define set_bit(nr,p)   ATOMIC_BITOP(set_bit,nr,p)

#define ATOMIC_BITOP(name,nr,p)   \
    (__builtin_constant_p(nr) ? ____atomic_##name(nr, p) : _##name(nr,p))


extern void _set_bit(int nr, volatile unsigned long * p);

/*
 * These functions are the basis of our bit ops.
 *
 * First, the atomic bitops. These use native endian.
 */

static inline void ____atomic_set_bit(unsigned int bit, volatile unsigned long *p)
{
    unsigned long flags;
    unsigned long mask = BIT_MASK(bit);

    p += BIT_WORD(bit);

    raw_local_irq_save(flags);
    *p |= mask;
    raw_local_irq_restore(flags);
}

#define BIT_MASK(nr)  (1UL << ((nr) % BITS_PER_LONG))
#define BIT_WORD(nr)  ((nr) / BITS_PER_LONG)

#ifdef CONFIG_64BIT
#define BITS_PER_LONG 64
#else
#define BITS_PER_LONG 32
#endif /* CONFIG_64BIT */

函数介绍:该函数用于原子操作某个地址的某一位。

文件位置/arch/arm/include/asm/bitops.h

实现方式

  1. __builtin_constant_pGCC的一个内置函数,用来判断表达式是否为常量,如果为常量,则返回值为1
  2. ____atomic_set_bit函数中BIT_MASK,用于获取操作位的掩码,将要设置的位设置为1,其他为0
  3. BIT_WORD:确定要操作位的偏移,要偏移多少个字
  4. 通过raw_local_irq_saveraw_local_irq_restore中断屏蔽来保证位操作*p |= mask;的原子性

4、总结

该文章主要详细了解了Linux内核锁的原子操作,原子操作分为两种:整型变量的原子操作和位原子操作。

  • 整型变量的原子操作:通过ldrexstrex来实现
  • 位原子操作:通过中断屏蔽来实现。
嵌入式艺术
MEET SPRING
万物更生,新岁开启


嵌入式艺术 分享一些高级嵌入式相关知识,包括:计算机基础、操作系统、Linux驱动、Linux内核、RT-thread等,除此之外,并且会组织一些简单的训练项目,一起成长。 我的创作理念:专注分享高质量的嵌入式文章,让大家读有所得!
评论
  • 在2024年的科技征程中,具身智能的发展已成为全球关注的焦点。从实验室到现实应用,这一领域正以前所未有的速度推进,改写着人类与机器的互动边界。这一年,我们见证了具身智能技术的突破与变革,它不仅落地各行各业,带来新的机遇,更在深刻影响着我们的生活方式和思维方式。随着相关技术的飞速发展,具身智能不再仅仅是一个技术概念,更像是一把神奇的钥匙。身后的众多行业,无论愿意与否,都像是被卷入一场伟大变革浪潮中的船只,注定要被这股汹涌的力量重塑航向。01为什么是具身智能?为什么在中国?最近,中国具身智能行业的进
    艾迈斯欧司朗 2025-02-28 15:45 221浏览
  • RGB灯光无法同步?细致的动态光效设定反而成为产品客诉来源!随着科技的进步和消费者需求变化,电脑接口设备单一功能性已无法满足市场需求,因此在产品上增加「动态光效」的形式便应运而生,藉此吸引消费者目光。这种RGB灯光效果,不仅能增强电脑周边产品的视觉吸引力,还能为用户提供个性化的体验,展现独特自我风格。如今,笔记本电脑、键盘、鼠标、鼠标垫、耳机、显示器等多种电脑接口设备多数已配备动态光效。这些设备的灯光效果会随着音乐节奏、游戏情节或使用者的设置而变化。想象一个画面,当一名游戏玩家,按下电源开关,整
    百佳泰测试实验室 2025-02-27 14:15 137浏览
  • 1,微软下载免费Visual Studio Code2,安装C/C++插件,如果无法直接点击下载, 可以选择手动install from VSIX:ms-vscode.cpptools-1.23.6@win32-x64.vsix3,安装C/C++编译器MniGW (MinGW在 Windows 环境下提供类似于 Unix/Linux 环境下的开发工具,使开发者能够轻松地在 Windows 上编写和编译 C、C++ 等程序.)4,C/C++插件扩展设置中添加Include Path 5,
    黎查 2025-02-28 14:39 140浏览
  •           近日受某专业机构邀请,参加了官方举办的《广东省科技创新条例》宣讲会。在与会之前,作为一名技术工作者一直认为技术的法例都是保密和侵权方面的,而潜意识中感觉法律有束缚创新工作的进行可能。通过一个上午学习新法,对广东省的科技创新有了新的认识。广东是改革的前沿阵地,是科技创新的沃土,企业是创新的主要个体。《广东省科技创新条例》是广东省为促进科技创新、推动高质量发展而制定的地方性法规,主要内容包括: 总则:明确立法目
    广州铁金刚 2025-02-28 10:14 103浏览
  • 一、VSM的基本原理震动样品磁强计(Vibrating Sample Magnetometer,简称VSM)是一种灵敏且高效的磁性测量仪器。其基本工作原理是利用震动样品在探测线圈中引起的变化磁场来产生感应电压,这个感应电压与样品的磁矩成正比。因此,通过测量这个感应电压,我们就能够精确地确定样品的磁矩。在VSM中,被测量的样品通常被固定在一个震动头上,并以一定的频率和振幅震动。这种震动在探测线圈中引起了变化的磁通量,从而产生了一个交流电信号。这个信号的幅度和样品的磁矩有着直接的关系。因此,通过仔细
    锦正茂科技 2025-02-28 13:30 100浏览
  • 振动样品磁强计是一种用于测量材料磁性的精密仪器,广泛应用于科研、工业检测等领域。然而,其测量准确度会受到多种因素的影响,下面我们将逐一分析这些因素。一、温度因素温度是影响振动样品磁强计测量准确度的重要因素之一。随着温度的变化,材料的磁性也会发生变化,从而影响测量结果的准确性。因此,在进行磁性测量时,应确保恒温环境,以减少温度波动对测量结果的影响。二、样品制备样品的制备过程同样会影响振动样品磁强计的测量准确度。样品的形状、尺寸和表面处理等因素都会对测量结果产生影响。为了确保测量准确度,应严格按照规
    锦正茂科技 2025-02-28 14:05 134浏览
  • 更多生命体征指标风靡的背后都只有一个原因:更多人将健康排在人生第一顺位!“AGEs,也就是晚期糖基化终末产物,英文名Advanced Glycation End-products,是存在于我们体内的一种代谢产物” 艾迈斯欧司朗亚太区健康监测高级市场经理王亚琴说道,“相信业内的朋友都会有关注,最近该指标的热度很高,它可以用来评估人的生活方式是否健康。”据悉,AGEs是可穿戴健康监测领域的一个“萌新”指标,近来备受关注。如果站在学术角度来理解它,那么AGEs是在非酶促条件下,蛋白质、氨基酸
    艾迈斯欧司朗 2025-02-27 14:50 400浏览
  • 美国加州CEC能效跟DOE能效有什么区别?CEC/DOE是什么关系?美国加州CEC能效跟DOE能效有什么区别?CEC/DOE是什么关系?‌美国加州CEC能效认证与美国DOE能效认证在多个方面存在显著差异‌。认证范围和适用地区‌CEC能效认证‌:仅适用于在加利福尼亚州销售的电器产品。CEC认证的范围包括制冷设备、房间空调、中央空调、便携式空调、加热器、热水器、游泳池加热器、卫浴配件、光源、应急灯具、交通信号模块、灯具、洗碗机、洗衣机、干衣机、烹饪器具、电机和压缩机、变压器、外置电源、消费类电子设备
    张工nx808593 2025-02-27 18:04 120浏览
  •         近日,广电计量在聚焦离子束(FIB)领域编写的专业著作《聚焦离子束:失效分析》正式出版,填补了国内聚焦离子束领域实践性专业书籍的空白,为该领域的技术发展与知识传播提供了重要助力。         随着芯片技术不断发展,芯片的集成度越来越高,结构也日益复杂。这使得传统的失效分析方法面临巨大挑战。FIB技术的出现,为芯片失效分析带来了新的解决方案。它能够在纳米尺度上对芯片进行精确加工和分析。当芯
    广电计量 2025-02-28 09:15 116浏览
  • 在物联网领域中,无线射频技术作为设备间通信的核心手段,已深度渗透工业自动化、智慧城市及智能家居等多元场景。然而,随着物联网设备接入规模的不断扩大,如何降低运维成本,提升通信数据的传输速度和响应时间,实现更广泛、更稳定的覆盖已成为当前亟待解决的系统性难题。SoC无线收发模块-RFM25A12在此背景下,华普微创新推出了一款高性能、远距离与高性价比的Sub-GHz无线SoC收发模块RFM25A12,旨在提升射频性能以满足行业中日益增长与复杂的设备互联需求。值得一提的是,RFM25A12还支持Wi-S
    华普微HOPERF 2025-02-28 09:06 143浏览
我要评论
0
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦