聊聊闪存存储的延迟可预测性

SSDFans 2023-07-21 08:59


如何利用神经网络预测闪存尾端延迟的发生

    由于用户对低且稳定的延迟(微秒级)的需求越来越大,人们对SSD的百分比延迟越来越关心,即SSD有99%的概率可以提供低且稳定的延迟,但有1%的概率产生几倍于正常情况的延迟,而这1%的高延迟被称为尾端延迟。尾端延迟有什么影响?如何降低尾端延迟的影响?如何在存储环境下利用神经网络?这些疑问,本文将一一解答。


尾端延迟与Hedged Request

百分比延迟

    也许你已经查了维基百科中”百分比延迟“的定义,但我想对大多数人而言有点晦涩难懂,下面我将举一个简单的例子以帮助你理解。

    首先,我们先列举出一系列收集到的延迟:

23,20,21,20,23,20,45,21,25,25

    对它们排序:

20,20,20,21,21,23,23,25,25,45

    接下来可以选择前x%的延迟,例如假设我们想要得到50th百分比延迟,则选择前5个延迟:

20,20,20,21,21

    然后选择这一组延迟中最大的那个——即21——就是这一组延迟中的50th百分比延迟(也可以写作p50),同理,p90是25。

尾端延迟

    尾端延迟就是百分比延迟中末尾的(通常p99之后)那些延迟。看起来尾端延迟占比并不多,但当系统处理的请求达到10^6个数量级,可能足足有104个请求处理延迟远高于正常情况——你不会想成为那不幸的1%,对吗?

    分析SSD的内部行为后,本文作者认为尾端延迟的产生源自SSD内部日益复杂的内部活动,如垃圾回收、负载均衡等,和用户请求的冲突。为了降低尾端延迟或者降低尾端延迟的影响,业界提出的方案分为两大类:

  • 白盒子方案

此时SSD内部的行为可知,通过改进SSD内部架构来降低尾端延迟。这种方式无疑是直接而强有效的,但是不利于推广到市场。

  • 灰盒子方案

此时不需要修改SSD的内部架构,但是需要修改上层的软件栈。

  • 黑盒子方案

以各种预测为代表,既不需要修改上层软件栈,也不需要修改SSD内部架构,是目前最流行的解决方案。其中一个经典的方案是Hedged Request,它的原理和应用环境将在下文中介绍。

Hedged Request

    为了保证数据安全、实现负载均衡,现代的存储系统通常存在一定冗余,而多个不同的SSD的内部行为同时和用户请求产生冲突的概率非常低。基于这样的思考,Hedged  Request将一个请求发给一个SSD后,若等待请求完成的时间超过了阈值,则重发请求到另一个可用的SSD。如下图所示:

    然而,传统Hedged Request中,快SSD需要等待一段时间(等待慢SSD处理的时间超过阈值)后才能处理请求,对于微秒级SSD而言,这个等待时间是致命的。如果可以学习SSD的特征,预测将要变慢的SSD而及时将请求重发到快SSD中,则可以节约出等待的时间,从而降低闪存组的尾端延迟——这就是LinnOS完成的工作,如下图所示,用户发送请求后,若经过LinnOS网络预测得知该SSD将变慢,则提前告知用户重发请求,随后请求将被送到下一个SSD,减少了Hedged Request中的等待时间。


LinnOS的三大挑战

    设计LinnOS存在三大挑战,接下来将一一阐述。

  • 对用户输出什么结果?

    需要输出具体的延迟(如120μs)吗?虽然这样更灵活,但是一方面,对用户而言,120μs或者125μs其实区别不大,另一方面,如此精确的输出意味着准确率低,并不划算。那么如果输出一个延迟范围,如80~100μs、100~120μs呢?此时准确率稍高了些,但不够(仅60%-70%),处于区间交界处的延迟往往预测不准确。回顾Hedged Request的原理,其实对用户而言,知道SSD是”快“或者”慢“就足够了!所以LinnOS使用简单的二分类模型。

  • 使用什么信息进行预测?

    看起来一系列信息都和SSD快或慢有关:读写请求?请求的块内偏移?长期的写入历史?然而,作者发现这些请求都对提高精确度没有明显帮助。首先,由于当前SSD常有内置写缓存,写之后的读延迟常常没有明显提高,更为常见的其实是数据从缓存”冲“(flush)入SSD后,读延迟会更高。其次,一组I/O请求会通过条带均匀地写入各个通道或者芯片,它们写入同一个芯片的概率很低,所以块内偏移这个特征其实并不重要。最后,GC或者flush通常发生时间短,短期写入历史足矣预测。

    因此,可以使用SSD当前I/O队列长度来预测SSD快或者慢:一个直观的感受是,当I/O队列较长时,SSD处理通常比较慢。但是这样并不能体现SSD的内部活动的发生,因此额外增加了历史四条请求进入SSD时的队列长度和完成请求的时间。若某个请求进入SSD时队列短而完成请求的时间长,意味着SSD内部行为可能和用户请求冲突了。

  • 如何最小化预测错误的影响?

    作者分析发现,若将一个快的SSD预测为慢的从而错误地重发了,将带来微秒级延迟,而若将一个慢的SSD预测为快,将带来毫秒级延迟,比第一种情况严重许多,所以作者在训练时对第二种情况施加了更加严重的惩罚以减少它们的发生。此外,还补充了hedged request以减少预测失败的损失。


实验结果与总结

    作者上层使用了不同的软件产生负载,底层使用同构的消费级SSD阵列或者异构企业级SSD阵列测试它们的表现,以读延迟为指标展示结果。总共比较了7种不同的方案:

  • Base:无优化

  • Clone:同时发送两份请求,选择先返回的SSD的结果返回给用户

  • Hedge95:等待p95之后重发请求

  • Hedge IP(inflection point):和上一个相比,使用针对负载优化后的等待时间

  • HeurSim:队列较长时重发请求

  • HeurAdv:队列较长、且考虑历史信息(和LinnOS一样)后决定重发请求

  • LinnOS-Raw:没有hedged补偿的LinnOS

  • LinnOS+HL:最终的LinnOS方案

实验结果如下图:

The End

致谢


感谢本次论文解读者,来自华东师范大学的硕士生俞丁翠,主要研究方向为智能存储。


 点一下“阅读原文”获取论文

SSDFans AI+IOT+闪存,万物存储、万物智能、万物互联的闪存2.0时代即将到来,你,准备好了吗?
评论 (0)
  • 文/Leon编辑/cc孙聪颖‍《中国家族企业传承研究报告》显示,超四成“企二代” 明确表达接班意愿,展现出对家族企业延续发展的主动担当。中国研究数据服务平台(CNRDS)提供的精准数据进一步佐证:截至 2022 年,已有至少 280 家上市家族企业完成权杖交接,其中八成新任掌门人为创始人之子,凸显家族企业代际传承中 “子承父业” 的主流模式。然而,对于“企二代” 而言,接棒掌舵绝非易事。在瞬息万变的商业环境中,他们既要在白热化的市场竞争中开拓创新、引领企业突破发展瓶颈,又需应对来自父辈管理层的经
    华尔街科技眼 2025-05-06 18:17 48浏览
  • 在过去的很长一段时间里,外卖市场呈现出美团和饿了么双寡头垄断的局面。美团凭借先发优势、强大的地推团队以及精细化的运营策略,在市场份额上长期占据领先地位。数据显示,截至2024年上半年,美团外卖以68.2%的市场份额领跑外卖行业,成为当之无愧的行业老大。其业务广泛覆盖,从一线城市的繁华商圈到二三线城市的大街小巷,几乎无处不在,为无数消费者提供便捷的外卖服务。饿了么作为阿里本地生活服务的重要一环,依托阿里强大的资金和技术支持,也在市场中站稳脚跟,以25.4%的份额位居第二。尽管市场份额上与美团有一定
    用户1742991715177 2025-05-06 19:43 119浏览
  • 后摄像头是长这个样子,如下图。5孔(D-,D+,5V,12V,GND),说的是连接线的个数,如下图。4LED,+12V驱动4颗LED灯珠,给摄像头补光用的,如下图。打开后盖,发现里面有透明白胶(防水)和白色硬胶(固定),用合适的工具,清理其中的胶状物。BOT层,AN3860,Panasonic Semiconductor (松下电器)制造的,Cylinder Motor Driver IC for Video Camera,如下图。TOP层,感光芯片和广角聚焦镜头组合,如下图。感光芯片,看着是玻
    liweicheng 2025-05-07 23:55 499浏览
  • 温度传感器的工作原理依据其类型可分为以下几种主要形式:一、热电阻温度传感器利用金属或半导体材料的电阻值随温度变化的特性实现测温:l ‌金属热电阻‌(如铂电阻 Pt100、Pt1000):高温下电阻值呈线性增长,稳定性高,适用于工业精密测温。l ‌热敏电阻‌(NTC/PTC):NTC 热敏电阻阻值随温度升高而下降,PTC 则相反;灵敏度高但线性范围较窄,常用于电子设备温控。二、热电偶传感器基于‌塞贝克效应‌(Seebeck effect):两种不同
    锦正茂科技 2025-05-09 13:31 259浏览
  • 这款无线入耳式蓝牙耳机是长这个样子的,如下图。侧面特写,如下图。充电接口来个特写,用的是卡座卡在PCB板子上的,上下夹紧PCB的正负极,如下图。撬开耳机喇叭盖子,如下图。精致的喇叭(HY),如下图。喇叭是由电学产生声学的,具体结构如下图。电池包(AFS 451012  21 12),用黄色耐高温胶带进行包裹(安规需求),加强隔离绝缘的,如下图。451012是电池包的型号,聚合物锂电池+3.7V 35mAh,详细如下图。电路板是怎么拿出来的呢,剪断喇叭和电池包的连接线,底部抽出PCB板子
    liweicheng 2025-05-06 22:58 660浏览
  • 飞凌嵌入式作为龙芯合作伙伴,隆重推出FET-2K0300i-S全国产自主可控工业级核心板!FET-2K0300i-S核心板基于龙芯2K0300i工业级处理器开发设计,集成1个64位LA264处理器,主频1GHz,提供高效的计算能力;支持硬件ECC;2K0300i还具备丰富的连接接口USB、SDIO、UART、SPI、CAN-FD、Ethernet、ADC等一应俱全,龙芯2K0300i支持四路CAN-FD接口,具备良好的可靠性、实时性和灵活性,可满足用户多路CAN需求。除性价比超高的国产处理器外,
    飞凌嵌入式 2025-05-07 11:54 98浏览
  • 随着智能驾驶时代到来,汽车正转变为移动计算平台。车载AI技术对存储器提出新挑战:既要高性能,又需低功耗和车规级可靠性。贞光科技代理的紫光国芯车规级LPDDR4存储器,以其卓越性能成为国产芯片产业链中的关键一环,为智能汽车提供坚实的"记忆力"支持。作为官方授权代理商,贞光科技通过专业技术团队和完善供应链,让这款国产存储器更好地服务国内汽车厂商。本文将探讨车载AI算力需求现状及贞光科技如何通过紫光国芯LPDDR4产品满足市场需求。 车载AI算力需求激增的背景与挑战智能驾驶推动算力需求爆发式
    贞光科技 2025-05-07 16:54 230浏览
  • 硅二极管温度传感器是一种基于硅半导体材料特性的测温装置,其核心原理是利用硅二极管的电学参数(如正向压降或电阻)随温度变化的特性实现温度检测。以下是其工作原理、技术特点及典型应用:一、工作原理1、‌PN结温度特性‌硅二极管由PN结构成,当温度变化时,其正向电压 VF与温度呈线性负相关关系。例如,温度每升高1℃,VF约下降2 mV。2、‌电压—温度关系‌通过jing确测量正向电压的微小变化,可推算出环境温度值。部分型号(如SI410)在宽温域内(如1.4 K至475 K)仍能保持高线性度。
    锦正茂科技 2025-05-09 13:52 286浏览
  • UNISOC Miracle Gaming奇迹手游引擎亮点:• 高帧稳帧:支持《王者荣耀》等主流手游90帧高画质模式,连续丢帧率最高降低85%;• 丝滑操控:游戏冷启动速度提升50%,《和平精英》开镜开枪操作延迟降低80%;• 极速网络:专属游戏网络引擎,使《王者荣耀》平均延迟降低80%;• 智感语音:与腾讯GVoice联合,弱网环境仍能保持清晰通话;• 超高画质:游戏画质增强、超级HDR画质、游戏超分技术,优化游戏视效。全球手游市场规模日益壮大,游戏玩家对极致体验的追求愈发苛刻。紫光展锐全新U
    紫光展锐 2025-05-07 17:07 352浏览
  • 文/郭楚妤编辑/cc孙聪颖‍相较于一众措辞谨慎、毫无掌舵者个人风格的上市公司财报,利亚德的财报显得尤为另类。利亚德光电集团成立于1995年,是一家以LED显示、液晶显示产品设计、生产、销售及服务为主业的高新技术企业。自2016年年报起,无论业绩优劣,董事长李军每年都会在财报末尾附上一首七言打油诗,抒发其对公司当年业绩的感悟。从“三年翻番顺大势”“智能显示我第一”“披荆斩棘幸从容”等词句中,不难窥见李军的雄心壮志。2012年,利亚德(300296.SZ)在深交所创业板上市。成立以来,该公司在细分领
    华尔街科技眼 2025-05-07 19:25 465浏览
  • 二位半 5线数码管的驱动方法这个2位半的7段数码管只用5个管脚驱动。如果用常规的7段+共阳/阴则需要用10个管脚。如果把每个段看成独立的灯。5个管脚来点亮,任选其中一个作为COM端时,另外4条线可以单独各控制一个灯。所以实际上最多能驱动5*4 = 20个段。但是这里会有一个小问题。如果想点亮B1,可以让第3条线(P3)置高,P4 置低,其它阳极连P3的灯对应阴极P2 P1都应置高,此时会发现C1也会点亮。实际操作时,可以把COM端线P3设置为PP输出,其它线为OD输出。就可以单独控制了。实际的驱
    southcreek 2025-05-07 15:06 582浏览
  • Matter协议是一个由Amazon Alexa、Apple HomeKit、Google Home和Samsung SmartThings等全球科技巨头与CSA联盟共同制定的开放性标准,它就像一份“共生契约”,能让原本相互独立的家居生态在应用层上握手共存,同时它并非另起炉灶,而是以IP(互联网协议)为基础框架,将不同通信协议下的家居设备统一到同一套“语义规则”之下。作为应用层上的互通标准,Matter协议正在重新定义智能家居行业的运行逻辑,它不仅能向下屏蔽家居设备制造商的生态和系统,让设备、平
    华普微HOPERF 2025-05-08 11:40 408浏览
我要评论
0
0