分析丨HBM,并非固若金汤?

原创 AI芯天下 2024-08-09 20:30

·聚焦:人工智能、芯片等行业

欢迎各位客官关注、转发






前言
随着人工智能、机器学习等技术的快速发展,对高速且大容量内存的需求急剧增加。

HBM与AI芯片的产业链涵盖了从原材料供应、芯片设计、制造、封装测试到最终产品的多个环节,两者之间的博弈关系是典型的合作竞争关系。


作者 | 方文三
图片来源 |  网 络 


HBM现阶段面临的挑战和难点


①HBM的3D堆叠技术成本高昂,主要依赖于昂贵的硅中介层和TSV(硅通孔)。


例如,英伟达的H100加速卡物料成本为3000美元,而SK海力士提供的HBM芯片成本高达2000美元。


高成本是HBM普及的主要障碍,尤其是对于中小型厂商。尽管HBM在性能上具有明显优势,但其高昂的价格使得许多企业望而却步。


②HBM的高带宽特性使其产生的热量较高,需要有效的散热解决方案。


其2.5D封装结构会集聚热量,靠近CPU和GPU的布局又会加剧这种情况。


散热问题不仅影响HBM的性能,还可能导致芯片过热和性能下降。解决这一问题需要复杂的散热设计和材料选择。


③HBM的高带宽特性可能使得数据在传输过程中容易受到攻击和窃取,需要采取加密技术和访问控制等措施来保护数据安全。


数据安全性是HBM应用中不可忽视的因素。尽管有加密技术,但如何确保数据在传输和存储过程中的安全性仍然是一个挑战。


④HBM通过3D堆叠及TSV技术实现高带宽和低功耗,但这也带来了堆叠精度、TSV制作、热管理、电源和信号完整性等技术难点。


这些技术难点需要高精度的制造工艺和复杂的设计,以确保HBM的稳定性和可靠性。



AI芯片在寻求其他存储方案时的权衡


一方面,生产 HBM 需要先进的生产设备和工艺,而这些资源在短期内是有限的。


例如,台积电的 CoWoS 封装技术在满足HBM生产需求方面存在一定的产能瓶颈。


另一方面,随着AI芯片需求的快速增长,HBM的需求也急剧上升。


但HBM的生产周期较长,从设计到量产需要数月的时间,这使得其产能的提升速度难以跟上市场需求的增长速度。


AI芯片制造商在选择存储方案时,需要综合考虑性能、成本、功耗、产能等多方面的因素。


然而,HBM(高带宽内存)并非普通DRAM所能比拟,其价格已攀升至令人咋舌的水平。


在相同存储密度下,HBM的价格约为DDR5的五倍。


据最新数据显示,HBM在AI服务器成本中的占比高居第三,约占整体成本的9%,导致单机平均售价激增至18000美元。


以英伟达H100加速卡为例,其整体物料成本高达3000美元,其中HBM芯片的成本占比即达三分之二,达到2000美元之巨。


对于财力雄厚的行业巨头而言,他们或许能够继续加大投入,采购更大容量的HBM以满足需求。


然而,对于中小型厂商而言,高昂的HBM成本却成为了他们进军大模型领域的重大障碍。


随着AI技术在智能手机、电动汽车及云服务等领域的广泛应用,越来越多的企业开始寻求更为经济高效的解决方案。


部分小型企业因不愿承担高达20000美元的费用,而拒绝购买市场上被视为顶尖选择的英伟达高端GPU。



Tenstorrent成替代HBM的典型案例


在此背景下,Tenstorrent公司正积极筹备其第二代多功能AI芯片的年底上市。


该公司声称,在特定领域,其产品在能效及处理效率方面均优于英伟达AI GPU。


具体而言,Tenstorrent的Galaxy系统效率为英伟达DGX AI服务器的三倍,且成本降低了33%。


这一成就部分归功于公司未采用高成本的HBM技术,该内存芯片虽能高速传输大量数据,但亦是AI芯片高能耗与高价格的元凶之一。


在典型的AI芯片组中,GPU在执行任务时需频繁向内存发送数据,这就要求HBM具备高速数据传输能力。


而Tenstorrent则通过独特设计,大幅减少了此类数据传输需求。


这一创新方法使得公司芯片在某些AI开发领域能够替代GPU与HBM,为用户提供更为经济高效的选择。


今年3月,Tenstorrent已推出基于Grayskull架构的两款开发板——e75与e150。


这两款产品均定位于推理型AI图形处理器,采用Tensix Cores构建,集成了计算单元、片上网络、本地缓存及[小型RISC-V]核心,实现了芯片内部高效的数据流动。


它们专为追求经济高效、可定制的传统GPU替代方案的ML开发人员设计。


具体而言,Grayskull e75为一款75瓦PCIe Gen 4卡,售价600美元。


其内置一颗1GHz NPU芯片,集成96颗Tensix核心与96MB SRAM,并配备8GB LPDDR4 DRAM。


而Grayskull e150则在性能上有所提升,时钟频率增至1.2GHz,核心数量增加至120个,片上内存也相应提升至120MB,但片外DRAM仍维持8GB LPDDR4规格,功耗则上升至200瓦,售价为800美元。


值得强调的是,Grayskull架构在数据中心AI加速器(GPU/NPU)中独树一帜。


其Tensix核心排列方式包含多个CPU供计算单元使用,后者则融合了向量与矩阵引擎。这种结构化设计提高了数学单元的利用率,进而提升了每瓦性能。


此外,每个Tensix核心均配备1MB SRAM,提供了充足的片上内存资源。


与其他依赖大内存NPU的产品不同,Grayskull能够连接至外部内存以满足更多元化的需求。


尤为关键的是,Grayskull采用了标准DRAM而非昂贵的HBM技术,从而在成本上实现了大幅削减。


这一举措不仅符合吉姆·凯勒所倡导的成本效益原则,也为广大用户带来了更为实惠的AI解决方案。



未来AI芯片市场的竞争格局将更加多元化


在全球数字化与智能化浪潮的推动下,AI芯片作为驱动这一转型的核心力量,正步入前所未有的快速发展期。


根据IMARC的权威研究预测,至2029年,全球人工智能芯片市场将实现显著扩张,市场规模有望达到8960亿美元。


这一显著增长,既受益于人工智能技术的持续飞跃,也得益于消费电子产品领域对AI芯片需求的激增,以及行业内创新活力的持续释放。


同时,得益于政策的有力支持与市场需求的持续扩大,中国AI芯片市场展现出强劲的增长势头,预计至2024年,其市场规模将成功突破千亿元人民币大关。


尤为值得注意的是,随着技术的持续进步,AI芯片的成本正逐步趋于合理化。


在云端训练芯片与边缘AI芯片领域,这一趋势尤为显著。


展望未来,随着新兴企业的不断涌入与技术创新的持续涌现,AI芯片将更加智能化、高效化与经济化,从而对各行各业产生深远影响。


从智能安防到自动驾驶,从工业自动化到医疗健康,AI芯片的应用场景将不断拓展,引领社会迈向更加智能与高效的新纪元。


综上所述,AI芯片市场的未来发展潜力巨大,前景广阔。在技术进步、成本优化与新兴企业崛起的共同驱动下,一个更加多元化、开放化与创新化的AI芯片市场正加速形成。


此外,值得注意的是,有报道指出三星计划推出采用LPDDR内存的AI芯片,而非HBM。


这一决策主要基于成本与市场的综合考量,旨在提供一种更为轻量级的AI芯片解决方案。



除HBM外的AI芯片领域的选项


①GDDR:特别是GDDR6与GDDR6X,作为GPU中广泛采用的存储器类型,同样适用于对性能有较高要求的AI应用场景。


其虽在带宽上略逊于HBM,但成本效益更佳,且市场供应更为充足。


因此,对于成本敏感或无需极端带宽需求的AI项目,GDDR系列存储器是理想之选。


②DRAM:包括DDR4与DDR5在内,这些存储器类型以其通用性著称,可胜任多种计算任务。


尽管在带宽与延迟方面不及HBM或GDDR,但它们在成本控制与存储容量上展现出显著优势。


因此,对于成本敏感且对延迟及计算性能要求不高的AI应用,如特定推理任务或低功耗设备上的AI部署,DRAM是合适的选择。


③LPDDR:专为移动设备与低功耗应用场景设计,LPDDR在功耗优化方面表现出色。


它特别适用于移动设备中的AI应用,以及其他对节能与空间要求严苛的场合。


④整合内存解决方案:部分AI芯片采用SoC(系统级芯片)整合式设计,将处理器与存储器集成于单一芯片之上。


此类设计可灵活采用多种内存技术,如静态随机存取存储器(SRAM)或DRAM等,以满足不同需求。


此设计尤其适用于移动设备、嵌入式系统以及对功耗与空间有严格要求的场景。


⑤MCR-DIMM:作为尚处于研发阶段的技术,MCR-DIMM旨在为通用CPU提供高性能内存解决方案。


通过简化大容量双列模组的构造,MCR-DIMM在提升性能的同时,还提供了较大的容量与带宽。这一特性使其成为处理通用计算任务的优选方案。


⑥虽然NVRAM、MRAM及ReRAM等技术在AI芯片中的应用尚属有限,但它们在存储与快速检索模型参数、权重等方面展现出巨大潜力。



结尾:


尽管当前HBM以其卓越的性能在高端AI应用领域占据了一席之地,然而,随着其他内存技术的持续进步,特别是在成本控制、性能提升及功耗降低等方面的显著改进,HBM可能会遭遇新兴内存技术的竞争压力。


然而,从短期视角来看,HBM依然是那些对带宽有极高要求的应用场景的首选解决方案。


从长期发展的角度出发,市场将依据技术的不断演进以及应用需求的动态变化,逐步进行调整与优化。


部分资料参考:半导体行业观察:《干掉HBM?》,友硕:《AI离不开HBM?无需HBM的AI芯片诞生》,PE Link:《被称为「技术奇迹」的HBM会否被取代》


本公众号所刊发稿件及图片来源于网络,仅用于交流使用,如有侵权请联系回复,我们收到信息后会在24小时内处理。



END


推荐阅读:


商务合作请加微信勾搭:

18948782064

请务必注明:

「姓名 + 公司 + 合作需求」


AI芯天下 聚焦人工智能,AI芯片,5G通讯等行业动态
评论
  • PNT、GNSS、GPS均是卫星定位和导航相关领域中的常见缩写词,他们经常会被用到,且在很多情况下会被等同使用或替换使用。我们会把定位导航功能测试叫做PNT性能测试,也会叫做GNSS性能测试。我们会把定位导航终端叫做GNSS模块,也会叫做GPS模块。但是实际上他们之间是有一些重要的区别。伴随着技术发展与越发深入,我们有必要对这三个词汇做以清晰的区分。一、什么是GPS?GPS是Global Positioning System(全球定位系统)的缩写,它是美国建立的全球卫星定位导航系统,是GNSS概
    德思特测试测量 2025-01-13 15:42 475浏览
  • 流量传感器是实现对燃气、废气、生活用水、污水、冷却液、石油等各种流体流量精准计量的关键手段。但随着工业自动化、数字化、智能化与低碳化进程的不断加速,采用传统机械式检测方式的流量传感器已不能满足当代流体计量行业对于测量精度、测量范围、使用寿命与维护成本等方面的精细需求。流量传感器的应用场景(部分)超声波流量传感器,是一种利用超声波技术测量流体流量的新型传感器,其主要通过发射超声波信号并接收反射回来的信号,根据超声波在流体中传播的时间、幅度或相位变化等参数,间接计算流体的流量,具有非侵入式测量、高精
    华普微HOPERF 2025-01-13 14:18 468浏览
  • 电动汽车(EV)正在改变交通运输,为传统内燃机提供更清洁、更高效的替代方案。这种转变的核心是电力电子和能源管理方面的创新,而光耦合器在其中发挥着关键作用。这些不起眼的组件可实现可靠的通信、增强安全性并优化电动汽车系统的性能,使其成为正在进行的革命中不可或缺的一部分。光耦合器,也称为光隔离器,是一种使用光传输电信号的设备。通过隔离高压和低压电路,光耦合器可确保安全性、减少干扰并保持信号完整性。这些特性对于电动汽车至关重要,因为精确控制和安全性至关重要。 光耦合器在电动汽车中的作用1.电池
    腾恩科技-彭工 2025-01-10 16:14 75浏览
  • 随着全球向绿色能源转型的加速,对高效、可靠和环保元件的需求从未如此强烈。在这种背景下,国产固态继电器(SSR)在实现太阳能逆变器、风力涡轮机和储能系统等关键技术方面发挥着关键作用。本文探讨了绿色能源系统背景下中国固态继电器行业的前景,并强调了2025年的前景。 1.对绿色能源解决方案日益增长的需求绿色能源系统依靠先进的电源管理技术来最大限度地提高效率并最大限度地减少损失。固态继电器以其耐用性、快速开关速度和抗机械磨损而闻名,正日益成为传统机电继电器的首选。可再生能源(尤其是太阳能和风能
    克里雅半导体科技 2025-01-10 16:18 322浏览
  •   在信号处理过程中,由于信号的时域截断会导致频谱扩展泄露现象。那么导致频谱泄露发生的根本原因是什么?又该采取什么样的改善方法。本文以ADC性能指标的测试场景为例,探讨了对ADC的输出结果进行非周期截断所带来的影响及问题总结。 两个点   为了更好的分析或处理信号,实际应用时需要从频域而非时域的角度观察原信号。但物理意义上只能直接获取信号的时域信息,为了得到信号的频域信息需要利用傅里叶变换这个工具计算出原信号的频谱函数。但对于计算机来说实现这种计算需要面对两个问题: 1.
    TIAN301 2025-01-14 14:15 100浏览
  • 随着数字化的不断推进,LED显示屏行业对4K、8K等超高清画质的需求日益提升。与此同时,Mini及Micro LED技术的日益成熟,推动了间距小于1.2 Pitch的Mini、Micro LED显示屏的快速发展。这类显示屏不仅画质卓越,而且尺寸适中,通常在110至1000英寸之间,非常适合应用于电影院、监控中心、大型会议、以及电影拍摄等多种室内场景。鉴于室内LED显示屏与用户距离较近,因此对于噪音控制、体积小型化、冗余备份能力及电气安全性的要求尤为严格。为满足这一市场需求,开关电源技术推出了专为
    晶台光耦 2025-01-13 10:42 491浏览
  • 随着通信技术的迅速发展,现代通信设备需要更高效、可靠且紧凑的解决方案来应对日益复杂的系统。中国自主研发和制造的国产接口芯片,正逐渐成为通信设备(从5G基站到工业通信模块)中的重要基石。这些芯片凭借卓越性能、成本效益及灵活性,满足了现代通信基础设施的多样化需求。 1. 接口芯片在通信设备中的关键作用接口芯片作为数据交互的桥梁,是通信设备中不可或缺的核心组件。它们在设备内的各种子系统之间实现无缝数据传输,支持高速数据交换、协议转换和信号调节等功能。无论是5G基站中的数据处理,还是物联网网关
    克里雅半导体科技 2025-01-10 16:20 436浏览
  • 新年伊始,又到了对去年做总结,对今年做展望的时刻 不知道你在2024年初立的Flag都实现了吗? 2025年对自己又有什么新的期待呢? 2024年注定是不平凡的一年, 一年里我测评了50余块开发板, 写出了很多科普文章, 从一个小小的工作室成长为科工公司。 展望2025年, 中国香河英茂科工, 会继续深耕于,具身机器人、飞行器、物联网等方面的研发, 我觉得,要向未来学习未来, 未来是什么? 是掌握在孩子们生活中的发现,和精历, 把最好的技术带给孩子,
    丙丁先生 2025-01-11 11:35 447浏览
  • 根据Global Info Research(环洋市场咨询)项目团队最新调研,预计2030年全球无人机电池和电源产值达到2834百万美元,2024-2030年期间年复合增长率CAGR为10.1%。 无人机电池是为无人机提供动力并使其飞行的关键。无人机使用的电池类型因无人机的大小和型号而异。一些常见的无人机电池类型包括锂聚合物(LiPo)电池、锂离子电池和镍氢(NiMH)电池。锂聚合物电池是最常用的无人机电池类型,因为其能量密度高、设计轻巧。这些电池以输出功率大、飞行时间长而著称。不过,它们需要
    GIRtina 2025-01-13 10:49 170浏览
  • ARMv8-A是ARM公司为满足新需求而重新设计的一个架构,是近20年来ARM架构变动最大的一次。以下是对ARMv8-A的详细介绍: 1. 背景介绍    ARM公司最初并未涉足PC市场,其产品主要针对功耗敏感的移动设备。     随着技术的发展和市场需求的变化,ARM开始扩展到企业设备、服务器等领域,这要求其架构能够支持更大的内存和更复杂的计算任务。 2. 架构特点    ARMv8-A引入了Execution State(执行状
    丙丁先生 2025-01-12 10:30 457浏览
  • 01. 什么是过程能力分析?过程能力研究利用生产过程中初始一批产品的数据,预测制造过程是否能够稳定地生产符合规格的产品。可以把它想象成一种预测。通过历史数据的分析,推断未来是否可以依赖该工艺持续生产高质量产品。客户可能会要求将过程能力研究作为生产件批准程序 (PPAP) 的一部分。这是为了确保制造过程能够持续稳定地生产合格的产品。02. 基本概念在定义制造过程时,目标是确保生产的零件符合上下规格限 (USL 和 LSL)。过程能力衡量制造过程能多大程度上稳定地生产符合规格的产品。核心概念很简单:
    优思学院 2025-01-12 15:43 501浏览
  • 在不断发展的电子元件领域,继电器——作为切换电路的关键设备,正在经历前所未有的技术变革。固态继电器(SSR)和机械继电器之间的争论由来已久。然而,从未来发展的角度来看,固态继电器正逐渐占据上风。本文将从耐用性、速度和能效三个方面,全面剖析固态继电器为何更具优势,并探讨其在行业中的应用与发展趋势。1. 耐用性:经久耐用的设计机械继电器:机械继电器依靠物理触点完成电路切换。然而,随着时间的推移,这些触点因电弧、氧化和材料老化而逐渐磨损,导致其使用寿命有限。因此,它们更适合低频或对切换耐久性要求不高的
    腾恩科技-彭工 2025-01-10 16:15 97浏览
我要评论
0
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦