AI服务器:CXLvsNVLink!

原创 SSDFans 2025-04-02 08:26


点击蓝字
关注我们



Nvidia GTC 2024上,GPUAI占据了中心舞台。但另一项有人认为可以帮助解决GPU瓶颈的技术却缺席了:CXL。多年来,CXL一直被吹捧为增加数据中心设备(包括GPU等加速器)内存的一种方式。


然而,在台下,关于CXLAI中角色的争论更加微妙。一些人认为,鉴于Nvidia缺乏支持,CXL在讨论中的地位有限。其他公司,包括内存软件供应商MemVerge、内存供应商Micron和硬件供应商Supermicro,都证明了这一点。


GTC上,MemVergeMicronSupermicro展示了CXL如何在不增加更多处理单元的情况下提高大型语言模型GPU的利用率。CXL通过扩展GPU内存池来增加高带宽内存使用,而不是使用更多GPU或更多HBM扩展基础设施,从而实现这一点。然而,权衡的是性能。


英伟达则走了一条不同的道路。这家GPU制造商有自己的NVLink,这是一种专门设计用于实现GPU之间高带宽连接的互连。虽然CXL提供了扩展内存占用和池化处理器内存的通用功能,但在一些最受欢迎的GPU中却没有。


AI下CXL已死?


CXL2019年首次出现,被视为克服孤立内存和CPU内存限制的潜在方法。从那时起,CXL用例不断增长,可以在多个主机之间实现内存共享,并提供扩展的带宽和设备功能。


2024年内存结构论坛上,MemVerge强调了CXL是一种能够连接计算、网络和存储的潜在AI结构。与Nvidia一起是CXL联盟成员的MemVerge开发的软件在开发CXL用例中发挥着关键作用。


MemVerge CEO Charles Fan表示,x86时代的传统数据中心布局是通过以太网网络结构将x86 CPU服务器与存储连接起来。但AI时代将看到基于GPU的服务器通过HBM连接到存储,并可能使用NVLink或超以太网作为GPU和内存池之间的互连。

Fan表示CXL也可以作为AI的结构发挥作用


但独立研究公司SemiAnalysis的两位分析师PatelOntiveros认为,CXL不会向AI迈进。在一篇新文章中,他们认为,虽然CXL总体上对服务器有潜在的好处,但这些好处并不能服务于Nvidia GPU,因为Nvidia GP有多少空间用于连接而且Nvidia倾向于自己的NVLink


根据PatelOntiveros的说法,Nvidia GPU的四I/O中有两是专门用于HBM的。这就为连接留下了两个优势,英伟达更有可能选择自己的NVLinkNVLink- c2c(与Grace CPU的互连),而不是CXL。这两种协议都是Nvidia专有的,并且比CXL提供更多的带宽。


Fan表示,争论的焦点只集中在AI工作负载的GPUGPU连接上,而CXL提供了更广泛的功能。


GPUGPU的通信不是CXL标准的最初设计或用例,相反,CXL解决了带宽和容量扩展问题。


Fan说,Nvidia既支持NVLink连接到其他Nvidia GPU,也支持PCIe连接到其他设备,但PCIe协议可以用于CXL。事实上,GPU的竞争对手AMD生产的芯片几乎完全使用PCIe。就像英伟达的GPU一样,Fan看到了两种互连共存的未来。


不止一个用例


Dragon Slayer Consulting的总裁Marc staimer也认为,专注于GPUGPU的通信(对于生成式AI很重要)的范围过于有限,并且从来都不是CXL技术的预期目标。


CXL不仅仅是为了解决GPU问题,”他说。


Staimer说,生成式AI主要有两个方面。首先是训练,这通常需要GPU提供大量带宽,以确保以最大速度并行读取大量数据。第二是推理,经过训练的语言模型可能依赖于检索增强生成,这是一种AI框架,可以使用额外的数据集来提高准确性。


一种RAG技术是矢量数据库,它可以存储高维数据,如图像和文本,可以用来根据需要更新查询,而不需要额外的训练。


“数据库在CPU和内存中运行,你的记忆越多越好。


Staimer说,CXL可以扩展内存占用,让整个矢量数据库在内存中运行。在内存中运行数据库意味着不需要访问存储来检索数据,从而提高了数据库速度。然而,他指出,生成式AI仍然是数据中心总支出的一小部分,而CXL可以更广泛地用于扩展数据中心内存,从而提供更低的成本和更好的内存利用率。


PatelOntiveros还看到了CXLAI之外的内存扩展和内存池优势的价值,特别是在大规模提高DRAM利用率方面。他们写道,这些功能可以为每家云提供商“节省数十亿美元”。


Fan认为,考虑到AI的发展速度之快,以及新的用例仍在被发现,将CXL排除在AI工作负载之外还为时过早。这样的一个用例可能是扩展GPU上的HBM池以维持处理器的利用率。


扩大HBM


HBM是堆叠的同步动态随机存取存储器,通常附加到处理器、CPU、特定应用程序集成电路,或者更常见的是GPU。堆叠设计增加了带宽,降低了功耗。然而,HBM的容量有限,而且价格昂贵。人们对HBM的兴趣有所上升,因为AI带宽是关键,HBM提供了尽可能高的带宽。


但是CXL可以扩展GPU的容量,超出HBM的限制。Fan表示,在GTC上,MemVerge、美光和超微展示了克服AI内存墙问题的潜力,即内存传输的容量和带宽有限,特别是GPU上的内存大小。


“模型大小的增长以及GPU计算能力的增长超过了GPU的内存容量


一种解决方法是扩展所使用的GPU数量。但这样做既昂贵又依赖于目前需求量很大的处理设备。另一个解决方案是通过CXL卸载或扩展内存,这将更便宜,并且无需更多的GPU或更密集的HBM


HBM相比,切换到较慢的CXL内存将影响性能。但MemVergeMicronSupermicro的联合技术显示,GPU的利用率也显著提高,从而更快地完成任务。


应该注意的是,在他们的设置中使用的GPU使用GDDR6内存,而不是HBM。无论如何,MemVerge表示,内存扩展的效果是一样的。


原文链接:

https://www.techtarget.com/searchStorage/news/366575974/What-role-does-CXL-play-in-AI-Depends-on-who-you-ask




高端微信群介绍

创业投资群


AI、IOT、芯片创始人、投资人、分析师、券商

闪存群


覆盖5000多位全球华人闪存、存储芯片精英

云计算群


全闪存、软件定义存储SDS、超融合等公有云和私有云讨论

AI芯片群


讨论AI芯片和GPU、FPGA、CPU异构计算

5G群


物联网、5G芯片讨论

第三代半导体群

氮化镓、碳化硅等化合物半导体讨论

储芯片群

DRAM、NAND、3D XPoint等各类存储介质和主控讨论

汽车电子群

MCU、电源、传感器等汽车电子讨论

光电器件群

光通信、激光器、ToF、AR、VCSEL等光电器件讨论

渠道群

存储和芯片产品报价、行情、渠道、供应链




< 长按识别二维码添加好友 >

加入上述群聊




长按并关注

带你走进万物存储、万物智能、

万物互联信息革命新时代

微信号:SSDFans



SSDFans AI+IOT+闪存,万物存储、万物智能、万物互联的闪存2.0时代即将到来,你,准备好了吗?
评论 (0)
  • 文/Leon编辑/cc孙聪颖‍4月18日7时,2025北京亦庄半程马拉松暨人形机器人半程马拉松正式开跑。与普通的半马比赛不同,这次比赛除了有人类选手,还有21支人形机器人队伍参赛,带来了全球首次人类与机器人共同竞技的盛况。参赛队伍中,不乏明星机器人企业及机型,比如北京人形机器人创新中心的天工Ultra、松延动力的N2等。宇树G1、众擎PM01,则是由城市之间科技有限公司购置及调试,并非厂商直接参赛。考虑到机器人的适用场景和续航力各有不同,其赛制也与人类选手做出区别:每支赛队最多可安排3名参赛选手
    华尔街科技眼 2025-04-22 20:10 112浏览
  • 故障现象一辆2016款奔驰C200L车,搭载274 920发动机,累计行驶里程约为13万km。该车组合仪表上的防侧滑故障灯、转向助力故障灯、安全气囊故障灯等偶尔异常点亮,且此时将挡位置于R挡,中控显示屏提示“后视摄像头不可用”,无法显示倒车影像。 故障诊断用故障检测仪检测,发现多个控制单元中均存储有通信类故障代码(图1),其中故障代码“U015587 与仪表盘的通信存在故障。信息缺失”出现的频次较高。 图1 存储的故障代码1而组合仪表中存储有故障代码“U006488 与用户界
    虹科Pico汽车示波器 2025-04-23 11:22 83浏览
  • 在科技飞速发展的当下,机器人领域的每一次突破都能成为大众瞩目的焦点。这不,全球首届人形机器人半程马拉松比赛刚落下帷幕,赛场上的 “小插曲” 就掀起了一阵网络热潮。4月19日,北京亦庄的赛道上热闹非凡,全球首届人形机器人半程马拉松在这里激情开跑。20支机器人队伍带着各自的“参赛选手”,踏上了这21.0975公里的挑战之路。这场比赛可不简单,它将机器人放置于真实且复杂的动态路况与环境中,对机器人在运动控制、环境感知和能源管理等方面的核心技术能力进行了全方位的检验。不仅要应对长距离带来的续航挑战,还要
    用户1742991715177 2025-04-22 20:42 98浏览
  •   卫星通信效能评估系统平台全面解析   北京华盛恒辉卫星通信效能评估系统平台是衡量卫星通信系统性能、优化资源配置、保障通信服务质量的关键技术工具。随着卫星通信技术的快速发展,特别是低轨卫星星座、高通量卫星和软件定义卫星的广泛应用,效能评估系统平台的重要性日益凸显。以下从技术架构、评估指标、关键技术、应用场景及发展趋势五个维度进行全面解析。   应用案例   目前,已有多个卫星通信效能评估系统在实际应用中取得了显著成效。例如,北京华盛恒辉和北京五木恒润卫星通信效能评估系统。这些成功案例为卫
    华盛恒辉l58ll334744 2025-04-22 16:34 148浏览
  •   后勤实验仿真系统平台深度解析   北京华盛恒辉后勤实验仿真系统平台依托计算机仿真技术,是对后勤保障全流程进行模拟、分析与优化的综合性工具。通过搭建虚拟场景,模拟资源调配、物资运输等环节,为后勤决策提供数据支撑,广泛应用于军事、应急管理等领域。   应用案例   目前,已有多个后勤实验仿真系统平台在实际应用中取得了显著成效。例如,北京华盛恒辉和北京五木恒润后勤实验仿真系统平台。这些成功案例为后勤实验仿真系统平台的推广和应用提供了有力支持。   一、核心功能   (一)后勤资源模拟
    华盛恒辉l58ll334744 2025-04-23 15:39 120浏览
  •   陆地边防事件紧急处置系统平台解析   北京华盛恒辉陆地边防事件紧急处置系统平台是整合监测、预警、指挥等功能的智能化综合系统,致力于增强边防安全管控能力,快速响应各类突发事件。以下从系统架构、核心功能、技术支撑、应用场景及发展趋势展开全面解读。   应用案例   目前,已有多个陆地边防事件紧急处置系统在实际应用中取得了显著成效。例如,北京华盛恒辉和北京五木恒润陆地边防事件紧急处置系统。这些成功案例为陆地边防事件紧急处置系统的推广和应用提供了有力支持。   一、系统架构   感知层:部
    华盛恒辉l58ll334744 2025-04-23 11:22 113浏览
  •   复杂电磁环境模拟系统平台解析   一、系统概述   北京华盛恒辉复杂电磁环境模拟系统平台是用于还原真实战场或特定场景电磁环境的综合性技术平台。该平台借助软硬件协同运作,能够产生多源、多频段、多体制的电磁信号,并融合空间、时间、频谱等参数,构建高逼真度的电磁环境,为电子对抗、通信、雷达等系统的研发、测试、训练及评估工作提供重要支持。   应用案例   目前,已有多个复杂电磁环境模拟系统在实际应用中取得了显著成效。例如,北京华盛恒辉和北京五木恒润复杂电磁环境模拟系统。这些成功案例为复杂电
    华盛恒辉l58ll334744 2025-04-23 10:29 159浏览
  • 前言本文主要演示基于TL3576-MiniEVM评估板HDMI OUT、DP 1.4和MIPI的多屏同显、异显方案,适用开发环境如下。Windows开发环境:Windows 7 64bit、Windows 10 64bitLinux开发环境:VMware16.2.5、Ubuntu22.04.5 64bitU-Boot:U-Boot-2017.09Kernel:Linux-6.1.115LinuxSDK:LinuxSDK-[版本号](基于rk3576_linux6.1_release_v
    Tronlong 2025-04-23 13:59 102浏览
  • 一、行业背景与市场需求高血压作为全球发病率最高的慢性病之一,其早期监测与管理已成为公共卫生领域的重要课题。世界卫生组织数据显示,全球超13亿人受高血压困扰,且患者群体呈现年轻化趋势。传统血压计因功能单一、数据孤立等缺陷,难以满足现代健康管理的需求。在此背景下,集语音播报、蓝牙传输、电量检测于一体的智能血压计应运而生,通过技术创新实现“测量-分析-管理”全流程智能化,成为慢性病管理的核心终端设备。二、技术架构与核心功能智能血压计以电子血压测量技术为基础,融合物联网、AI算法及语音交互技术,构建起多
    广州唯创电子 2025-04-23 09:06 143浏览
  • 一、技术背景与市场机遇在智能家居高速发展的今天,用户对家电设备的安全性、智能化及能效表现提出更高要求。传统取暖器因缺乏智能感知功能,存在能源浪费、安全隐患等痛点。WTL580-C01微波雷达感应模块的诞生,为取暖设备智能化升级提供了创新解决方案。该模块凭借微波雷达技术优势,在精准测距、环境适应、能耗控制等方面实现突破,成为智能取暖器领域的核心技术组件。二、核心技术原理本模块采用多普勒效应微波雷达技术,通过24GHz高频微波信号的发射-接收机制,实现毫米级动作识别和精准测距。当人体进入4-5米有效
    广州唯创电子 2025-04-23 08:41 126浏览
  • 文/Leon编辑/cc孙聪颖‍在特朗普政府发起的关税战中,全球芯片产业受到巨大冲击,美国芯片企业首当其冲。据报道称,英伟达本周二公布的8-K文件显示,美国政府通知该公司向中国(包括中国香港及澳门)销售尖端芯片(H20)时,需要获得美国政府的许可。文件发布后,英伟达预计会在第一季度中额外增加55亿美元的相关费用计提。随后,英伟达股价单日下跌6.9%,市值一夜蒸发约1890亿美元(约合人民币1.37万亿元)。至截稿时,至截稿时,其股价未见止跌,较前日下跌4.51%。北京时间4月17日,英伟达创始人、
    华尔街科技眼 2025-04-22 20:14 107浏览
  •   无人机结构仿真与部件拆解分析系统平台解析   北京华盛恒辉无人机结构仿真与部件拆解分析系统无人机技术快速发展的当下,结构仿真与部件拆解分析系统平台成为无人机研发测试的核心工具,在优化设计、提升性能、降低成本等方面发挥关键作用。以下从功能、架构、应用、优势及趋势展开解析。   应用案例   目前,已有多个无人机结构仿真与部件拆解分析系统在实际应用中取得了显著成效。例如,北京华盛恒辉和北京五木恒润无人机结构仿真与部件拆解分析系统。这些成功案例为无人机结构仿真与部件拆解分析系统的推广和应用提
    华盛恒辉l58ll334744 2025-04-23 15:00 157浏览
  •   电磁频谱数据综合管理平台系统解析   一、系统定义与目标   北京华盛恒辉电磁频谱数据综合管理平台融合无线传感器、软件定义电台等前沿技术,是实现无线电频谱资源全流程管理的复杂系统。其核心目标包括:优化频谱资源配置,满足多元通信需求;运用动态管理与频谱共享技术,提升资源利用效率;强化频谱安全监管,杜绝非法占用与干扰;为电子战提供频谱监测分析支持,辅助作战决策。   应用案例   目前,已有多个电磁频谱数据综合管理平台在实际应用中取得了显著成效。例如,北京华盛恒辉和北京五木恒润电磁频谱数
    华盛恒辉l58ll334744 2025-04-23 16:27 151浏览
  •   电磁干扰抑制系统平台深度解析   一、系统概述   北京华盛恒辉电磁干扰抑制系统在电子技术快速发展、电磁环境愈发复杂的背景下,电磁干扰(EMI)严重影响电子设备性能、稳定性与安全性。电磁干扰抑制系统平台作为综合性解决方案,通过整合多元技术手段,实现对电磁干扰的高效抑制,确保电子设备稳定运行。   应用案例   目前,已有多个电磁干扰抑制系统在实际应用中取得了显著成效。例如,北京华盛恒辉和北京五木恒润电磁干扰抑制系统。这些成功案例为电磁干扰抑制系统的推广和应用提供了有力支持。   二
    华盛恒辉l58ll334744 2025-04-22 15:27 156浏览
我要评论
0
0
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦