GTC20 | 软件定义、硬件加速的可编程InfiniBand NDR网络赋能E级AI和HPC平台

英伟达NVIDIA中国 2020-12-16 00:00

在之前的2020年全球数字超算大会(SC20大会)上,NVIDIA宣布推出NVIDIA® Mellanox® 400G InfiniBand产品,这是全球第一代400Gb/s网速的端到端网络解决方案,可为全球的AI和HPC用户提供最快的网络互连性能,同时将计算、可编程性和软件定义三种技术成功地融于一体,成为业界领先的软件定义、硬件加速的可编程网络,为全球的科研人员和工程人员设计新一代计算系统和提升应用性能提供了新的思路。


NVIDIA Mellanox InfiniBand NDR产品是第7代的InfiniBand产品,利用100Gb/s的PAM4 Serdes技术, 实现了400Gb/s的单端口传输带宽, 是上一代产品的两倍, 同时通过添加更多、更强大的加速引擎,实现了更强大的计算和通信能力。



“Speed Of Light”是关于NDR InfiniBand技术的第一个特征,通过加倍的带宽、更快的包处理能力(Message Rate), 让基于RDMA、GPU Direct RDMA和GPU Direct Storage等先进通信技术的应用性能得到了进一步提升。InfiniBand网络是天然的SDN网络,可以让用户根据应用的属性来选择各种不同的网络拓扑,以达到最优的性能,如Fat-Tree、DragonFly+、各种Torus等。如通过DragonFly+网络拓扑可以在4个交换机Hop内达到一百万个节点的同时通信,这个规模远远超出了E级机、甚至10E级机或百E级机需要的规模;同时其天然的SDN属性也让动态路由和网络拥塞控制变得更容易实现。InfiniBand动态路由已经被广泛地应用到各种网络拓扑当中,成为优化通信性能的关键手段,如美国橡树林国家实验室的Summit超级计算机就通过动态路由将超算中心全网的通信效率从60%提升到了96%。NDR InfiniBand交换机在1U空间内可以支持64个400Gb/s的端口或128个200Gb/s的端口,是上一代交换机端口密度的3倍;它还将框式交换机系统的聚合双向吞吐量提高了5倍,达到1.64 petabits/s,是全球端口数最多、交换容量最大的交换机。


硬件加速是InfiniBand网络的最大特色,随着越来越多的加速引擎被添加到InfiniBand硬件中来,进一步加大了其相对于其它网络技术的领先性。如NDR InfiniBand实现了对于业界最头疼的All2All和Allreduce通信的硬件卸载,能让MPI通信的性能提升四倍。NDR InfiniBand对于MPI Tag Matching的硬件卸载,实现了1.8倍的MPI通信性能提升。NDR InfiniBand可以实现对于NVMeoF的全面卸载, NVMeoF的Target卸载可以让存储系统在几乎不消耗Target端CPU的前提下达到数以百万级的IOPS,NVME SNAP可以实现对于NVMeoF的Initiator端的卸载,同时可以将InfiniBand网络模拟成NVMe磁盘提供给主机CPU,可以解决目前很多OS还没有NVMeoF的Initiator支持的问题,实现了对任何OS, 无论是虚拟化还是物理机的全面NVMeoF的支持;InfiniBand FIO SNAP可以实现对于文件存储的本地模拟,让任何OS都可以享受最先进的分布式文件存储系统的性能优势。


InfiniBand SHARP(Scalable Hierarchical Aggregation and Reduction Protocol)技术彻底消除了MPI或者NCCL的Allreduce操作中的多打一通信带来的Incast Burst问题,在保证所有端口全线速、共计12.8Tb/s或25.6Tb/s的数据输入的前提下,实现在交换机上的Allreduce、Barrier、Reduce和Broadcast计算,在NDR交换机上更是实现了相比上一代交换机32倍的计算性能提升。InfiniBand SHIELD(Self Healing)技术实现了网络中链路故障的自修复,让网络无需等待管理软件的参与来恢复链路故障,实现了比传统的软件故障恢复快千倍以上的性能,让您的应用不再受困链路故障的干扰,提升应用的性能。


InfiniBand安全卸载是面向Cloud Native的应用场景,InfiniBand已经得到了Open Stack的官方软件支持,通过自带的硬件IPSec、TLS、AES、Root Of Trust等功能,可以让数据不论是在网络中流动时,还是在向存储中落盘时都能以线速性能得到加解密,实现了在虚拟化环境或者在容器化环境中的安全保障。


软件可编程让InfiniBand的应用场景得到了进一步的延伸,可编程的NDR InfiniBand不仅可以让用户处理数据的header,还可以对于数据的数据路径进行操作,如用户可以自定义规则对于数据路径进行操作;或是对于数据直接在网络中进行预处理而无需送到CPU做预处理。用户还可以对于数据的通信特征进行提取、然后利用AI技术对其进行训练,得到不同应用数据的通用通信特征,如果发现有异常通信信息,可以向管理员主动发出预警。


NVIDIA Mellanox NDR 400G InfiniBand亮点


NDR InfiniBand以其优异的性能和灵活广泛的使用场景吸引了众多的合作伙伴一起共建生态系统,包括Atos、戴尔科技、富士通、浪潮、联想和SuperMicro等服务器厂商,以及DDN、IBM Storage等存储厂商。各家公司都已开始研发其新一代产品,实现对于NDR InfiniBand的支持。而包括微软Azure公有云、美国Los Alamos国家实验室、欧洲Jülich超算中心等全球各顶级用户都纷纷表示,期待能尽快应用NDR InfiniBand到他们的业务中去,享受NDR的技术优势。


NVIDIA网络高级副总裁Gilad Shainer表示:“我们AI客户最重要的工作就是处理日益复杂的应用程序,这需要更快速、更智能、更具扩展性的网络。NVIDIA Mellanox 400G InfiniBand的海量吞吐量和智能加速引擎,帮助HPC、AI和超大规模云基础设施以更低的成本和复杂性,实现无与伦比的性能。


E级AI和HPC时代已经来临,同时带来新的挑战,软件定义、硬件加速、面向网络计算的可编程NDR InfiniBand产品将于2021年第二季度提供样品。NDR产品的出现,将会大幅提升E级AI和HPC系统的性能和效率,简化系统的管理和操作,降低系统的TCO,进而保护数据中心的投资。



NVIDIA 首席科学家 BILL DALLY 通过 GTC 中国线上大会 2020 主题演讲,为您解读 NVIDIA 新科技如何助力解决当今世界的巨大挑战。速速扫描下方海报中的二维码观看演讲视频!


评论
  • 11-29学习笔记11-29学习笔记习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习笔记&记录学习习笔记&记学习学习笔记&记录学习学习笔记&记录学习习笔记&记录学习学习笔记&记录学习学习笔记记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&学习学习笔记&记录学习学习笔记&记录学习学习笔记&记
    youyeye 2024-12-02 23:58 73浏览
  • 当前,智能汽车产业迎来重大变局,随着人工智能、5G、大数据等新一代信息技术的迅猛发展,智能网联汽车正呈现强劲发展势头。11月26日,在2024紫光展锐全球合作伙伴大会汽车电子生态论坛上,紫光展锐与上汽海外出行联合发布搭载紫光展锐A7870的上汽海外MG量产车型,并发布A7710系列UWB数字钥匙解决方案平台,可应用于数字钥匙、活体检测、脚踢雷达、自动泊车等多种智能汽车场景。 联合发布量产车型,推动汽车智能化出海紫光展锐与上汽海外出行达成战略合作,联合发布搭载紫光展锐A7870的量产车型
    紫光展锐 2024-12-03 11:38 101浏览
  • TOF多区传感器: ND06   ND06是一款微型多区高集成度ToF测距传感器,其支持24个区域(6 x 4)同步测距,测距范围远达5m,具有测距范围广、精度高、测距稳定等特点。适用于投影仪的无感自动对焦和梯形校正、AIoT、手势识别、智能面板和智能灯具等多种场景。                 如果用ND06进行手势识别,只需要经过三个步骤: 第一步&
    esad0 2024-12-04 11:20 58浏览
  • 作为优秀工程师的你,已身经百战、阅板无数!请先醒醒,新的项目来了,这是一个既要、又要、还要的产品需求,ARM核心板中一个处理器怎么能实现这么丰富的外围接口?踌躇之际,你偶阅此文。于是,“潘多拉”的魔盒打开了!没错,USB资源就是你打开新世界得钥匙,它能做哪些扩展呢?1.1  USB扩网口通用ARM处理器大多带两路网口,如果项目中有多路网路接口的需求,一般会选择在主板外部加交换机/路由器。当然,出于成本考虑,也可以将Switch芯片集成到ARM核心板或底板上,如KSZ9897、
    万象奥科 2024-12-03 10:24 68浏览
  • RDDI-DAP错误通常与调试接口相关,特别是在使用CMSIS-DAP协议进行嵌入式系统开发时。以下是一些可能的原因和解决方法: 1. 硬件连接问题:     检查调试器(如ST-Link)与目标板之间的连接是否牢固。     确保所有必要的引脚都已正确连接,没有松动或短路。 2. 电源问题:     确保目标板和调试器都有足够的电源供应。     检查电源电压是否符合目标板的规格要求。 3. 固件问题: &n
    丙丁先生 2024-12-01 17:37 102浏览
  • 光伏逆变器是一种高效的能量转换设备,它能够将光伏太阳能板(PV)产生的不稳定的直流电压转换成与市电频率同步的交流电。这种转换后的电能不仅可以回馈至商用输电网络,还能供独立电网系统使用。光伏逆变器在商业光伏储能电站和家庭独立储能系统等应用领域中得到了广泛的应用。光耦合器,以其高速信号传输、出色的共模抑制比以及单向信号传输和光电隔离的特性,在光伏逆变器中扮演着至关重要的角色。它确保了系统的安全隔离、干扰的有效隔离以及通信信号的精准传输。光耦合器的使用不仅提高了系统的稳定性和安全性,而且由于其低功耗的
    晶台光耦 2024-12-02 10:40 120浏览
  • 遇到部分串口工具不支持1500000波特率,这时候就需要进行修改,本文以触觉智能RK3562开发板修改系统波特率为115200为例,介绍瑞芯微方案主板Linux修改系统串口波特率教程。温馨提示:瑞芯微方案主板/开发板串口波特率只支持115200或1500000。修改Loader打印波特率查看对应芯片的MINIALL.ini确定要修改的bin文件#查看对应芯片的MINIALL.ini cat rkbin/RKBOOT/RK3562MINIALL.ini修改uart baudrate参数修改以下目
    Industio_触觉智能 2024-12-03 11:28 87浏览
  • 概述 说明(三)探讨的是比较器一般带有滞回(Hysteresis)功能,为了解决输入信号转换速率不够的问题。前文还提到,即便使能滞回(Hysteresis)功能,还是无法解决SiPM读出测试系统需要解决的问题。本文在说明(三)的基础上,继续探讨为SiPM读出测试系统寻求合适的模拟脉冲检出方案。前四代SiPM使用的高速比较器指标缺陷 由于前端模拟信号属于典型的指数脉冲,所以下降沿转换速率(Slew Rate)过慢,导致比较器检出出现不必要的问题。尽管比较器可以使能滞回(Hysteresis)模块功
    coyoo 2024-12-03 12:20 111浏览
  •         温度传感器的精度受哪些因素影响,要先看所用的温度传感器输出哪种信号,不同信号输出的温度传感器影响精度的因素也不同。        现在常用的温度传感器输出信号有以下几种:电阻信号、电流信号、电压信号、数字信号等。以输出电阻信号的温度传感器为例,还细分为正温度系数温度传感器和负温度系数温度传感器,常用的铂电阻PT100/1000温度传感器就是正温度系数,就是说随着温度的升高,输出的电阻值会增大。对于输出
    锦正茂科技 2024-12-03 11:50 111浏览
  • 最近几年,新能源汽车愈发受到消费者的青睐,其销量也是一路走高。据中汽协公布的数据显示,2024年10月,新能源汽车产销分别完成146.3万辆和143万辆,同比分别增长48%和49.6%。而结合各家新能源车企所公布的销量数据来看,比亚迪再度夺得了销冠宝座,其10月新能源汽车销量达到了502657辆,同比增长66.53%。众所周知,比亚迪是新能源汽车领域的重要参与者,其一举一动向来为外界所关注。日前,比亚迪汽车旗下品牌方程豹汽车推出了新车方程豹豹8,该款车型一上市就迅速吸引了消费者的目光,成为SUV
    刘旷 2024-12-02 09:32 119浏览
我要评论
0
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦