深度丨AMD来京办峰会,关键词只有一个

AI芯天下 2024-04-03 20:31

·聚焦:人工智能、芯片等行业

欢迎各位客官关注、转发






前言
近日,[AMD AI PC创新峰会]在北京开幕。值得一提的是,英伟达近期发布了其历史上性能最强劲的AI芯片[GB200]。

显然,苏姿丰与黄仁勋两位业界领袖之间的较量将愈发激烈,一场技术与战略的较量正悄然展开,无疑将引发行业内的广泛关注与期待。


作者 | 方文三
图片来源 |  网 络 

苏姿丰站台AMD来京办峰会


苏姿丰此次抵京,带来了AMD去年12月发布的锐龙8040系列AI PC处理器,该处理器代号为[Hawk Point]。


她透露,这款芯片已经开始出货,并且合作伙伴联想已确定于4月18日推出基于AMD处理器的AI PC新品。


锐龙8000系列在AI PC时代中扮演着至关重要的领军角色。


该系列中的锐龙8040系列移动处理器,凭借其内置的第二代Ryzen AI引擎NPU,为移动设备带来了前所未有的AI应用体验。


而锐龙8000G台式机处理器则将AI加速技术首次引入桌面平台,进一步拓宽了AI技术在各个领域的应用范围。


随着AI大模型的普及,AMD已将人工智能列为首要战略重点。


在苏姿丰的领导下,AMD的研发支出激增近四倍,高达50亿美元,几乎相当于她上任时的公司总收入。


此外,苏姿丰还详细介绍了AMD在大中华区的AI布局,并明确了对该地区的承诺,包括设立主要研发中心、AI卓越中心、支持超大型企业、以及推动联合研发与生态共建。


目前已有超过4000名工程师在中国各地的AMD公司工作。


在主流端侧大模型展区,AMD AI PC平台已适配了包括百川、通义千问、智谱清言、面壁MiniCPM以及RWKV等多个国内开源大模型。



围绕AI技术的三大战略重点

AMD正致力于构建一套全面覆盖云、HPC、企业、嵌入式、PC领域的端到端AI基础架构,并采用了三大策略来推进这一目标的实现。


①AMD提供了多样化的AI训练和推理计算引擎,包括基于Zen架构的霄龙数据中心与锐龙客户端CPU、基于CDNA架构的加速器、基于RDNA架构的独立集成显卡GPU以及基于XDNA架构的AI引擎NPU。


这些引擎能够满足不同场景下的AI需求,无论是训练还是推理,都能为用户提供合适的选择。


②AMD在软件方面也做出了显著的贡献。一方面,AMD ROCm软件开发平台经过多年的发展,已经为众多AI平台、框架、模型等提供了日益完善的支持。


另一方面,Ryzen AI软件通过释放硬件潜力,使得用户能够在各种计算引擎上部署和优化指定的预训练模型。


③AMD积极与合作伙伴进行创新合作,共同打造了一个强大的AI生态系统。目前,AMD AI PC的伙伴和应用支持已经相当广泛,预计到今年底,将有超过150家ISV厂商全面拥抱AMD Ryzen AI,覆盖各行各业、各种应用场景。


这一生态系统的建设将为AMD在AI领域的持续发展奠定坚实基础。



ZEN+XDNA+CDNA+RDNA覆盖AI加速应用


AMD致力于在AI PC上实现大模型的高效训练、微调和优化,力求以更小的模型、更高的速度和更低的成本为端侧用户提供服务。


在这一生态系统中,AMD提供了多元化的计算引擎,包括基于AMD XDNA的AI引擎NPU、基于[Zen]架构的CPU以及基于AMD RDNA的集成/独立GPU。


值得一提的是,Zen、RDNA和XDNA共同构成了Ryzen AI的技术基石。


预计到2024年,RDNA架构将升级到RDNA3+,带来显著的性能和能效提升。


目前,RDNA3在游戏性能上相较于前代产品最高提升了1.5倍,光追性能提升了1.8倍,同时在AI计算方面也有最高2.3倍的性能增长。


在CPU方面,Zen系列始终坚持性能与能效的双重提升。据透露,AMD将推出性能更为卓越的Zen 5,计划于今年内发布。


Zen 4已实现了超过15%的单线程性能提升,并引入了AVX-512指令集,以更节能的方式加速AI推理,同时加入了BF16模型,实现了相较于FP32两倍的性能提升。


XDNA NPU架构专注于边缘端和终端的AI推理应用,特别关注每瓦性能和能效的优化。


其独特的Adaptive dataflow(自适应数据流结构)有效解决了生成式AI中高昂的内存和带宽问题。


基于这一架构,XDNA能够将深度神经网络映射到Custom dataflow(数据流架构)中,从而大幅提升性能和能效。


此外,XDNA的空间分区架构支持多重任务处理,系统可同时执行四个AI工作负载。



值得一提的是,AMD XDNA架构是通过收购AMD Xilinx而获得的。


该架构内部的AI引擎单元采用类似Mesh的专用互联方式,确保各个单元之间能够直接通信,消除了数据阻塞的可能性,并保证了时序的确定性。


每个AI引擎单元都配备了分布式本地内存,避免了缓存未命中的情况,提供了更高的访问带宽,降低了对内存容量的需求。


这种自适应数据流架构专为AI计算设计,旨在提供领先的每瓦TOPS算力。


据AMD方面透露,下一代AMD XDNA架构设计旨在将NPU计算和代际的AI TOP算力性能翻三倍,为未来的AI计算奠定坚实基础。


随着技术的演进,XDNA架构将升级到XDNA2,进一步降低内存访问需求,提升性能和能效。


AMD Ryzen AI软件栈实现了CPU和GPU跨架构的AI融合加速,确保在各种应用场景下都能实现最佳性能。


根据官方路线图,下一代全新架构将是RDNA4,核心代号Navi 4x系列,预计将应用于RX 8000系列显卡。


AMD Ryzen AI软件通过优化CPU、GPU和NPU的协同工作,实现了跨平台的最佳性能表现。



结尾:


接下来,AMD将致力于深化端到端的AI基础架构,力求在云端和边缘端实现全面的AI引擎覆盖。


将从计算引擎、软件功能以及生态系统等多个维度,全面推进AI战略的实施。


部分资料参考:投资界:《今天,苏姿丰来北京了》,电脑报:《全面赋能AI应用生态圈!AMD AI PC创新峰会在京举行》,DoNews:《[芯片女王]来京,只为做这一件事》,智能涌现:《对话AMD苏姿丰:AI是50年来最具变革性技术,能否引发PC换机潮?》,芯东西:《AMD全面进军AI PC,数百万台锐龙AI PC已出货》,钛媒体AGI:《芯片巨头AMD全面发力AI PC,数百万设备已出货》,置顶头条:《AMD生态开疆拓土 引领AI PC狂潮席卷中国》,中国电子报:《AMD苏妈为AI PC划重点》


本公众号所刊发稿件及图片来源于网络,仅用于交流使用,如有侵权请联系回复,我们收到信息后会在24小时内处理。



END


推荐阅读:


商务合作请加微信勾搭:

18948782064

请务必注明:

「姓名 + 公司 + 合作需求」


AI芯天下 聚焦人工智能,AI芯片,5G通讯等行业动态
评论
  • 全球智能电视时代来临这年头若是消费者想随意地从各个通路中选购电视时,不难发现目前市场上的产品都已是具有智能联网功能的智能电视了,可以宣告智能电视的普及时代已到临!Google从2021年开始大力推广Google TV(即原Android TV的升级版),其他各大品牌商也都跟进推出搭载Google TV操作系统的机种,除了Google TV外,LG、Samsung、Panasonic等大厂牌也开发出自家的智能电视平台,可以看出各家业者都一致地看好这块大饼。智能电视的Wi-Fi连线怎么消失了?智能电
    百佳泰测试实验室 2024-12-12 17:33 33浏览
  • 本文介绍瑞芯微RK3588主板/开发板Android12系统下,APK签名文件生成方法。触觉智能EVB3588开发板演示,搭载了瑞芯微RK3588芯片,该开发板是核心板加底板设计,音视频接口、通信接口等各类接口一应俱全,可帮助企业提高产品开发效率,缩短上市时间,降低成本和设计风险。工具准备下载Keytool-ImportKeyPair工具在源码:build/target/product/security/系统初始签名文件目录中,将以下三个文件拷贝出来:platform.pem;platform.
    Industio_触觉智能 2024-12-12 10:27 27浏览
  • 一、SAE J1939协议概述SAE J1939协议是由美国汽车工程师协会(SAE,Society of Automotive Engineers)定义的一种用于重型车辆和工业设备中的通信协议,主要应用于车辆和设备之间的实时数据交换。J1939基于CAN(Controller Area Network)总线技术,使用29bit的扩展标识符和扩展数据帧,CAN通信速率为250Kbps,用于车载电子控制单元(ECU)之间的通信和控制。小北同学在之前也对J1939协议做过扫盲科普【科普系列】SAE J
    北汇信息 2024-12-11 15:45 108浏览
  • 天问Block和Mixly是两个不同的编程工具,分别在单片机开发和教育编程领域有各自的应用。以下是对它们的详细比较: 基本定义 天问Block:天问Block是一个基于区块链技术的数字身份验证和数据交换平台。它的目标是为用户提供一个安全、去中心化、可信任的数字身份验证和数据交换解决方案。 Mixly:Mixly是一款由北京师范大学教育学部创客教育实验室开发的图形化编程软件,旨在为初学者提供一个易于学习和使用的Arduino编程环境。 主要功能 天问Block:支持STC全系列8位单片机,32位
    丙丁先生 2024-12-11 13:15 63浏览
  • 时源芯微——RE超标整机定位与解决详细流程一、 初步测量与问题确认使用专业的电磁辐射测量设备,对整机的辐射发射进行精确测量。确认是否存在RE超标问题,并记录超标频段和幅度。二、电缆检查与处理若存在信号电缆:步骤一:拔掉所有信号电缆,仅保留电源线,再次测量整机的辐射发射。若测量合格:判定问题出在信号电缆上,可能是电缆的共模电流导致。逐一连接信号电缆,每次连接后测量,定位具体哪根电缆或接口导致超标。对问题电缆进行处理,如加共模扼流圈、滤波器,或优化电缆布局和屏蔽。重新连接所有电缆,再次测量
    时源芯微 2024-12-11 17:11 106浏览
  • 应用环境与极具挑战性的测试需求在服务器制造领域里,系统整合测试(System Integration Test;SIT)是确保产品质量和性能的关键步骤。随着服务器系统的复杂性不断提升,包括:多种硬件组件、操作系统、虚拟化平台以及各种应用程序和服务的整合,服务器制造商面临着更有挑战性的测试需求。这些挑战主要体现在以下五个方面:1. 硬件和软件的高度整合:现代服务器通常包括多个处理器、内存模块、储存设备和网络接口。这些硬件组件必须与操作系统及应用软件无缝整合。SIT测试可以帮助制造商确保这些不同组件
    百佳泰测试实验室 2024-12-12 17:45 25浏览
  • 习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习笔记&记录学习习笔记&记学习学习笔记&记录学习学习笔记&记录学习习笔记&记录学习学习笔记&记录学习学习笔记记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记
    youyeye 2024-12-12 10:13 21浏览
  • 在智能化技术快速发展当下,图像数据的采集与处理逐渐成为自动驾驶、工业等领域的一项关键技术。高质量的图像数据采集与算法集成测试都是确保系统性能和可靠性的关键。随着技术的不断进步,对于图像数据的采集、处理和分析的需求日益增长,这不仅要求我们拥有高性能的相机硬件,还要求我们能够高效地集成和测试各种算法。我们探索了一种多源相机数据采集与算法集成测试方案,能够满足不同应用场景下对图像采集和算法测试的多样化需求,确保数据的准确性和算法的有效性。一、相机组成相机一般由镜头(Lens),图像传感器(Image
    康谋 2024-12-12 09:45 74浏览
  • 近日,搭载紫光展锐W517芯片平台的INMO GO2由影目科技正式推出。作为全球首款专为商务场景设计的智能翻译眼镜,INMO GO2 以“快、准、稳”三大核心优势,突破传统翻译产品局限,为全球商务人士带来高效、自然、稳定的跨语言交流体验。 INMO GO2内置的W517芯片,是紫光展锐4G旗舰级智能穿戴平台,采用四核处理器,具有高性能、低功耗的优势,内置超微高集成技术,采用先进工艺,计算能力相比同档位竞品提升4倍,强大的性能提供更加多样化的应用场景。【视频见P盘链接】 依托“
    紫光展锐 2024-12-11 11:50 69浏览
  • 首先在gitee上打个广告:ad5d2f3b647444a88b6f7f9555fd681f.mp4 · 丙丁先生/香河英茂工作室中国 - Gitee.com丙丁先生 (mr-bingding) - Gitee.com2024年对我来说是充满挑战和机遇的一年。在这一年里,我不仅进行了多个开发板的测评,还尝试了多种不同的项目和技术。今天,我想分享一下这一年的故事,希望能给大家带来一些启发和乐趣。 年初的时候,我开始对各种开发板进行测评。从STM32WBA55CG到瑞萨、平头哥和平海的开发板,我都
    丙丁先生 2024-12-11 20:14 68浏览
  • 习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习笔记&记录学习习笔记&记学习学习笔记&记录学习学习笔记&记录学习习笔记&记录学习学习笔记&记录学习学习笔记记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记录学习学习笔记&记
    youyeye 2024-12-11 17:58 83浏览
  • 铁氧体芯片是一种基于铁氧体磁性材料制成的芯片,在通信、传感器、储能等领域有着广泛的应用。铁氧体磁性材料能够通过外加磁场调控其导电性质和反射性质,因此在信号处理和传感器技术方面有着独特的优势。以下是对半导体划片机在铁氧体划切领域应用的详细阐述: 一、半导体划片机的工作原理与特点半导体划片机是一种使用刀片或通过激光等方式高精度切割被加工物的装置,是半导体后道封测中晶圆切割和WLP切割环节的关键设备。它结合了水气电、空气静压高速主轴、精密机械传动、传感器及自动化控制等先进技术,具有高精度、高
    博捷芯划片机 2024-12-12 09:16 80浏览
  • RK3506 是瑞芯微推出的MPU产品,芯片制程为22nm,定位于轻量级、低成本解决方案。该MPU具有低功耗、外设接口丰富、实时性高的特点,适合用多种工商业场景。本文将基于RK3506的设计特点,为大家分析其应用场景。RK3506核心板主要分为三个型号,各型号间的区别如下图:​图 1  RK3506核心板处理器型号场景1:显示HMIRK3506核心板显示接口支持RGB、MIPI、QSPI输出,且支持2D图形加速,轻松运行QT、LVGL等GUI,最快3S内开
    万象奥科 2024-12-11 15:42 83浏览
我要评论
0
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦