异构芯片,探析未来算力出路

智能计算芯世界 2024-01-30 07:34

本文来自“芯片未来可期:数据中心、国产化浪潮和先进封装(精华)”,英伟达宣布 GH200 Grace Hopper 超级芯片投产,生成式 AI 引擎 NVIDIA DGX GH200 现已投入量产

GH200 使用 Nvidia 的 NVLink-C2C 互连技术,将 Nvidia 基于 ARM 的 Grace CPU和 Hopper GPU 架构融合到一个芯片中。NVIDIA DGX GH200 将 256 个 NVIDIA Grace Hopper超级芯片完全连接到单个 GPU 中,支持万亿参数 AI 大模型训练,能够处理大规模推荐系统、生成式人工智能和图形分析,并为巨型人工智能模型提供线性可扩展性。

下载链接:
智能时代的计算架构发展趋势
半导体封装行业深度:先进封装引领未来
中国芯未来梦:2023半导体洞察报告
2023年边缘计算网关技术词条报告
《半导体行业系列报告合集》
1、半导体行业系列报告(一):道阻且长,行则将至 2、半导体行业系列报告(二)碳化硅:衬底产能持续扩充,渗透加速国产化 3、半导体行业系列报告(三)先进封装:先进封装大有可为,上下游产业链将受益
芯片未来可期:数据中心、国产化浪潮和先进封装(精华)
智算时代的容器技术演进与实践
半导体存储行业深度研究(2023)
2023 LLM技术报告:知名大模型应用
中国智能汽车车载计算芯片产业报告
中国车规级芯片产业白皮书
中国芯未来梦:2023半导体洞察报告
2023年边缘计算网关技术词条报告
《半导体行业系列报告合集》
1、半导体行业系列报告(一):道阻且长,行则将至 2、半导体行业系列报告(二)碳化硅:衬底产能持续扩充,渗透加速国产化 3、半导体行业系列报告(三)先进封装:先进封装大有可为,上下游产业链将受益
智能汽车芯片专题研究
CPU生态、价值与机遇研究(2021)
信创研究专题框架
异构芯片研究框架合集
中国数据处理器行业概览(2021)
DPU在数据中心和边缘云上的应用
英伟达DPU集数据中心于芯片
行业研究:国产6大CPU全对比
龙芯LoongArch指令集全集
RISC-V芯片产业指令集架构研究
服务器研究框架合集
异构芯片研究框架合集
芯片技术设计和应用汇总
CPU和GPU研究框架合集


GH200 速度和功耗指标都有显著提升。这款新的芯片总带宽达每秒 900GB,比当今最先进的加速计算系统中采用的标准 PCIe Gen5 通道高出 7 倍。Nvidia 表示,Superchip 的功耗也降低了 5倍。

AMD 推出数据中心 APU Instinct MI300。AMD 推出数据中心APU(加速处理器)Instinct MI300,其旨在帮助数据中心处理人工智能相关数据流量,并在这一快速增长的市场上挑战英伟达的垄断地位。Instinct MI300 系列将包括一个 GPU(图形处理器)MI300X,可以加速 ChatGPT 等聊天机器人所使用的生成式 AI 技术的处理

先进算力国产替代在行业变革中有望迎来机遇。半导体国产化势在必行,而算力芯片又是重中之重。AI 算力、低功耗等对服务器算力芯片提出新的要求,市场格局近几个季度变化较多,英伟达GH200 有望加速全球 AI 服务器算力芯片市场变革,中国芯片企业在面临挑战的同时,也有望迎来发展机遇。

1、不同算力芯片的特点与区别

计算芯片包括 CPU、GPU、FPGA、ASIC 等,都用作计算分析。其中,CPU 是性能最综合的计算芯片,AI 算法的执行也运用 GPU、FPGA、ASIC 等芯片

CPU 是综合计算芯片,擅长逻辑控制和串行运算。计算机的运算器和控制器一起组成了 CPU,CPU 是整台计算机的大脑,也是一个有多种功能的优秀领导者。它的优点在于调度、管理、协调能力强,计算能力则位于其次。CPU 有大量的缓存和复杂的逻辑控制单元,非常擅长逻辑控制、串行的运算,但因计算单元占 30%左右,不擅长复杂算法运算和处理并行重复的操作。

GPU相比CPU计算单元大大增加,擅长大量并行计算。而作为通用芯片的 GPU 相当于一个接受CPU 调度的“拥有大量计算能力”的员工,计算单元相比 CPU 大大增加。GPU 最初承担图像计算任务,能够进行并行计算,因此 GPU 架构本身比较适合深度学习算法,通过对 GPU 的优化,进一步满足深度学习大量计算需求。其主要缺点在于功耗较高。

GPU 按照接入类型可以分为独立 GPU 和集成 GPU。独立 GPU 即独立显卡,需要插在主板的相应接口上,具备单独的显存,不占用系统内存,能够提供更好的显示效果和运行性能。全球知名供应商主要包括 AMD 和 NVIDIA 两家。集成 GPU 即集成显卡,是将图形核心以单独芯片的方式集成在主板上,并且动态共享部分系统内存作为显存使用,能够提供简单的图形处理能力,以及较为流畅的编码应用。全球知名供应商主要包括英特尔和 AMD 两家。

GPU 按照应用场景不同可分为 PC GPU、服务器 GPU 和移动 GPU。

1)集成 GPU 一般运用于PC 以轻办公、文字编纂为主;独立 GPU 则一般运用于 PC 以制作高清图片、编辑视频、渲染游戏等。

2)服务器 GPU 主要以独立 GPU 为主。服务器 GPU 主要应用于服务器,可做专业可视化、计算加速、深度学习等应用。

3)移动 GPU 以集成 GPU 为主。随着移动端向着轻薄化不断发展,终端内部净空间随着多种功能模组的增加呈快速下降趋势。此外,就目前的移动端视频和图片的处理要求而言,集成 GPU 的性能尚可满足移动端的需要。

GPU技术篇
  • GPU分析:全球竞争格局与未来发展
  • 2023年GPU显卡技术词条报告
  • 英伟达GPU龙头稳固,国内逐步追赶(详解)
  • GPU/CPU领域散热工艺的发展与路径演绎
  • 探析ARM第五代GPU架构
  • 新型GPU云桌面发展白皮书
  • 十大国产GPU产品及规格概述
  • GPU平台生态:英伟达CUDA和AMD ROCm对比分析
  • GPU竞争壁垒:微架构和平台生态
  • GPU微架构、性能指标、场景、生态链及竞争格局(2023)
  • 大模型训练,绕不开GPU和英伟达
  • Nvidia/AMD竞争:GPU架构创新和新兴领域前瞻探索
  • 走进芯时代:AI算力GPU行业深度报告
  • 独立GPU市场,AMD份额大跌?
  • CPU渲染和GPU渲染优劣分析
  • NVIDIA Hopper GPU:芯片三围、架构、成本和性能分析
  • 国内GPU厂商及细分行业前景(2023)
  • ChatGPT对GPU算力的需求测算与分析
  • AMD RDNA2 GPU架构详解
  • GPU研究框架(2023)

FPGA 又称半定制化芯片,具有足够的计算能力、较低的试错成本和足够的灵活性。FPGA 的计算速度快是源于它本质上是无指令、无需共享内存的体系结构,“无指令”即使用硬件描述语言编程,直接编译为晶体管电路的组合,所以 FPGA 实际上直接用晶体管电路实现用户的算法,没有通过指令系统的翻译;“无需共享内存”是指对于保存状态的需求,FPGA 中的寄存器和片上内存(BRAM)是属于各自的控制逻辑的,无需不必要的仲裁和缓存。

因此,FPGA 运算速度足够快,优于GPU。同时,相比量产成本高昂的 ASIC 芯片,因为 FPGA 是一种半定制的硬件,通过编程可定义其中的单元配置和链接架构进行计算,因此在灵活性上优于 ASIC,具备较低试错成本。

ASIC 是全定制芯片,性能强但是前期开发久、成本高。是根据产品的需求进行特定设计和制造的集成电路,能够在特定功能上进行强化,具有更高的处理速度和更低的能耗。缺点是成本高,且由于定制化,可复制性一般,因此只有用量足够大时才能够分摊前期投入,降低成本。

2、CPU 广泛应用于服务器、工作站、个人计算机等

CPU 可以应用在服务器、工作站、个人计算机(台式机、笔记本电脑)、移动终端和嵌入式设备等不同设备上,根据应用领域的不同,其架构、功能、性能、可靠性、能效比等技术指标也存在一定差异

服务器处理器需长时间运行,数据处理能力最强、设计工艺最复杂、可靠性最高。服务器具有高速的数据处理能力、强大的 I/O 数据吞吐能力、良好的可扩展性,并需要长时间可靠运行,其CPU 芯片在性能、可靠性、可扩展性和可维护性等方面要求较为苛刻。因此,服务器处理器是数据处理能力最强、设计工艺最复杂、可靠性最高的处理器。服务器的应用领域包括实时分析、5G应用、人工智能、机器学习、金融、大数据和云计算等领域。

工作站主要为单用户提供比个人计算机更强大的性能。工作站是一种高端微型计算机,主要为单用户提供比个人计算机更强大的性能,尤其是在数据并行处理能力和图形处理能力等方面。工作站的典型应用领域包括科学和工程计算、软件开发、计算机辅助设计等。

个人计算机主要满足个人需求,核心数量较少。个人计算机包括台式机和笔记本电脑两大类,主要用于满足个人的工作、学习、娱乐需求,以及企业员工的办公需求。个人计算机处理器核心数量较少,具有较少 I/O。

移动终端具有低功耗、轻量化等特点,关注对多媒体功能的增强。移动终端包括手机、笔记本、平板电脑、POS 机等。随着集成电路技术的进步和移动网络向宽带化发展,移动终端正从简单通话工具逐步转变为综合信息处理平台。移动终端处理器具有低功耗、轻量化等特点,关注对多媒体功能的增强,具有较少 I/O。

嵌入式设备对功耗、稳定性、可扩展能力要求高。嵌入式设备需要具有高稳定性和低功耗,其处理器对环境(如温度、湿度、电磁场、振动等)的适应能力强,体积小,且集成度高,适用于工业控制、移动便携设备、物联网终端等场合。其中,大多数物联网设备需要额外的 CPU 处理能力来支持可升级的额外功能。因此,针对特定的物联网应用程序的 CPU 不仅必须支持安全特性,而且必须同时具有可扩展的性能,实现更高的时钟频率。物联网应用处理器芯片具有面向高集成度、高抗干扰能力和低功耗的发展趋势。

3、GPU 等 AI 芯片广泛应用于高性能运算、深度学习等场景

AI 芯片主要指面向人工智能应用的芯片。大致包含三类:

1)通用、半定制化芯片:经过软硬件优化可以高效支持 AI 应用的通用芯片,如 GPU,FPGA;

2)专门为特定的 AI 产品或者服务而设计的芯片:侧重加速机器学习(尤其是神经网络、深度学习),如 ASIC;

3)神经形态计算芯片:不采用经典的冯·诺依曼架构,而是基于神经形态架构设计,类似人脑,具备较高的集成度和能效比,以 IBM Truenorth 为代表。

国产算力芯片市占率低,具备广阔拓展空间。算力芯片目前国产厂商份额极低。CPU 目前从市场占有率来说,Intel 依靠其强大的 X86 生态体系,在通用 CPU 市场占据领先地位,市场份额常年保持在 80%左右,AMD 近期追赶势头明显,其他厂商整体市场份额不超过 1%。

2022 年,数据中心领域 Intel 市场占有率为 71%,较 21年下降 10pcts,AMD 在 22 年市占率快速提升 8pcts 至 20%,亚马逊、Ampere 等新兴玩家份额快速提升,给总计份额不足 5%的国产厂商发展带来了借鉴意义。在独立显卡市场上,NVIDIA、AMD 和英特尔 2022 年 Q4 全球 GPU 市场占有率分别为82%、9%和 9%。

多数参数我国 CPU 具备比肩能力,IPC 性能是最主要差距。目前通过公开信息可以看出,主频、核心数、内存类型等指标我国 CPU 厂商差异不大,具备一定的比肩能力,但落实到具体性能决定指标 IPC,仅 Intel 和 AMD 会公布 IPC“相比上一代提升了多少”,其他国产 CPU 从 IPC 性能来看大致落后于 Intel、AMD 几年水平

国产厂商的机遇一:数据中心带来新需求。根据工信部信息通信发展司数据,2017年我国数据中心市场总机架数量 166 万架,2022 年预测达到 670 万架,2017-2022E 复合增速达 32.2%。目前东数西算工程将通过构建数据中心、云计算、大数据一体化的新型算力网络体系,于 2022 年 2 月,在京津冀、长三角、粤港澳大湾区等 8 地启动建设国家算力枢纽节点,规划了 10 个国家数据中心集群。各地数据中心都将集聚大量服务器,如韶关数据中心预计到 2025 年将建成 50 万架标准机架、500 万台服务器规模,投资超 500 亿元(不含服务器及软件)。

国产厂商的机遇二:国产化浪潮。政府及国有企事业单位为国产 CPU 主阵地。据测算,今年 PC 芯片市场规模在 162-330 亿元之间,2022 年服务器芯片市场规模则已达 130 亿美元。在企业级市场中,也不仅是国有企业,能源、交通、金融、电信、教育等重要领域或规模较大的民营企业也存在设备国产化需求。消费级市场对产业生态的要求最高,对性价比较为敏感,迭代周期短,是国产 CPU 长期需突破的目标市场。

国产厂商的机遇三:通过封测技术弯道超车。后摩尔时代的到来,一方面,CPU 制程进入后摩尔定律时期升级速度趋缓,国产 CPU 性能与国际主流水平逐步缩小,存在赶超的可能;另一方面,先进封装技术成为兵家竞争新赛道,在封装方面,我国封测厂商长电科技和通富微电在全球前五中占据两席,通富与 AMD 紧密合作,先进封装技术正成为集成电路产业发展的新引擎,我国 CPU 企业有望通过封测技术弯道超车,弥补先进制程能力不足的缺陷。目前国产 CPU 已经可以通过先进封装技术实现性能提升与应用场景拓展。

下载链接:
龙芯LoongArch指令集全集
RISC-V芯片产业指令集架构研究
服务器研究框架合集
异构芯片研究框架合集
芯片技术设计和应用汇总
CPU和GPU研究框架合集
基于RISC-V调试协议的片上调试系统设计与实现
一款用于Flash型FPGA的阶梯式配置方法
量子计算模拟平台发展综述
面向AIoT芯片的OCR模型压缩方案研究
面向自主可控的微系统关键技术研究及展望
基于RISC-V调试协议的片上调试系统设计与实现
星云计算系统及其任务协同调度方法研究
DDR存储器单粒子翻转试验及加固设计研究进展
基于FPGA的脉冲神经网络模型设计与实现
基于深度学习的行为识别方法综述
DSP体系结构发展综述


本号资料全部上传至知识星球,更多内容请登录智能计算芯知识(知识星球)星球下载全部资料。




免责申明:本号聚焦相关技术分享,内容观点不代表本号立场,可追溯内容均注明来源,发布文章若存在版权等问题,请留言联系删除,谢谢。



温馨提示:

请搜索“AI_Architect”或“扫码”关注公众号实时掌握深度技术分享,点击“阅读原文”获取更多原创技术干货。


智能计算芯世界 聚焦人工智能、芯片设计、异构计算、高性能计算等领域专业知识分享.
评论 (0)
  • 曾几何时,汽车之家可是汽车资讯平台领域响当当的“扛把子”。2005 年成立之初,它就像一位贴心的汽车小助手,一下子就抓住了大家的心。它不仅吸引了海量用户,更是成为汽车厂商和经销商眼中的“香饽饽”,广告投放、合作推广不断,营收和利润一路高歌猛进,2013年成功在纽交所上市,风光无限。2021年更是在香港二次上市,达到了发展的巅峰,当年3月15日上市首日,港股股价一度高达184.6港元,市值可观。然而,如今的汽车之家却陷入了困境,业务下滑明显。业务增长瓶颈从近年来汽车之家公布的财报数据来看,情况不容
    用户1742991715177 2025-04-07 21:48 109浏览
  • HDMI从2.1版本开始采用FRL传输模式,和2.0及之前的版本不同。两者在物理层信号上有所区别,这就需要在一些2.1版本的电路设计上增加匹配电路,使得2.1版本的电路能够向下兼容2.0及之前版本。2.1版本的信号特性下面截取自2.1版本规范定义,可以看到2.1版本支持直流耦合和交流耦合,其共模电压和AVCC相关,信号摆幅在400mV-1200mV2.0及之前版本的信号特性HDMI2.0及之前版本采用TMDS信号物理层,其结构和参数如下:兼容设计根据以上规范定义,可以看出TMDS信号的共模电压范
    durid 2025-04-08 19:01 127浏览
  •   卫星图像智能测绘系统:地理空间数据处理的创新引擎   卫星图像智能测绘系统作为融合卫星遥感、地理信息系统(GIS)、人工智能(AI)以及大数据分析等前沿技术的综合性平台,致力于达成高精度、高效率的地理空间数据采集、处理与应用目标。借助自动化、智能化的技术路径,该系统为国土资源管理、城市规划、灾害监测、环境保护等诸多领域输送关键数据支撑。   应用案例   目前,已有多个卫星图像智能测绘系统在实际应用中取得了显著成效。例如,北京华盛恒辉北京五木恒润卫星图像智能测绘系统。这些成功案例为卫星
    华盛恒辉l58ll334744 2025-04-08 16:19 51浏览
  •   卫星图像智能测绘系统全面解析   一、系统概述   卫星图像智能测绘系统是基于卫星遥感技术、图像处理算法与人工智能(AI)技术的综合应用平台,旨在实现高精度、高效率的地理空间数据获取、处理与分析。该系统通过融合多源卫星数据(如光学、雷达、高光谱等),结合AI驱动的智能算法,实现自动化、智能化的测绘流程,广泛应用于城市规划、自然资源调查、灾害监测等领域。   应用案例   目前,已有多个卫星图像智能测绘系统在实际应用中取得了显著成效。例如,北京华盛恒辉和北京五木恒润卫星图像智能测绘系统
    华盛恒辉l58ll334744 2025-04-08 15:04 47浏览
  • 文/Leon编辑/cc孙聪颖‍转手绢、跳舞、骑车、后空翻,就在宇树、智元等独角兽企业率领“机器人大军”入侵短视频时,却有资本和科技大佬向此产业泼了一盆冷水。金沙江创投管理合伙人朱啸虎近日突然对人形机器人发难,他表示“最近几个月正在批量退出人形机器人公司”。“只是买回去做研究的,或者买回去做展示的,这种都不是我们意义上的商业化,谁会花十几万买一个机器人去干这些活?”朱啸虎吐槽。不过,朱啸虎的观点很快就遭到驳斥,众擎机器人的创始人、董事长赵同阳回怼道:“(朱啸虎)甚至问出了人形机器人在这个阶段有什么
    华尔街科技眼 2025-04-07 19:24 145浏览
  • 在万物互联时代,智能化安防需求持续升级,传统报警系统已难以满足实时性、可靠性与安全性并重的要求。WT2003H-16S低功耗语音芯片方案,以4G实时音频传输、超低功耗设计、端云加密交互为核心,重新定义智能报警设备的性能边界,为家庭、工业、公共安防等领域提供高效、稳定的安全守护。一、技术内核:五大核心突破,构建全场景安防基座1. 双模音频传输,灵活应对复杂场景实时音频流传输:内置高灵敏度MIC,支持环境音实时采集,通过4G模块直接上传至云端服务器,响应速度低至毫秒级,适用于火灾警报、紧急呼救等需即
    广州唯创电子 2025-04-08 08:59 130浏览
  •     根据 IEC术语,瞬态过电压是指持续时间几个毫秒及以下的过高电压,通常是以高阻尼(快速衰减)形式出现,波形可以是振荡的,也可以是非振荡的。    瞬态过电压的成因和机理,IEC 60664-1给出了以下四种:    1. 自然放电,最典型的例子是雷击,感应到电力线路上,并通过电网配电系统传输,抵达用户端;        2. 电网中非特定感性负载通断。例如热处理工厂、机加工工厂对
    电子知识打边炉 2025-04-07 22:59 122浏览
  • 在人工智能技术飞速发展的今天,语音交互正以颠覆性的方式重塑我们的生活体验。WTK6900系列语音识别芯片凭借其离线高性能、抗噪远场识别、毫秒级响应的核心优势,为智能家居领域注入全新活力。以智能风扇为起点,我们开启一场“解放双手”的科技革命,让每一缕凉风都随“声”而至。一、核心技术:精准识别,无惧环境挑战自适应降噪,听懂你的每一句话WTK6900系列芯片搭载前沿信号处理技术,通过自适应降噪算法,可智能过滤环境噪声干扰。无论是家中电视声、户外虫鸣声,还是厨房烹饪的嘈杂声,芯片均能精准提取有效指令,识
    广州唯创电子 2025-04-08 08:40 161浏览
  •   工业自动化领域电磁兼容与接地系统深度剖析   一、电磁兼容(EMC)基础认知   定义及关键意义   电磁兼容性(EMC),指的是设备或者系统在既定的电磁环境里,不但能按预期功能正常运转,而且不会对周边其他设备或系统造成难以承受的电磁干扰。在工业自动化不断发展的当下,大功率电机、变频器等设备被大量应用,现场总线、工业网络等技术也日益普及,致使工业自动化系统所处的电磁环境变得愈发复杂,电磁兼容(EMC)问题也越发严峻。   ​电磁兼容三大核心要素   屏蔽:屏蔽旨在切断电磁波的传播路
    北京华盛恒辉软件开发 2025-04-07 22:55 191浏览
  • 在全球电子产业面临供应链波动、技术迭代和市场需求变化等多重挑战的背景下,安博电子始终秉持“让合作伙伴赢得更多一点”的核心理念,致力于打造稳健、高效、可持续的全球供应链体系。依托覆盖供应商管理、品质检测、智能交付的全链路品控体系,安博电子不仅能确保电子元器件的高可靠性与一致性,更以高透明的供应链管理模式,助力客户降低风险、提升运营效率,推动行业标准升级,与全球合作伙伴共同塑造更具前瞻性的产业生态。动态优选机制:构建纯净供应链生态安博电子将供应商管理视为供应链安全的根基。打造动态优选管控体系,以严格
    电子资讯报 2025-04-07 17:06 93浏览
  •     在研究Corona现象时发现:临界电压与介电材料表面的清洁程度有关。表面越清洁的介电材料,临界电压越高;表面污染物越多的地方,越容易“爬电”。关于Corona现象,另见基础理论第007篇。    这里说的“污染物”,定义为——可能影响介电强度或表面电阻率的固体、液体或气体(电离气体)的任何情况。    IEC 60664-1 (对应GB/T 16935.1-2023) 定义了 Pollution Degree,中文术语是“污染等
    电子知识打边炉 2025-04-07 22:06 92浏览
我要评论
0
0
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦