华为Mate 40系列手机中国区的发布会今天刚刚在上海举办,其中最引人注目的部分自然就是在这个特殊历史时期出现的海思麒麟(Kirin)9000 SoC了。本文主要探讨麒麟9000这颗芯片——虽然电子工程专辑此前已经在这款手机的全球发布会期间,对这颗芯片做了简单的探讨,我还是希望能够更全面地来呈现这颗,未来回看可能具有历史意义的SoC。

GPU:秒杀高通Adreno?

麒麟9000的GPU部分是非常值得一说的。去年麒麟990并未按照我们的预期,采用Arm Mali G77,而是继续采用麒麟980时期的G76。此前我曾撰文提到过,高通如今正逐渐在GPU部分丢失往常的优势:如果Mali G77能够按照Arm预期的那样,那么Mali GPU很可能实现对Adreno GPU性能和效率的同时追平。

悲剧的是,华为并未采用G77。而实施G77的三星Exynos 990(Mali G77MP11)与联发科天玑1000(MP9),在规模上都不够大——前者多方面的问题还相当一言难尽。这就让我们无从了解,G77到底是个什么水平。加上骁龙865的Adreno 640小小发挥了一下,在不少测试中的效率表现都和苹果相差不大了(性能仍有差距),Arm Mali阵营这边就急需一款产品来证明GPU的实际水准。

麒麟9000直接跳过G77,用上了Mali G78。华为给出的数据是,相比骁龙865+,麒麟9000的GPU性能领先52%,能效领先50%。从华为的PPT来看,对比的是GFXbench 5.0 Aztec Ruins Vulkan项目(不过极有可能,性能提升和效率提升的测试条件是不同的)。单纯从这个跑分来看,可能已经达到了苹果A13或者A14的水平——余承东在手机发布会现场列出了iPhone 12 Pro与Mate 40 Pro+的GPU跑分性能,两者似乎的确已经是相近水平:虽然目前还不清楚这是峰值性能还是持续性能,以及并未有能效比较的数据。

无论如何,这两个分数都是相当巨大的领先,这使得今年Mate 40系列手机的游戏表现非常令人期待。

华为自己的实际游戏性能测试是,“某国内TOP MOBA类游戏”满帧状态的能效,平均比“友商”(也就是骁龙865 Plus,三星Galaxy Note 20 Ultra)优秀20%;包括《王者荣耀》《和平精英》《明日之后》等在内的多款主流游戏,系统能效比都优于骁龙865+——这似乎还是华为首次在反复提GPU的“能效”,而不单纯是性能:表明这次的底气比以往都更充足。

事实上,Mali G78相比G77并没有发生太大的变化。但G77是首次换用了Valhall架构——算是一次大变动,G78则是个改款。仍然建议有兴趣的同学阅读此前有关Mali G77的文章《Arm新版Mali GPU简析:这次终于赶超高通和苹果?》。G77相比G76,性能密度提升30%,能效提升30%;主要是G77的shader核心换用新的执行引擎,16-wide warp执行模型,合并为一个执行引擎,提升ALU利用率。

因为此前G76已经有了一次Arm Mali阵营的大跃进,所以G77就纸面数字来看还是比较优秀的。而G78,Arm的数字是结合微架构与制造工艺的双重改进,相较G77有25%的性能提升。相同工艺情况下,性能密度提升15%(相同面积下,获得15%性能提升);能效提升10%。

Mali G78支持的最大核心数目提升到了24个核心,不知该说Arm Mali这种增多核心的路线是种进步还是退步——麒麟9000显然拉满了这个数字,算是G78的顶配了(9000E则为22个核心),从去年开始似乎华为已经不再走过去那种高频少核的路线了。

G78的执行核心与前代相比没什么变化,就是延续了Valhall架构的特色(16-wide,合并为一个引擎);shader核心整体上也没什么变化。其最大的变化在于从整个GPU的全局频域(frequency domain)变为两级结构,最顶级的共享GPU模块为一个频域,shader核心为一个频域——也就是GPU内部不同步的时钟域,shader核心可以跑在不同的频率下。只是不知道麒麟9000是否实施了这个方案。

这事实上解决了Mali GPU一个很大的问题:要在屏幕上推更多数量的多边形时,以前只能全面推高运行频率。如今市面上出现的新游戏普遍是几何处理工作偏重的,将tiler和几何引擎运行频率解耦,就能够解决吞吐不平衡的问题。另外就是,理论上能效也能得到改进——只不过要增加额外的电压域实施,也就增加了系统的成本。除此之外,G78的FMA引擎做了翻新,主要是乘法器结构变化,以及FP32和FP16路径做了隔离,据说是以面积来换取30%的节能。

大概也是因为GPU性能和效率水平真的上来了,艾伟今年谈了不少游戏画质相关的东西。而且事实上,在《原神》这类游戏开始出现在手机之上,更多原本属于PC和主机的游戏体验、特效,都开始向移动平台迁移。

包括SSR屏幕空间反射、MSAA/TAA抗锯齿,以及动态模糊、体积光+实时阴影等更好的游戏画质实现上,华为宣传的是麒麟9000在更好地实现这些特效的基础上,同时做到高帧率,以及更高的效率——如上图所示,是对比某尚未发布的游戏,在开启HDR、MSAA抗锯齿等特性后,稳定60fps运行,以及实现比“友商芯片平台”(这个对比对象未知)高了一倍的效率(图中中间mW/frame数值)。这其中应该也有AI的辅助:早年Kirin 970时期起,通过机器学习来达成针对特定游戏、特定设备的最优化DVFS调度。

所以Mate 40的GPU实际表现,的确令人十分期待。骁龙875的GPU恐怕会面临比较大的压力。

NPU:现在有什么用?

麒麟9000的NPU升级到达芬奇架构2.0,“NPU算力翻倍”。当然我们不清楚达芬奇架构2.0相比1.0,到底改了些什么。比较抽象的形容是“MAC规模翻倍,卷积网络性能翻倍,核间通讯带宽翻番”。所以AI Benchmark(ETH AI Benchmark V4.0)之类的拿“全球第一”也并不奇怪。另外华为这次特别提到了Int8数据类型的性能与能效。

艾伟说AI普及后,手机终端越来越多地需要做8位整型数据计算,而不是浮点FP16。用ResNet50网络来跑,麒麟9000的Int8性能较骁龙865+高出60%,能效则高了150%——这应该和高通的AI Engine始终不上专核,而主要靠强化DSP与异构计算有关。

SoC层面另外值得一提的就是前文已经提到过的system cache。由于这个末端cache容量增大,很多情况下各IP模块就不需要再去调用DRAM。由于带宽的成倍增加,以及能效的提升,NPU与其他处理器工作的实时性才有更好的保障。

往年的NPU介绍,大致上也就停留在这个程度了。今年华为似乎急着想要证明,NPU究竟能用来做什么。事实上,Android阵营的AI生态发展得并没有那么高速,即便华为始终在说HiAI支持的人工智能网络算子是业界最多。但华为在这个生态上的建设,真可谓不遗余力。这次艾伟主要列举了NPU的三个用处:AI视频处理、AI拍视频、AI AR。

本文为EET电子工程专辑原创文章,禁止转载。请尊重知识产权,违者本司保留追究责任的权利。
  • a15 isp 和麒麟9000isp
  • 100~150ms玩游戏是高ping了。理想ping值要在小两位数左右。
  • 没有如果
  • 理性文字
  • 如果华为的麒麟装到苹果手机上面不知道会怎么样
  • 写得非常清晰,赞
阅读全文,请先
您可能感兴趣
基于Lunar Lake的ThinkPad X1 Carbon笔记本重量就只有984g,如果拿这台笔记本和几年前重达2kg的游戏本比玩游戏谁更强,会怎样?
此次收购符合南芯科技的长期战略规划,通过整合昇生微在嵌入式芯片设计上的技术专长和研发团队,南芯科技将强化其在硬件、IP、算法及软件等方面的技术优势……
欧洲在1nm和光芯片技术上的试验线启动,将有助于缩小研究与制造之间的差距,并推动整个半导体生态系统的发展。
过去四年里,美国电子制造业的投资额已经超过此前三十年的总和,整体规划投资约达4500亿美元,堪称美国史上规模最大的半导体制造扩张。
面对未来道路的挑战,新一代汽车的OEM正在积极探索创新之路,努力实现既符合日益严格的法规要求的乘客安全功能,又配备出色音频性能的沉浸式车内娱乐系统,以满足市场和消费者的需求。在这一过程中,OEM可以充分借助TI全新推出芯片产品,重塑车内体验,开启汽车驾乘的新纪元。
尽管市场上有传言称英伟达大幅削减了对台积电CoWoS-S封装的需求,甚至有报告指出砍单幅度高达80%,但台积电和英伟达均对此进行了否认......
对于未来行业发展的增长趋势、行业特征和渠道特点等方面,IDC 总结并给出了2025年中国PC 显示器市场十大洞察……
该存内计算芯片采用全数字设计,能够保证不同位宽配置下的精确计算。为实现不同位宽配置下的高利用率和高能效,团队提出了一种……
西门子数字化工业软件在IDC MarketScape发布的《2024 – 2025全球制造执行系统供应商报告》中被评为MES领导厂商,该报告针对制造业的MES软件厂商进行了综合性评估。
Arm宣布其芯粒系统架构 (CSA) 正式推出首个公开规范,进一步推动芯粒技术的标准化,并减少行业的碎片化。
NAND闪存过剩情况下,势必让SSD等存储价格下滑,所以大厂们也开始行动了。据国外媒体报道称,由于NAND闪存持续供过于求,相应市场面临严峻挑战,除了企业级SSD有动能支撑外,其他终端产品销量均普遍不
近日,据36氪报道,进入2025年,丰田汽车针对中国区业务进行了一系列重要的人事调整。丰田中国已正式任命李晖为首位中国籍总经理。同时,广汽丰田现任总经理藤原宽行将被调任至一汽丰田,担任总经理一职。这一
美通社消息,根据Omdia最新的消费者调查,TikTok和YouTube已成为美国18-35岁人群的领先视频平台。这些平台的发展速度已经超过了Instagram、Facebook和Netflix,巩固
电影《金陵十三钗》剧照上周,一向低调的轻舟智航举办了一场媒体交流会,联合创始人、总裁侯聪和 CTO 李栋等轻舟智航核心成员亲临现场,讲述轻舟智航过去一年的成绩及未来展望。轻舟智航的 2024,成绩斐然
1月21日晚,中国MCU市场龙头兆易创新发布了2024年业绩预告,数据显示:2024年——预计实现营业收入73.49亿元左右,同比增长27.57%左右;预计归母净利润为10.90亿元,同比增长576.
上周SemiAccurate 曾报道称,一家神秘公司正在探索全面收购英特尔的可能性。表示有 90% 的把握认为有关英特尔被收购的消息是“真实的”,已从另一位“地位很高的消息人士”处获得了证实。虽然没有
据晚点 Auto消息,近日,比亚迪汽车新技术研究院院长、比亚迪智驾总负责人杨冬生在技术院内部,谈了他对于技术研发、管理、制度等话题的看法,并提出了新的工作要求或者方向。他表示:“一个产品的先进和成功是
要点 原始设计制造商(ODM)/ 独立设计公司(IDH)产业格局受到地缘政治冲突的影响。闻泰科技已剥离受影响的业务,并专注于半导体业务。立讯精密收购了闻泰的ODM业务,改善了自身的业务布局。随着ODM
近日,赛力斯发布2024 年年度业绩预盈公告,预计 2024 年度实现营业收入1442亿元到1467亿元,同比增长302.32%到309.30%;归属于上市公司股东的净利润预计将达到55亿元至60亿元
我是芯片超人花姐,入行20年,有40W+芯片行业粉丝。有很多不方便公开发公众号的,关于芯片买卖、关于资源链接等,我会分享在朋友圈。扫码加我本人微信👇TI(德州仪器)于1月23日(当地时间)公布了 20