阿里达摩院AI大模型M6再创世界纪录:512颗GPU、10万亿模型-电子工程专辑

 阿里巴巴达摩院传来又一个新攻破，多模态大模型M66创下一个世界纪录，其参数已从万亿跃迁至10万亿，规模远超谷歌、微软此前发布的万亿级模型，成为全球最大的AI预训练模型。

阿里巴巴达摩院传来又一个新攻破，多模态大模型M66创下一个世界纪录，其参数已从万亿跃迁至10万亿，规模远超谷歌、微软此前发布的万亿级模型，成为全球最大的AI预训练模型。

作为通用性AI大模型，M6拥有多模态、多任务能力，尤其擅长设计、写作、问答，在电商、制造业、文学艺术、科学研究等领域有广泛应用前景。

与传统AI相比，大模型拥有成百上千倍“神经元”数量，认知和创造能力也更胜一筹，被普遍认为是未来的“基础模型”。

但是，大模型的算力成本相当高昂，比如训练1750亿参数语言大模型GPT-3所需能耗，能让一辆汽车在地月之间往返一趟。

今年5月，通过专家并行策略及优化技术，达摩院M6团队将万亿模型能耗降低超过80％，效率提升近11倍。

10月，M6再次突破业界极限，使用512颗GPU，在10天内就训练出了具有可用水平的10万亿模型，相比去年发布的大模型GPT-3，M6实现了同等参数规模，能耗却只有1％。

另一方面，AI大模型扩展到千亿及以上参数的超大规模时，很难放在一台机器上，为此达摩院在阿里云PAI自研Whale框架上搭建了MoE模型，并通过更细粒度的CPU offload技术，最终实现将10万亿参数放进512张GPU：

自研Whale框架：

自研Whale分布式深度学习训练框架，针对数据并行、模型并行、流水并行、混合并行等多种并行模型进行了统一架构设计，让用户在仅仅添加几行API调用的情况下就可以实现丰富的分布式并行策略。

MoE专家并行策略：

在Whale架构中实现Mixture-of-Experts（MoE）专家并行策略，在扩展模型容量、提升模型效果的基础上，不显著增加运算FLOPs（每秒所执行的浮点运算次数），从而实现高效训练大规模模型的目的。

CPU offload创新技术：

在自研的分布式框架Whale中通过更细粒度的CPU offload，解决了有限资源放下极限规模的难题，并通过灵活地选择offload的模型层，进一步地提高GPU利用率。

此外，针对训练效率问题，M6团队设计了Pseudo-to-Real（共享解除）机制，即利用训练好的共享参数模型初始化大模型，让收敛效率进一步提升7倍，解决大模型训练速度慢的问题。

对比不使用该机制，预训练达到同样loss用时仅需6％；和此前万亿模型相比，训练样本量仅需40％。

作为国内首个商业化落地的多模态大模型，M6已在超40个场景中应用，日调用量上亿。

今年，大模型首次支持双11，应用包括但不限于：

－ M6在犀牛智造为品牌设计的服饰已在淘宝上线；

－凭借流畅的写作能力，M6正为天猫虚拟主播创作剧本；

－依靠多模态理解能力，M6正在增进淘宝、支付宝等平台的搜索及内容认知精度。

未来，M6将积极探索与科学应用的结合，通过AI for science让大模型的潜力充分发挥，并加强M6与国产芯片的软硬一体化研究。

目前，达摩院联合阿里云已推出M6服务化平台，为大模型训练及应用提供完备工具，首次让大模型实现“开箱即用”，算法人员及普通用户均可方便地使用平台。

责编：editorAlice

人工智能量子计算

返回列表

上一篇： 华为超聚变数字技术公司移主，出售X86服务器业务原因与手机一样？ 下一篇： 台积电3nm进展如何,苹果A16 iPhone 14、第三代M芯片MacBook Pro如期发布上市？

部分机型缺货、批发价暴涨，这个“冬天”华为“向死而生” 由于美国禁令的影响，华为手机供货非常紧张，大部分商家的拿货量少了15％-20％，小商家很多机型已经断货。而批发价目前已经涨到最高位，直逼官网定价，对“打价格战”的非官方商家打击巨大。华为公司遭遇的变动不仅仅影响着自身，还深刻地影响着整个手机市场。整个产业链不仅是从时效性上，包括从技术上、工艺上、备货上都出现了巨大的波动。
特斯拉Model 3交付时间延长到2个月随着市场的回暖，特斯拉销量最大的型号Model 3交货时间延长，消费者需要2个月才能提到车。
国产芯片突围:龙芯3A5000和3C5000与AMD比肩,未来RISC-V架构设计这段时间，国内半导体不断传出喜讯。不久前，龙芯12nm处理器完成流片，即将面世的消息惊艳四座。要知道我国一直苦于没有能够独当一面的芯
Windows 11怎么设置 DNS over HTTPS功能（附详细步骤教程）不安全的DNS系统导致的DNS劫持使全世界数十亿人容易受到攻击。DoH安全防劫持：DNS over HTTPS，进行DNS查询时通过加密方式发送数据，避免访问的网站被窃取、劫持和篡改。
台积电获批许可,已有5家芯片厂商获准供货华为名单有哪些？根本就是在打压中国经济发展势头，华为等一批信息产业，今天又传来好消息了，已经有5家供应商获批许可名单：英特尔和AMD、索尼、豪威科技、台积电。华为的努力不会白白浪费，就像所有的成功都会经历磨砺，所有的铺垫都是为了最终的辉煌。
华为手机业务复苏?美国或放宽制裁华为条件-非5G芯片供应美国还在不断升级对华为的相关限制，华为也将面临无芯片可能，华为此前采用的基本都是高通以及自家研发的麒麟芯片，还有少部分使用联发科的芯片，美国“吹风”放松对华为制裁，国际供应商陆续获许供货华为？
比亚迪笔记本电脑怎么样,龙芯3A4000cpu+独显,国产系统麒麟OS、UO 比亚迪汽车大家都非常熟悉了，BYD生产笔记本电脑？有没有搞错吧？对没有错，比亚迪最近推出笔记本电脑了，外观非常酷炫，配置方面CPU：龙芯3A4000处理器、显卡：景嘉微JM7201、内存：8G DDR4、系统配置：支持龙芯操作系统、麒麟OS、UOS MIPS 版本系统
美国将在月球建4G网络，这个计划的实施有何重要意义？美国航天局宣布，将与芬兰诺基亚公司在月球上共建第一个4G通信网络。该通信网络将为航天员执行任务提供重要通信能力，这些任务包括遥控月球车、实时导航和传输高清视频流。
谐波电流升高原因、为什么要进行补偿、（峰值）计算公式本文带你了解一下几个问题：谐波电流升高的原因？为什么要对谐波电流进行补偿？谐波电流如何计算？谐波电流峰值怎么看？谐波电流指的是在交流电路中，由于非线性元件的存在（例如电感、电
苹果下一代芯片(iPhone 13系列）5nm Plus A15、N4工艺M1升级版台积电失去了华为这个大客户后，代工业务似乎没多大影响，反而是老伙伴苹果的订单需求量越来越大。最新处理器已来到A15和M系列（M1和M1升级版 \M2）都开始用台积电代工生产，台积电很自然的从苹果那里获得的订单越来越多。

中国成为最大腕戴设备市场，引领全球增长腕戴设备市场包含智能手表和手环产品。其中，智能手表市场在2024年前三季度全球出货量1.1亿台，同比下降3.8%；而中国智能手表市场出货量3,286万台，同比增长……
截止2030年，全球蜂窝物联网连接收入将超过 260 亿美元 • 2023 年，全球蜂窝物联网连接数激增 24%，超过 33 亿，到 2030 年将突破 62 亿。 • 尽管中国在 2023 年以 23 亿的连接数规模占据全球蜂窝物联网连接总数的 70%，但其在全球连接收入中的份额仅为 36%。 • 到 2030 年，联网汽车、智能表计和智能零售这三大应用预计将合计占蜂窝物联网应用总市场份额的 60% 以上。 • 到 2030 年，5G 连接将在全球范围内超过 NB-IoT 连接，占物联网连接总收入的近 50%。
为什么翻新机的价格在上涨？ • 目前，iPhone在翻新市场中是最热门的商品，并将长期主导着翻新机的平均销售价格。 • 全球翻新机市场持续向高端化发展，其平均销售价格（ASP）现已超过新手机。 • 新兴市场是增长的最大驱动力，消费者对高端旗舰产品有着迫切需求。 • 由于市场固化和供应链的一些问题限制推高中国、东南亚和非洲等大市场的价格。 • 2024年，这些翻新机平均销售价格将首次超过新手机。
2024三季度全球扫地机器人市场出货增长持续，卷势不减从全球厂商竞争来看，三季度凭借多个新品发布，石头科技市场份额提升至16.4%,连续两季度排名全球第一……
AMOLED行业核心模具，精密金属掩膜版国产技术攻克核心瓶颈 AMOLED行业的关键模具FMM及Invar在市场中属于极其细分而品质又要求极高的赛道，传统企业打法在这两个产品上都难以适用。唯有对上下游有深度了解，并能够将产业链技术链条打通，才能够将近似于黑箱中的FMM及其原材料Invar长期受限的困局打破。
IDC：2024前三季度中国安全硬件市场规模同比下降2.9% IDC定义下的网络安全硬件市场分别由统一威胁管理 (UTM)、基于UTM平台的防火墙 (UTM Firewall) 、安全内容管理（SCM）、入侵检测与防御 (IDP)、虚拟专用网（VPN）和传统防火墙 (Traditional Firewall) 构成。
预计1Q25 NAND Flash价格将出现超10%下滑 2025年第一季NAND Flash供货商将面临库存持续上升，订单需求下降等挑战，平均合约价恐季减10%至15%。
山东大学团队在高精度存算芯片领域取得新进展本研究通过设计闪存存算一体架构，有效提升了计算效率和精度，为解决复杂计算任务提供了重要技术支撑。
加速资源整合将是本田与日产合并后的首要任务日本两大全球汽车集团本田与日产于2024年12月23日宣布启动合并谈判，目标在2025年6月达成协议，三菱汽车也有望加入。若三家车厂顺利合并，当务之急将是整合各自的资源以节省开支，利用规模化生产降低成本，以及加快电动车相关计划......
2024过去了，细数中国工业经济这一年这一年的成绩单足够亮眼，但来之不易。

热门评论
最新评论

换一换

阿里达摩院AI大模型M6再创世界纪录:512颗GPU、10万亿模型

杂志声明