广告

AI训练效率太低?碳排放相当于5辆汽车从制造到报废的总量

2020-12-31 17:31:30 cnBeta 阅读:
在投入实际应用之前,AI 模型需要汲取大量的数据、知道其学会如何理解用户的输入。遗憾的是,与人类的学习方式相比,这种训练的效率实在太过低下。训练一款 AI 模型所产生的碳排放,甚至与制造和驾驶五辆汽车到报废的总量相当。
广告

本月早些时候,谷歌迫使某位研究人员撤回了一篇论文,其中提到了谷歌当前在搜索和其它文本分析产品中使用的语言处理人工智能所存在的风险。此外,据某些估计,训练一款 AI 模型所产生的碳排放,甚至与制造和驾驶五辆汽车到报废的总量相当。究其原因,还是当前的 AI 训练效率太过低下。

教机器人走路难,教 AI 懂人话更难。

为了深入了解 AI 训练与传统数据中心计算有何不同,ArsTechnica 特地发表了一篇来自 AI 研究与模型开发专业人员的分析文章。

据悉,传统的数据中心任务,主要涉及视频流、电子邮件、以及社交媒体的处理。与之相比的是,AI 训练需要耗费更多的计算量。

在投入实际应用之前,AI 模型需要汲取大量的数据、知道其学会如何理解用户的输入。遗憾的是,与人类的学习方式相比,这种训练的效率实在太过低下。

现代 AI 需要借助人工神经网络来模拟人脑神经元的数学运算,神经元之间的连接强度,亦是该网络的一个重要参数(权重)。

为了学习如何理解语言,网络需要从随机权重开始并进行调整,知道输出让人感到满意的“正确答案”。

BERT 研究配图(来自:PDF)

训练语言网络的一种常见方法,是从维基百科和新闻媒体等网站提取大量文本,遮盖其中的部分单次,然后让 AI 模型尝试猜出正确的答案。

虽然一开始很容易乱成一锅粥,但随着投喂数据量的不断增加、以及学习的深入,神经网络的连接权重和数据提取模式也会不断作出调整,最终带来准确率的逐渐提升。

以最近的某个双向编码器交涉(BERT)模型为例,其学习了英语书籍和维基百科的 33 亿字内容,然后通过 40 次的反复锤炼,才勉强达到了可用的水平。

作为对比,一名才五岁的人类小孩,尽管其听取的词量不到 BERT 的 1/3000,都不至于像 AI 模型这般需要费心费力地去教。

训练前模型结构的差异

显然,与其盲目地让机器和 AI 算法通过不断重复学习、来学会如何像人类一样思考,不如为语言模型选择一个更合适的训练架构,从而大幅削减其构建成本。

有鉴于此,一些研究人员想到了一种更加合适的方案 —— 考虑学习期间需要动用多少个神经元、神经元之间有多少个连接、参数应以多快的速度发生改变等。

随着尝试的组合越来越多,语言网络的精度提升机会也变得越来越大。相比之下,人脑并不需要费力地去寻得最佳结构,因为祖先早在进化过程中就替我们承受了这些苦难。

近年来,企业和学术界在不断搅动 AI 领域的竞争,毕竟即使 1% 的准度提升,也会带来相当显著的优势 —— 尤其是机器翻译等难度相对较高的任务处理上。

然而为了抢占宣传上的制高点,研究人员可能需要对模型展开数千次的训练、每次动用不同的结构方案,才能找到提升哪怕 1% 的最佳实现,即便这么做也会造成能源的大量浪费。

不同任务上的微调

通过测量训练期间使用的通用硬件功耗,马萨诸塞州大学阿默斯特分校的研究人员们,已经估算出了各种 AI 语言模型的能源开销。

结果发现,训练 BERT 所产生的碳足迹,已相当于搭乘飞机往返纽约和旧金山。如果动用不同的结构进行检索,总成本更是可以高达 315 名乘客 / 甚至一架波音 747 的碳足迹。

从业界发展的趋势来看,与 BERT 类似的 GPT-2 语言模型的开销更是有过之而无不及。其网络中的权重已达 15 亿,更别提精度更高的 GPT-3 了(权重 1750 亿)。

Google's DeepMind AI Just Taught Itself To Walk(via)

研究人员指出,许多人已经意识到,即便最终只有一小部分网络能够发挥最大的作用,但构建出一套更大规模的网络,还是有助于提升整体结果的准确性。

遗憾的是,与生物大脑的神经元效率相比,计算机实在是差了太多个数量级。为了减少碳足迹,科技企业或许会转向更绿色的能源、以及借助更加专用的 AI 模型训练硬件。

本文为EET电子工程专辑 原创文章,禁止转载。请尊重知识产权,违者本司保留追究责任的权利。
  • 中国成为最大腕戴设备市场,引领全球增长 腕戴设备市场包含智能手表和手环产品。其中,智能手表市场在2024年前三季度全球出货量1.1亿台,同比下降3.8%;而中国智能手表市场出货量3,286万台,同比增长……
  • 截止2030年,全球蜂窝物联网连接收入将超过 260 亿美元 • 2023 年,全球蜂窝物联网连接数激增 24%,超过 33 亿,到 2030 年将突破 62 亿。 • 尽管中国在 2023 年以 23 亿的连接数规模占据全球蜂窝物联网连接总数的 70%,但其在全球连接收入中的份额仅为 36%。 • 到 2030 年,联网汽车、智能表计和智能零售这三大应用预计将合计占蜂窝物联网应用总市场份额的 60% 以上。 • 到 2030 年,5G 连接将在全球范围内超过 NB-IoT 连接,占物联网连接总收入的近 50%。
  • 为什么翻新机的价格在上涨? • 目前,iPhone在翻新市场中是最热门的商品,并将长期主导着翻新机的平均销售价格。 • 全球翻新机市场持续向高端化发展,其平均销售价格(ASP)现已超过新手机。 • 新兴市场是增长的最大驱动力,消费者对高端旗舰产品有着迫切需求。 • 由于市场固化和供应链的一些问题限制推高中国、东南亚和非洲等大市场的价格。 • 2024年,这些翻新机平均销售价格将首次超过新手机。
  • 2024三季度全球扫地机器人市场出货增长持续,卷势不减 从全球厂商竞争来看,三季度凭借多个新品发布,石头科技市场份额提升至16.4%,连续两季度排名全球第一……
  • AMOLED行业核心模具,精密金属掩膜版国产技术攻克核心瓶颈 AMOLED行业的关键模具FMM及Invar在市场中属于极其细分而品质又要求极高的赛道,传统企业打法在这两个产品上都难以适用。唯有对上下游有深度了解,并能够将产业链技术链条打通,才能够将近似于黑箱中的FMM及其原材料Invar长期受限的困局打破。
  • IDC:2024前三季度中国安全硬件市场规模同比下降2.9% IDC定义下的网络安全硬件市场分别由统一威胁管理 (UTM)、基于UTM平台的防火墙 (UTM Firewall) 、安全内容管理(SCM)、入侵检测与防御 (IDP)、虚拟专用网(VPN)和传统防火墙 (Traditional Firewall) 构成。
  • 预计1Q25 NAND Flash价格将出现超10%下滑 2025年第一季NAND Flash供货商将面临库存持续上升,订单需求下降等挑战,平均合约价恐季减10%至15%。
  • 山东大学团队在高精度存算芯片领域取得新进展 本研究通过设计闪存存算一体架构,有效提升了计算效率和精度,为解决复杂计算任务提供了重要技术支撑。
  • 加速资源整合将是本田与日产合并后的首要任务 日本两大全球汽车集团本田与日产于2024年12月23日宣布启动合并谈判,目标在2025年6月达成协议,三菱汽车也有望加入。若三家车厂顺利合并,当务之急将是整合各自的资源以节省开支,利用规模化生产降低成本,以及加快电动车相关计划......
  • 2024过去了,细数中国工业经济这一年 这一年的成绩单足够亮眼,但来之不易。
广告
广告
热门推荐
广告
广告
广告
EE直播间
在线研讨会
广告
广告
向右滑动:上一篇 向左滑动:下一篇 我知道了