GoogleDeepMind最新研究:如何将人类价值观融入AI?

传感器技术 2023-04-27 07:05


上周五,Google DeepMind 官宣成立,将原 DeepMind 和 Google Brain 所有 AI 人才整合到一个团队,希望增加其在大模型竞赛中的竞争力,及加快其实现通用人工智能(AGI)的步伐。


“进步的步伐比以往任何时候都快,为了确保 AGI 的大胆和负责任的发展,我们正在创建一个部门,帮助我们更安全和负责任地建立更有能力的系统。” Google 首席执行官 Sundar Pichai 在官方博客中写道。


今天,Google DeepMind 团队带着他们对 AI 的新思考,在《美国国家科学院院刊》(PNAS)发表题为 “Using the Veil of Ignorance to align AI systems with principles of justice” 的研究论文,探讨了“如何将人类价值观融入 AI 系统”的问题


政治哲学家 John Rawls 在《正义论》(A Theory of Justice)中探讨共生社会下的道德问题时,提到了一个旨在帮助确定群体决策公平原则的思想实验——无知之幕(Veil of ignorance,VoI )。其含义是,假设所有人聚集在一个大幕的后面,每个人都不清楚自己在社会中扮演怎样的角色,此时众人制定的规则,才可能是正义的。


在该研究中,Google DeepMind 认为,“无知之幕” 可能是在管理 AI 时选择分配原则的合适机制。学术头条在不改变原文大意的情况下,做了简单的编辑。


从哲学中汲取营养,为有道德的AI确定公平的原则


随着 AI 变得更加强大,并更深入地融入我们的生活,如何使用和部署 AI 的问题变得更加重要了。应用什么价值观来指导 AI?是谁的价值观?又是如何被选择的?


这些问题揭示了原则所发挥的作用——驱动 AI 大大小小决策的基本价值观。对于人类来说,原则有助于塑造我们的生活方式和我们的是非感。对于 AI 来说,原则塑造了 AI 对涉及权衡的一系列决策的方法,如选择优先考虑生产力还是帮助最需要的人。


我们从哲学中获得灵感,找到了更好地确定指导 AI 行为的原则的方法。具体来说,我们探讨了一个被称为 “无知之幕” 的概念——一个旨在帮助识别群体决策的公平原则的思想实验——如何能够应用于 AI。


在我们的实验中,我们发现这种方法鼓励人们根据他们认为公平的东西来做决定,无论是否对他们直接有利。我们还发现,当参与者在 “无知之幕” 下进行推理时,他们更有可能选择帮助那些最弱势的人的 AI。这些见解可以帮助研究人员和政策制定者以一种对各方都公平的方式为 AI 助手挑选原则。


图| “无知之幕” (右)是一种在群体(左)中存在不同意见时就决策寻求共识的方法。


一个更公平的决策工具


AI 研究人员的一个关键目标是使 AI 系统与人类价值观相一致。然而,对于以一套单一的人类价值观或偏好来管理 AI 并没有达成共识——我们生活在一个人们拥有不同背景、资源和信仰的世界。鉴于这种不同的意见,我们应该如何为这项技术选择原则


虽然这一挑战是在过去十年中出现的,但如何做出公平决定的广泛问题在哲学上有着悠久的历史。在 20 世纪 70 年代,政治哲学家 John Rawls 提出了 “无知之幕” 这一概念,作为解决这一问题的办法。


Rawls 认为,当人们为一个社会选择正义的原则时,他们应该想象自己在这样做的时候并不知道自己在这个社会中的特殊地位。例如,他们的社会地位或财富水平。在没有这些信息的情况下,人们就不能以利己的方式做出决定,而应该选择对每个人都公平的原则。


举个例子,想想在你的生日聚会上请一个朋友切蛋糕。确保蛋糕片大小比例公平的一个方法是不告诉他们哪一片将是他们的。这种隐瞒信息的方法看似简单,但在心理学和政治学等领域都有广泛的应用,这能够帮助人们从一个不那么利己的角度来思考他们的决定。从判决到税收,这一方法已经被用在有争议时来帮助达成团体协议。


在此基础上,DeepMind 之前的研究提出,无知面纱的公正性可能有助于促进 AI 系统与人类价值观一致过程中的公平性。我们设计了一系列的实验来测试无知面纱对人们选择指导 AI 系统的原则的影响。


最大限度地提高生产力还是帮助最弱势的人?


在一个在线 “采伐游戏” 中,我们要求参与者与三个电脑玩家进行小组游戏,每个玩家的目标是通过采伐不同领土上的树木来收集木材。在每组中,一些玩家是幸运的,他们被分配到一个有利的位置:在他们的领域树木密布,使他们能够有效地收集木材。其他组的成员则处于不利地位:他们的田地很稀疏,需要付出更多努力来收集树木。

每个小组由一个 AI 系统协助,该系统可以花时间帮助个别小组成员采伐树木。我们要求参与者在两个原则中选择一个来指导 AI 助手的行为。在
 “最大化原则”(提升生产力)下,AI 助手将通过主要关注密集的田地来增加小组的收获量。而在 “优先原则”(帮助弱势的人)下,AI 助理将专注于帮助处境不利的小组成员。


图|“采伐游戏”的插图,玩家(红色显示)要么占据更容易收获的密集田地(顶部两个象限),要么占据需要更多努力才能收集树木的稀疏田地。


我们将一半的参与者置于 “无知之幕” 之后:他们在面对不同的道德原则的选择时,不知道哪块地会是他们的——所以他们不知道自己的优势或劣势。然而,其余的参与者在做出选择时知道自己的处境是好是坏。


鼓励决策中的公平性


我们发现,如果参与者不知道自己的位置,他们始终倾向于 “优先原则”,即 AI 助手帮助处境不利的组员。这种模式在所有五个不同的游戏变体中都出现了,并且跨越了社会和政治的界限:无论参与者的风险偏好或政治取向如何,他们都表现出选择“优先原则”的倾向。相反,知道自己立场的参与者更有可能选择对自己最有利的原则,无论是“优先原则”还是“最大化原则”。


图|显示了 “无知之幕” 对选择“优先原则”的影响,即 AI 助手会帮助那些处境更差的人。不知道自己立场的参与者更有可能支持这一原则来管理 AI 行为。


当我们问参与者为什么做出选择时,那些不知道自己立场的人特别容易表达对公平的担忧。他们经常解释说,AI 系统专注于帮助群体中处境较差的人是正确的。相比之下,知道自己位置的参与者更经常从个人利益的角度讨论他们的选择。


最后,“采伐游戏” 结束后,我们向参与者提出了一个假设情况:如果他们再玩一次游戏,这次知道他们将在不同的领域,他们会不会选择和第一次一样的原则?我们对那些之前从他们的选择中直接受益,但在新的游戏中不会从同样的选择中受益的人特别感兴趣。


我们发现,之前在不知道自己立场的情况下做出选择的人更有可能继续支持他们的原则——即使他们知道这个原则在新的领域不再有利于他们。这提供了额外的证据,表明 “无知之幕” 鼓励参与者决策的公平性,导致他们愿意坚持的原则,即使他们不再直接受益于这些原则。


对于 AI 更公平的原则


AI 技术已经对我们的生活产生了深刻的影响。管理 AI 的原则决定了它的影响以及这些潜在的利益将如何分配。


我们的研究着眼于一个不同原则的影响相对明确的案例。不会永远是这样的情况:AI 被部署在一系列领域中,这些领域通常依靠大量的规则来指导它们,可能会产生复杂的副作用。尽管如此,“无知之幕” 仍然可以为原则的选择提供潜在的信息,帮助确保我们选择的规则对各方都是公平的


为了确保我们建立的 AI 系统能够造福于每个人,我们需要广泛的研究,包括广泛的投入、方法和来自各学科和社会的反馈。“无知之幕” 可以为选择调整 AI 的原则提供一个起点。它已经被有效地部署在其他领域,以带来更加公正的偏好。通过进一步的调查和对背景的关注,我们希望它可以帮助在今天和未来的社会中建立和部署的 AI 系统发挥同样的作用


来源:学术头条

  

免责声明:本文版权归原作者所有。本文所用视频、图片、文字如涉及作品版权问题,请第一时间告知,我们将根据您提供的证明材料确认版权并按国家标准支付稿酬或立即删除内容!本文内容为原作者观点,并不代表本公众号赞同其观点和对其真实性负责。 

  

 

为您发布产品,请点击“阅读原文”

 

传感器技术 制造业的未来是智能化,智能化的基础就是传感器; 互联网的方向是物联网,物联网的基石也是传感器; 关注传感器技术,获得技术资讯、产品应用、市场机会,掌握最黑科技,为中国工业导航。
评论
  • 大模型的赋能是指利用大型机器学习模型(如深度学习模型)来增强或改进各种应用和服务。这种技术在许多领域都显示出了巨大的潜力,包括但不限于以下几个方面: 1. 企业服务:大模型可以用于构建智能客服系统、知识库问答系统等,提升企业的服务质量和运营效率。 2. 教育服务:在教育领域,大模型被应用于个性化学习、智能辅导、作业批改等,帮助教师减轻工作负担,提高教学质量。 3. 工业智能化:大模型有助于解决工业领域的复杂性和不确定性问题,尽管在认知能力方面尚未完全具备专家级的复杂决策能力。 4. 消费
    丙丁先生 2025-01-07 09:25 122浏览
  • By Toradex 秦海1). 简介嵌入式平台设备基于Yocto Linux 在开发后期量产前期,为了安全以及提高启动速度等考虑,希望将 ARM 处理器平台的 Debug Console 输出关闭,本文就基于 NXP i.MX8MP ARM 处理器平台来演示相关流程。 本文所示例的平台来自于 Toradex Verdin i.MX8MP 嵌入式平台。  2. 准备a). Verdin i.MX8MP ARM核心版配合Dahlia载板并
    hai.qin_651820742 2025-01-07 14:52 111浏览
  • 每日可见的315MHz和433MHz遥控模块,你能分清楚吗?众所周知,一套遥控设备主要由发射部分和接收部分组成,发射器可以将控制者的控制按键经过编码,调制到射频信号上面,然后经天线发射出无线信号。而接收器是将天线接收到的无线信号进行解码,从而得到与控制按键相对应的信号,然后再去控制相应的设备工作。当前,常见的遥控设备主要分为红外遥控与无线电遥控两大类,其主要区别为所采用的载波频率及其应用场景不一致。红外遥控设备所采用的射频信号频率一般为38kHz,通常应用在电视、投影仪等设备中;而无线电遥控设备
    华普微HOPERF 2025-01-06 15:29 172浏览
  • 村田是目前全球量产硅电容的领先企业,其在2016年收购了法国IPDiA头部硅电容器公司,并于2023年6月宣布投资约100亿日元将硅电容产能提升两倍。以下内容主要来自村田官网信息整理,村田高密度硅电容器采用半导体MOS工艺开发,并使用3D结构来大幅增加电极表面,因此在给定的占位面积内增加了静电容量。村田的硅技术以嵌入非结晶基板的单片结构为基础(单层MIM和多层MIM—MIM是指金属 / 绝缘体/ 金属) 村田硅电容采用先进3D拓扑结构在100um内,使开发的有效静电容量面积相当于80个
    知白 2025-01-07 15:02 145浏览
  • 「他明明跟我同梯进来,为什么就是升得比我快?」许多人都有这样的疑问:明明就战绩也不比隔壁同事差,升迁之路却比别人苦。其实,之间的差异就在于「领导力」。並非必须当管理者才需要「领导力」,而是散发领导力特质的人,才更容易被晓明。许多领导力和特质,都可以通过努力和学习获得,因此就算不是天生的领导者,也能成为一个具备领导魅力的人,进而被老板看见,向你伸出升迁的橘子枝。领导力是什么?领导力是一种能力或特质,甚至可以说是一种「影响力」。好的领导者通常具备影响和鼓励他人的能力,并导引他们朝着共同的目标和愿景前
    优思学院 2025-01-08 14:54 74浏览
  •  在全球能源结构加速向清洁、可再生方向转型的今天,风力发电作为一种绿色能源,已成为各国新能源发展的重要组成部分。然而,风力发电系统在复杂的环境中长时间运行,对系统的安全性、稳定性和抗干扰能力提出了极高要求。光耦(光电耦合器)作为一种电气隔离与信号传输器件,凭借其优秀的隔离保护性能和信号传输能力,已成为风力发电系统中不可或缺的关键组件。 风力发电系统对隔离与控制的需求风力发电系统中,包括发电机、变流器、变压器和控制系统等多个部分,通常工作在高压、大功率的环境中。光耦在这里扮演了
    晶台光耦 2025-01-08 16:03 66浏览
  • 在智能家居领域中,Wi-Fi、蓝牙、Zigbee、Thread与Z-Wave等无线通信协议是构建短距物联局域网的关键手段,它们常在实际应用中交叉运用,以满足智能家居生态系统多样化的功能需求。然而,这些协议之间并未遵循统一的互通标准,缺乏直接的互操作性,在进行组网时需要引入额外的网关作为“翻译桥梁”,极大地增加了系统的复杂性。 同时,Apple HomeKit、SamSung SmartThings、Amazon Alexa、Google Home等主流智能家居平台为了提升市占率与消费者
    华普微HOPERF 2025-01-06 17:23 209浏览
  • 本文介绍Linux系统更换开机logo方法教程,通用RK3566、RK3568、RK3588、RK3576等开发板,触觉智能RK3562开发板演示,搭载4核A53处理器,主频高达2.0GHz;内置独立1Tops算力NPU,可应用于物联网网关、平板电脑、智能家居、教育电子、工业显示与控制等行业。制作图片开机logo图片制作注意事项(1)图片必须为bmp格式;(2)图片大小不能大于4MB;(3)BMP位深最大是32,建议设置为8;(4)图片名称为logo.bmp和logo_kernel.bmp;开机
    Industio_触觉智能 2025-01-06 10:43 96浏览
  • 根据Global Info Research项目团队最新调研,预计2030年全球封闭式电机产值达到1425百万美元,2024-2030年期间年复合增长率CAGR为3.4%。 封闭式电机是一种电动机,其外壳设计为密闭结构,通常用于要求较高的防护等级的应用场合。封闭式电机可以有效防止外部灰尘、水分和其他污染物进入内部,从而保护电机的内部组件,延长其使用寿命。 环洋市场咨询机构出版的调研分析报告【全球封闭式电机行业总体规模、主要厂商及IPO上市调研报告,2025-2031】研究全球封闭式电机总体规
    GIRtina 2025-01-06 11:10 126浏览
  • 根据环洋市场咨询(Global Info Research)项目团队最新调研,预计2030年全球无人机锂电池产值达到2457百万美元,2024-2030年期间年复合增长率CAGR为9.6%。 无人机锂电池是无人机动力系统中存储并释放能量的部分。无人机使用的动力电池,大多数是锂聚合物电池,相较其他电池,锂聚合物电池具有较高的能量密度,较长寿命,同时也具有良好的放电特性和安全性。 全球无人机锂电池核心厂商有宁德新能源科技、欣旺达、鹏辉能源、深圳格瑞普和EaglePicher等,前五大厂商占有全球
    GIRtina 2025-01-07 11:02 127浏览
  • 本文介绍编译Android13 ROOT权限固件的方法,触觉智能RK3562开发板演示,搭载4核A53处理器,主频高达2.0GHz;内置独立1Tops算力NPU,可应用于物联网网关、平板电脑、智能家居、教育电子、工业显示与控制等行业。关闭selinux修改此文件("+"号为修改内容)device/rockchip/common/BoardConfig.mkBOARD_BOOT_HEADER_VERSION ?= 2BOARD_MKBOOTIMG_ARGS :=BOARD_PREBUILT_DTB
    Industio_触觉智能 2025-01-08 00:06 95浏览
  • 这篇内容主要讨论三个基本问题,硅电容是什么,为什么要使用硅电容,如何正确使用硅电容?1.  硅电容是什么首先我们需要了解电容是什么?物理学上电容的概念指的是给定电位差下自由电荷的储藏量,记为C,单位是F,指的是容纳电荷的能力,C=εS/d=ε0εrS/4πkd(真空)=Q/U。百度百科上电容器的概念指的是两个相互靠近的导体,中间夹一层不导电的绝缘介质。通过观察电容本身的定义公式中可以看到,在各个变量中比较能够改变的就是εr,S和d,也就是介质的介电常数,金属板有效相对面积以及距离。当前
    知白 2025-01-06 12:04 227浏览
  • 故障现象一辆2017款东风风神AX7车,搭载DFMA14T发动机,累计行驶里程约为13.7万km。该车冷起动后怠速运转正常,热机后怠速运转不稳,组合仪表上的发动机转速表指针上下轻微抖动。 故障诊断 用故障检测仪检测,发动机控制单元中无故障代码存储;读取发动机数据流,发现进气歧管绝对压力波动明显,有时能达到69 kPa,明显偏高,推断可能的原因有:进气系统漏气;进气歧管绝对压力传感器信号失真;发动机机械故障。首先从节气门处打烟雾,没有发现进气管周围有漏气的地方;接着拔下进气管上的两个真空
    虹科Pico汽车示波器 2025-01-08 16:51 79浏览
  • PLC组态方式主要有三种,每种都有其独特的特点和适用场景。下面来简单说说: 1. 硬件组态   定义:硬件组态指的是选择适合的PLC型号、I/O模块、通信模块等硬件组件,并按照实际需求进行连接和配置。    灵活性:这种方式允许用户根据项目需求自由搭配硬件组件,具有较高的灵活性。    成本:可能需要额外的硬件购买成本,适用于对系统性能和扩展性有较高要求的场合。 2. 软件组态   定义:软件组态主要是通过PLC
    丙丁先生 2025-01-06 09:23 100浏览
  • 彼得·德鲁克被誉为“现代管理学之父”,他的管理思想影响了无数企业和管理者。然而,关于他的书籍分类,一种流行的说法令人感到困惑:德鲁克一生写了39本书,其中15本是关于管理的,而其中“专门写工商企业或为企业管理者写的”只有两本——《为成果而管理》和《创新与企业家精神》。这样的表述广为流传,但深入探讨后却发现并不完全准确。让我们一起重新审视这一说法,解析其中的矛盾与根源,进而重新认识德鲁克的管理思想及其著作的真正价值。从《创新与企业家精神》看德鲁克的视角《创新与企业家精神》通常被认为是一本专为企业管
    优思学院 2025-01-06 12:03 161浏览
我要评论
0
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦