京公网安备 11010802034615号
经营许可证编号:京B2-20210330
前沿 | 当 AI 掌握「读心术」:DeepMind AI 已经学会相互理解
「心智理论」一直被认为是人工智能无法掌握的能力,然而在 DeepMind 发表的论文《Machine Theory of Mind》中,研究人员提出了一种新型神经网络 ToMnet,具备理解自己以及周围智能体心理状态的能力。该论文已被 ICML 2018 接收为 Oral 论文。近日,这一研究又引起了《Science》的注意。
有时候,我们会觉得 Siri 或 Alexa 等数字助理非常令人失望,因为它们根本不懂我们人类。它们需要懂点被心理学家称为「心智理论」(theory of mind)的东西,搞清楚别人的信念和意图。最近,计算机科学家开发出了一种新的 AI,这种 AI 可以探测到其他计算机的「想法」,并预测它们的行动,这是机器之间以及机器与人之间灵活协作的第一步。
加州大学伯克利分校的发展心理学家 Alison Gopnik 表示,显然,要探索一个充满各种想法的世界,「掌握心智理论非常重要。」人在大约 4 岁的时候会了解到,他人的信念可能与现实不符,然后根据这个人的信念推断其接下来的行动。当前的计算机可以区分「开心」、「生气」等面部表情,这是一种与「心智理论」相关的技能,但是它们对人类的情绪、动机知之甚少。
这一新项目的初衷是尝试让人理解计算机。AI 使用的许多算法并不是完全由程序员完成的,而是依赖于机器在解决问题的过程中不断「学习」。计算机生成的解决方案通常是黑箱,由于算法过于复杂,人类往往难以理解。因此,DeepMind 研究科学家 Neil Rabinowitz 和他的同事创建了一个名为「ToMnet」的心智理论 AI,并使其观察其他 AI,看看它能否了解其他 AI 智能体的工作原理。
ToMnet 由三个神经网络组成,每个网络包含一些小的计算单元和从经验中学到的连接,与人类大脑类似。第一个网络根据其他 AI 过去的行动学习它们的倾向。第二个网络理解其他 AI 的当前「信念」;第三个网络接收前两个网络的输出,并根据情况推测其他 AI 的后续行动。
研究中涉及的 AI 智能体是在虚拟房间中到处移动收集彩色箱子以获取得分的简单「角色」。ToMnet 从上方观察整个房间。一次测试中有三种「角色」:一种看不到周围环境,一种记不住最近的步伐,一种可以看到也可以记住。看不到的智能体可能会沿着墙走,「失忆」智能体会移动到离它最近的物体处,而第三种能够构建子目标,以特定顺序有策略地抓取物体,得到更多分。DeepMind 研究人员在本月于瑞典斯德哥尔摩举办的 ICML 大会上报告称:经过一番训练,ToMnet 不仅能够在几步之后识别「角色」的种类,还能够准确预测它们的未来行为。
最终测试证明,ToMnet 甚至可以理解持有错误信念的「角色」,这是训练它们掌握心智理论(人类和其他动物具备的心智理论)的关键阶段。在该测试中,一种「角色」被编程设定为近视,那么当计算机在游戏中途改变道路(超出上述「角色」的视力范围)时,ToMnet 可以准确预测到,近视的「角色」更可能坚持原来的路径,而视力好的「角色」则更倾向于调整路径,适应新的情况。
Gopnik 称,该研究以及 ICML 会议上证明 AI 可以根据它们对自己的了解预测其他 AI 智能体行为的另一研究,都是神经网络「惊人」自主学习能力的例证。但是这仍然无法使人工智能体达到人类儿童的同等水平,Gopnik 说道,AI 智能体很可能以接近完美的准确率完成错误信念任务,即使它们之前从未遇到过。
MIT 心理学家、计算机科学家 Josh Tenenbaum 也研究心智理论的计算模型。他认为 ToMnet 在推断信念方面比他团队研发出的系统更高效,后者基于更抽象的概率推论,而不是神经网络。但是 ToMnet 的理解能力与训练所用语境相关性更强,因此它在全新环境中预测行为的能力欠佳,而 Josh Tenenbaum 的系统甚至儿童在这方面做得更好。Josh 称,未来两种方法结合或许会给该领域带来「真正有趣的方向」。
Gopnik 注意到这种具备社交能力的计算机不仅将改善人机合作,还会影响到人机之间的相互「欺骗」。如果一台计算机能够理解错误信念,那它就可能知道如何诱导人类相信它。希望未来的扑克机器人能够掌握 bluff(使诈)的艺术。
论文:Machine Theory of Mind
论文链接:https://arxiv.org/abs/1802.07740
摘要:心智理论(ToM; Premack & Woodruff, 1978)广义上指个体有能力理解他人的心理状态,包括期望、信念和意图。我们提出对机器进行训练,使之也具备这项能力。我们设计了一种心智理论神经网络 ToMnet,它使用元学习通过观察智能体的行为而对它们进行建模。通过该过程,该网络得到一个对智能体行为具备强大先验知识的模型,同时能够利用少量行为观测对智能体特征和心理状态进行更丰富的预测。我们将 ToMnet 应用于在 gridworld 环境中采取行动的智能体,结果表明该网络学会对来自不同群体的智能体进行建模,包括随机、规则系统和深度强化学习智能体等,该网络通过了经典的 ToM 任务,如"Sally-Anne"测试,即意识到他人持有的错误信念。我们认为该系统(自动学习如何对出现在其世界中的其他智能体进行建模)是开发多智能体 AI 系统的重要步骤,可以帮助构建人机交互的中介技术,推进可解释性 AI 的发展。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在日常办公中,数据透视表是Excel、WPS等表格工具中最常用的数据分析利器——它能快速汇总繁杂数据、挖掘数据关联、生成直观报表 ...
2026-02-28有限元法(Finite Element Method, FEM)作为工程数值模拟的核心工具,已广泛应用于机械制造、航空航天、土木工程、生物医学等多 ...
2026-02-28在数字化时代,“以用户为中心”已成为企业运营的核心逻辑,而用户画像则是企业读懂用户、精准服务用户的关键载体。CDA(Certifi ...
2026-02-28在Python面向对象编程(OOP)中,类方法是构建模块化、可复用代码的核心载体,也是实现封装、继承、多态特性的关键工具。无论是 ...
2026-02-27在MySQL数据库优化中,索引是提升查询效率的核心手段—— 面对千万级、亿级数据量,合理创建索引能将查询时间从秒级压缩到毫秒级 ...
2026-02-27在数字化时代,企业积累的海量数据如同散落的珍珠,若缺乏有效的梳理与分类,终将难以发挥实际价值。CDA(Certified Data Analys ...
2026-02-27在问卷调研中,我们常遇到这样的场景:针对同一批调查对象,在不同时间点(如干预前、干预后、随访期)发放相同或相似的问卷,收 ...
2026-02-26在销售管理的实操场景中,“销售机会”是核心抓手—— 从潜在客户接触到最终成交,每一个环节都藏着业绩增长的关键,也暗藏着客 ...
2026-02-26在CDA数据分析师的日常工作中,数据提取、整理、加工是所有分析工作的起点,而“创建表”与“创建视图”,则是数据库操作中最基 ...
2026-02-26在机器学习分析、数据决策的全流程中,“数据质量决定分析价值”早已成为行业共识—— 正如我们此前在运用机器学习进行分析时强 ...
2026-02-25在数字化时代,数据已成为企业决策、行业升级的核心资产,但海量杂乱的原始数据本身不具备价值—— 只有通过科学的分析方法,挖 ...
2026-02-25在数字化时代,数据已成为企业核心资产,而“数据存储有序化、数据分析专业化、数据价值可落地”,则是企业实现数据驱动的三大核 ...
2026-02-25在数据分析、机器学习的实操场景中,聚类分析与主成分分析(PCA)是两种高频使用的统计与数据处理方法。二者常被用于数据预处理 ...
2026-02-24在聚类分析的实操场景中,K-Means算法因其简单高效、易落地的特点,成为处理无监督分类问题的首选工具——无论是用户画像分层、 ...
2026-02-24数字化浪潮下,数据已成为企业核心竞争力,“用数据说话、用数据决策”成为企业发展的核心逻辑。CDA(Certified Data Analyst) ...
2026-02-24CDA一级知识点汇总手册 第五章 业务数据的特征、处理与透视分析考点52:业务数据分析基础考点53:输入和资源需求考点54:业务数 ...
2026-02-23CDA一级知识点汇总手册 第四章 战略与业务数据分析考点43:战略数据分析基础考点44:表格结构数据的使用考点45:输入数据和资源 ...
2026-02-22CDA一级知识点汇总手册 第三章 商业数据分析框架考点27:商业数据分析体系的核心逻辑——BSC五视角框架考点28:战略视角考点29: ...
2026-02-20CDA一级知识点汇总手册 第二章 数据分析方法考点7:基础范式的核心逻辑(本体论与流程化)考点8:分类分析(本体论核心应用)考 ...
2026-02-18第一章:数据分析思维考点1:UVCA时代的特点考点2:数据分析背后的逻辑思维方法论考点3:流程化企业的数据分析需求考点4:企业数 ...
2026-02-16