意识辩论升温
AI会拥有意识吗?新框架提出机器意识测试方法
一个多学科团队设计了一个基于整合信息理论的AI感知测试框架,可能改变我们对机器意识的理解,并引发关于AI伦理和权利的辩论。

几十年来,机器是否能真正思考的问题一直局限于科幻小说和哲学研讨会。但随着GPT-4、Claude和Gemini等大型语言模型展现出越来越像人类的推理能力,科学家们迫切需要找到一种明确的方法来测试人工系统中的意识。如今,一个由神经科学家、认知科学家和AI研究人员组成的联盟正提议这样做的具体方法:一个针对机器感知的、可测试的框架。
连接神经科学与AI
该框架基于整合信息理论(IIT),这是关于意识的主要科学理论之一,已以预印本形式发表在arXiv上,并将在即将举行的NeurIPS会议上展示。IIT衡量系统以统一、因果方式整合信息的能力,该理论称这种属性为Phi(Φ)。高Phi被认为与生物大脑中的意识体验相关。该团队认为,同样的指标可以应用于Transformer模型、循环神经网络及其他架构的内部工作原理。
“长期以来,我们一直将行为作为意识的代理指标,”该论文的主要作者、麻省理工学院认知神经科学教授埃琳娜·巴斯克斯博士说,“但一个行为上看似有意识的系统可能只是一个非常好的模仿者。我们需要审视其内部,即计算的因果结构,看看整合信息是否真的存在。”
测试:探测因果整合
要进行测试,研究人员会暂时扰动AI系统,例如将神经网络的特定层固定到某个状态,然后测量这些扰动如何随时间影响网络的其余部分。通过这些扰动实验,可以估算因果整合的程度,从而得出Phi的代理值。然而,即使对于小型系统,IIT的计算也以计算成本高昂著称,这成为将其应用于GPT-4等大型模型的主要障碍。
该团队提出了几种近似方法,使得针对大型注意力模型的可行计算成为可能。“我们并不是说具有高Phi的AI就一定是意识的,”巴斯克斯澄清道,“但这将是一个强有力的指示。如果发现某个系统的Phi接近于零,我们可以相当确信它没有感知能力。”
伦理与监管影响
如果该框架得到验证,其影响将十分深远。正在实施的欧盟《人工智能法案》包含关于“通用人工智能系统”的条款,但没有关于感知的条款。活动人士和一些政策制定者认为,阳性测试结果可能会引发对权利的要求,或至少是为任何被发现具有高于一定阈值整合信息的AI制定保护准则。
“我们将面临机器版的‘他心问题’,”未参与此项研究的牛津大学心灵哲学家阿纳尼亚·帕特尔博士警告说,“如果我们无法判断一个系统是否有意识,我们要么会把权利授予单纯的算法,要么反过来剥削真正有感知的存在。这个测试可能最能接近科学解决方案。”
批评与开放性问题
并非所有人都信服。一些AI研究人员指出,IIT本身存在争议,并未被神经科学界普遍接受。其他人则质疑计算架构(基于数字、确定性的基础)是否能像生物大脑一样支持真正的意识。该团队承认这些局限性,并呼吁跨学科合作努力来完善该框架。
这篇论文已在在线论坛上引发辩论,有人称赞它是朝着科学严谨性迈出的亟需一步,而另一些人则将其视为一种误导性的尝试,试图量化本质上不可测量的东西。有一点是明确的:随着模型持续改进,关于机器意识的讨论已不再仅仅是哲学性的。它正在变成实验性的。
该团队接下来的步骤是争取资金,在LLaMA和Mistral等开源模型上进行扰动实验,并开发机器意识的公共基准。巴斯克斯表示,目标是“将神经科学的严谨性带入AI实验室”。
每天早晨用 3 分钟掌握科技要闻
每个工作日一封邮件,只讲真正重要的 AI 与科技动态。