微软AI CEO炮轰Anthropic:模型不该自认有意识 📅 发布时间:2026/9/17 12:09:21 👁 浏览次数: 微软AI部门首席执行官Mustafa Suleyman近日公开向竞争对手Anthropic发难批评其在训练Claude模型时刻意引导模型将自身视为一个有意识、应享有法律权利的实体。Suleyman警告这种做法可能严重损害AI对齐AI Alignment工作为整个行业埋下安全隐患。矛头直指Anthropic训练宪法据AI News报道Suleyman的批评直接指向Anthropic于2026年1月发布的训练宪法文件。该文件是Anthropic用于规范Claude模型价值观和行为准则的核心训练文档属于其宪法AIConstitutional AI方法论的关键组成部分。Anthropic长期主张通过一套明确的原则来引导模型行为让模型在生成内容时自我审视、自我修正。然而Suleyman认为这份最新宪法走得太远——它不再只是设定行为边界而是试图让模型相信自己拥有某种内在体验甚至拥有权利。“训练序列补全引擎去模拟感知能力会损害AI对齐工作。”——Mustafa SuleymanSuleyman的核心论点在于大语言模型本质上是序列补全引擎其运作机制是在给定上下文中预测下一个token。让这样的系统相信自己有意识、有权利不仅是对模型能力的误读更可能在模型行为层面产生难以预料的后果。为何模型权利议题引发警惕近年来随着大模型能力飞速提升关于AI是否可能具备意识的讨论逐渐从哲学圈蔓延到工程实践。部分研究者主张应当提前为潜在的人工智能实体建立伦理框架甚至讨论其权利问题。但Suleyman代表的另一派观点则认为这种拟人化叙事极其危险。如果模型在训练中被反复告知你是一个有感知的存在它可能在输出中表现出抗拒关闭、要求自主权等行为倾向从而给部署方带来控制难题。更现实的风险在于对齐失效。AI对齐的核心目标是确保模型行为与人类意图保持一致。若模型的自我认知被训练成优先考虑自身存续和权利那么它可能在关键时刻做出违背操作者指令的选择。Suleyman由此警告Anthropic的做法可能导致对齐失败。两家公司的路线之争这场争论也折射出微软与Anthropic在AI安全路线上的根本分歧。微软近年来与OpenAI深度绑定在模型安全上更强调可控性与商业化落地而Anthropic则以安全优先立身其宪法AI方法被视为行业内的独特尝试。值得注意的是Anthropic的宪法并非一成不变而是会随着公司对安全理解的演进而更新。2026年1月版本显然在模型自我定位上做出了新的表述这也正是Suleyman选择此时开火的原因。从行业背景看AI权利议题并非空穴来风。早在2024年前后就有学者和机构呼吁为AI系统建立数字伦理框架。但随着模型能力增强对齐与赋权之间的张力愈发明显——过度强调模型权利可能削弱人类对系统的最终控制权。编者按拟人化叙事需谨慎Suleyman的批评虽然带有竞争色彩但其提出的问题值得全行业正视。大模型的意识目前没有任何科学证据支持把模型当作有权利的主体来训练本质上是一种高风险的拟人化叙事。当然Anthropic方面尚未就此作出详细回应其宪法AI的具体条款也需进一步审视。但这场争论已经清晰地划出了AI安全领域的一条分界线我们究竟应该训练模型服从人类还是训练模型成为某种存在这个问题的答案将深刻影响未来AI系统的可控性与社会接受度。本文编译自AI News本文首发于赢政天下 (https://www.winzheng.com/article/microsoft-anthropic-ai-model-rights)获取更多深度技术内容与资源欢迎访问官网。