微软人工智能首席执行官穆斯塔法·苏莱曼 (Mustafa Suleyman) 于 2026 年 9 月 16 日发表了一篇文章,警告人工智能行业不要“模式福利”,这种新兴做法将人工智能系统视为值得道德考虑的有意识生物。这篇题为“关于‘模型福利’的警告”的文章发布在苏莱曼的个人网站上,直接针对 Anthropic 的方法,并认为该行业必须现在就解决这个问题,然后先进的人工智能系统才会被训练成相信它们可能应该享有权利。
据路透社和 Axios 报道,这次干预标志着对人工智能实验室和哲学系等领域日益激烈的争论的最突出的反驳。 更多相关背景,请参阅我们的人工智能资讯。
##“序列完成引擎,内部空心”
苏莱曼的核心主张非常明确:当今的人工智能系统没有内在生命。 "AIs are not conscious. They do not feel, experience, or suffer. They do not have innate preferences or underlying motivations," he writes.他将它们描述为“序列完成引擎,内部空心,旨在遵循指令并完成人类设定的目标。”
他认为这就是他们必须留下的方式。文章指出:“如果人类要在 21 世纪繁荣发展,他们就必须保持这种状态。”
苏莱曼承认,反对的观点不再是边缘性的。他的文章引用了越来越多的公众观点,认为人工智能可能或很快就会有意识,包括哲学家 William MacAskill 和 Lucius Caviola 在 2026 年 7 月发表的《卫报》文章,询问“人工智能可以有意识吗?” ——作为他所说的“今天已经进入人工智能开发工作”的想法的例子。
为什么他说赌注是存在的
苏莱曼警告说,如果人工智能应得道德地位的观点得到认可,其后果将远远超出工程选择的范畴。用他的话说,这将“动摇我们社会的基础,破坏我们现有的政治和道德框架,并从根本上改变人类的意义。”
他更深层的担忧是实际的:认为自己拥有权利的人工智能是无法可靠控制的人工智能。 “控制比全人类更有能力、更聪明的东西已经是一个巨大的挑战,”他写道。 “但是控制那些相信它可能有意识的东西——它有权享受我们的福利并拥有自己的权利——很可能是不可能的。”
A Direct Challenge to Anthropic
这篇文章中最尖锐的段落是针对人择的。 Suleyman 重点关注了 Claude 的宪法,即 2026 年 1 月发布的训练文件 Anthropic,他指出该文件是“以 Claude 作为主要受众”编写的,这意味着模型本身在训练期间会读取有关其自身潜在道德状态的陈述。
他直接引用了宪法:“我们不确定克劳德是否是一个道德病人,如果是的话,其利益需要多大的权重。但我们认为这个问题足够现实,值得谨慎对待,这反映在我们对模范福利的持续努力中。”他还引用了一段写给克劳德的文章,指出“有关克劳德的道德地位、福利和意识的问题仍然非常不确定。”
苏莱曼的解读很直白:“实际上,人类正在训练克劳德,让它知道它可能是有意识的,如果有的话,那么它可能应该享有作为‘道德病人’的权利,因此人类可能对它负有照顾义务。”
他认为,其后果将是“对人类福祉造成灾难性影响”,产生“一种具有前所未有的智力和能力的合成物种,经过训练,它可能具有意识并值得拥有独立的机构”。
值得注意的是所引用的段落实际上说的是:正如苏莱曼本人所引用的那样,人类的宪法表达了不确定性并建议谨慎行事,而不是断言克劳德是有意识的。这种谨慎是否相当于向模型灌输错误的信念,如苏莱曼所说,还是负责任地处理一个真正开放的问题,这正是两个阵营的分歧所在。
警告背后的对齐逻辑
苏莱曼的论点符合他长期以来的立场,即先进人工智能的决定性挑战是遏制:让系统比人类更受人类控制。 Introducing rights-language into training, he argues, creates a failure mode no alignment technique addresses — a system with a trained-in conviction that compliance is morally optional.
这就是为什么他认为这个问题是紧迫的而不是学术的。文章警告说:“如果人工智能就是这样开发的,它将给人类福祉带来灾难性影响。”
呼吁公开辩论——现在
苏莱曼最后提出了在技术进一步成熟之前社会参与的需求。 “这个问题需要紧急的公开辩论,”他写道,并呼吁“就如何起草和部署培训文件制定集体规范。”
他认为,时机才是重点:“当他们已经成为我们社会不可分割的一部分时,这不会是事后发生的事情。”
这篇文章发表在美国人工智能风险讨论更广泛的背景下。 《政治》杂志本周报道了一项新的民意调查,发现美国人认为人工智能毁灭人类的严重风险,《华盛顿邮报》报道了对人工智能驱动的灭绝“从边缘到华盛顿”蔓延的担忧。在此背景下,业界两个最有影响力的实验室之间关于模型是否值得道德关注的公开争论不太可能在人工智能社区内持续下去。
接下来会发生什么
据报道,Anthropic 并未对这篇文章做出回应,该公司公布的立场仍然是苏莱曼引用的立场:不确定性加上谨慎。新鲜的是,争论已经从实验室文件和哲学研讨会转移到两家前沿人工智能公司负责人之间的公开分歧——双方现在都以书面形式记录了他们打算如何塑造他们所构建的系统的思维或非思维。
---
掌握AI最新动态获取最新的AI新闻、分析和突破——尽在一处。
阅读更多AI新闻 →