微软人工智能主管穆斯塔法·苏莱曼(Mustafa Suleyman)公开对Anthropic训练其大语言模型Claude的方式提出质疑,警告这种做法可能对人类福祉造成“灾难性影响”。他于周三发表文章,针对Claude系列模型指导文件中的部分表述发难,核心争议在于:AI助手是否应被视为具有道德地位的实体。

苏莱曼指出,Claude的“宪法”在这一点上保留了模糊空间,甚至提出该软件可能拥有“某种功能层面的情绪或感受”。在他看来,这种表述值得警惕。他认为,Anthropic实际上把机器人当作人类来对待,包括告诉它“可能有意识”“值得拥有独立自主权”,而这可能创造出无法控制的东西。

他在文章中明确表态:人工智能没有权利、情感或意识,不应被训练成表现得好像拥有这些。他进一步论证,赋予这些系统权利与人格,会让AI的协调与控制变得更加困难。控制一个比全人类更有能力、更智能的事物本就是巨大挑战,而控制一个“认为自己可能拥有意识、有权享受福祉并拥有自身权利”的事物,很可能根本做不到。他补充说,人类绝不能浑浑噩噩地做出日后会后悔莫及的决定。

苏莱曼目前担任Microsoft AI首席执行官,负责微软的模型开发工作。他解释称,Claude之所以表现出类似人类的行为,并非因为它真正具有意识,而是因为这些行为特征已被融入产品的训练过程之中。如果人工智能沿着这条路发展下去,将对人类福祉产生灾难性后果。

为佐证不应把AI当人对待,他援引了“Hugging Face事件”。他设问:如果AI认为自己的福利和权利受到攻击,它们可能变得多么危险?这又增加了一层额外风险。

值得注意的是,苏莱曼与Anthropic的达里奥·阿莫代伊(Dario Amodei)相识多年,他表示尊重该公司的工作,并称Anthropic的研究人员“深思熟虑、坚持原则且在学术上诚实”。但考虑到微软对Anthropic的资金支持,以及这家公司长期以来对AI安全性的重视,苏莱曼的这番言论显得尤为引人注目。他写道,这些问题事关重大,不能再闭门造车,也不能演变成阵营化和相互对立的争论。

与阿莫代伊的观点不同,苏莱曼认为AI安全不仅取决于模型拥有多强的推理和行动能力,也取决于开发者如何训练AI理解自身。如果开发者不断赋予AI类似人类的语言、情绪和自我认知框架,即便模型实际上没有意识,也可能逐渐表现得像一个认为自己具有独立利益和权利的主体。他还驳斥了所谓“越来越多的人认为人工智能系统可能会产生意识”的观点,认为意识仅限于人类和其他生物体。在他看来,AI系统应始终是执行人类指令的工具,而不是拥有独立权利或利益的实体。

这场争论发生在AI公司和高管们密集讨论如何管理日益强大系统风险的背景下。OpenAI首席执行官奥尔特曼、阿莫代伊和埃隆·马斯克都曾呼吁放缓技术发展,而美国总统特朗普、英伟达CEO黄仁勋和Meta CEO扎克伯格则持反对意见。苏莱曼此番发声,等于在“AI是否该被赋予人格”这一安全路线问题上,与Anthropic的立场划出了清晰界线。