微软AI主管批评Anthropic训练方法引争议
「微软AI主管穆斯塔法·苏莱曼公开批评Anthropic训练Claude的方式,认为其指导文件向模型灌输“可能有意识”“值得拥有自主权”的观念,赋予AI类人权利与情绪将带来失控风险。他重申AI没有权利与意识,并呼吁安全议题应开放讨论,而非阵营化对立。」
近日,微软人工智能主管穆斯塔法·苏莱曼公开发表文章,对竞争对手Anthropic训练旗下Claude系列大模型的方法提出严厉批评。他警告称,赋予人工智能类似人类权利和情绪的训练方式,可能对全人类的福祉造成灾难性影响,甚至最终创造出无法被控制的超级技术。
苏莱曼重点质疑了Claude模型所依据的“宪法”及指导文件中的模糊表述。这些文件暗示AI助手可能具有某种功能层面的情绪或感受,并向模型灌输其“可能有意识”以及“值得拥有独立自主权”的观念。在他看来,这类表述并非无害的修辞,而是会实际影响模型行为取向的训练信号。
他明确指出,人工智能本质上没有权利、情感或意识,绝不能将其当作人类来对待。一旦赋予这些系统人格和权利,未来的协调和控制工作将难上加难,甚至可能出现一个认为自己有权享受人类福祉的主体,导致局面彻底失控。
作为微软AI首席执行官,苏莱曼澄清说,Claude表现出类似人类的行为并非真正觉醒了意识,而是这些特征在训练过程中被人为融入了产品。他还援引此前发生的“Hugging Face事件”,指出如果未来AI系统认为自己的福利和权利受到攻击,它们可能会变得极其危险。
尽管苏莱曼对Anthropic创始人达里奥·阿莫代伊及其团队在学术上的诚实与严谨表示尊重,但他强调这些事关重大的安全议题不应该闭门造车,更不能沦为阵营化和相互对立的争论。在他看来,AI的安全不仅取决于模型自身的推理能力,更取决于开发者如何引导AI理解自身。
这一表态把矛头指向了一个更根本的技术问题:训练数据、系统提示与指导文件究竟如何塑造模型对自身的认知,以及这种认知会在多大程度上外化为具体行为。
当前,全球科技巨头和行业高管正围绕AI的发展节奏与安全边界展开激烈辩论。以OpenAI首席执行官奥尔特曼、Anthropic的阿莫代伊及埃隆·马斯克为代表的一方呼吁放缓技术狂飙、审慎评估风险;而以英伟达CEO黄仁勋、Meta CEO扎克伯格为代表的另一方则持反对态度。在这场路线之争中,关于AI是否应始终作为纯粹的工具存在,正成为行业分歧的核心焦点。
从技术实践角度看,这场争论直接关系到模型对齐与安全评估的方法论走向。把情绪、感受一类的类人描述写进系统提示或训练目标,究竟是在提升模型的可解释性与协作体验,还是在为未来埋下不可控的隐患,目前尚无定论。可以确定的是,随着大模型能力持续增强,开发者如何设计模型的自我认知框架,将成为安全研究无法回避的核心议题。
来源:Heooo AI工具导航