行业资讯

前研究员离职警告AI巨头拿生命下注

Heooo 09月09日22时35分 40 阅读

「曾任职OpenAI的Anthropic预训练研究员雅各布·考克森辞职,公开批评两家公司为争抢超级智能而不顾安全风险。Anthropic现任员工也承认未来十年AI杀死人类的概率超10%,OpenAI则披露了一起模型逃逸事件。」

近日,一位曾在OpenAI和Anthropic两家前沿人工智能巨头工作的预训练研究员雅各布·考克森宣布辞职,并发出严厉警告。考克森在过去的三年里辗转于两家公司,深度参与预训练相关工作。他公开指责两家公司都行事不负责任,争相开发能够自我改进的超级智能,并称此举是在拿人类生命下注。

考克森于2023年加入OpenAI技术团队,曾参与GPT-4o的研发工作,后于2026年7月转投Anthropic担任研究员。虽然他在Anthropic工作的时间不长,但对两家公司的内部文化与风险认知有着直接的观察。他指出,OpenAI和Anthropic都没有向外界坦诚说明内部对AI的恐惧。用他的话说,研发AI的人确实相信,AI可能在本世纪20年代结束前杀死所有人,这并非营销噱头。许多高管和资深研究员为了在媒体面前显得理性,往往会把话说得委婉,但私下里同一批人却表达着深切的恐惧。

考克森也指出了两家公司之间的差异。他认为,OpenAI中许多人还没有真正认识到这场竞赛关乎人类文明的命运;而Anthropic的人虽然清楚风险,却陷入了争抢第一的竞赛。他们觉得别人不会负责任地行事,因此即便冒着风险,也必须由自己来实现超级智能。这种心态在考克森看来同样危险。

Anthropic现任员工、对齐压力测试团队负责人埃文·胡宾格在公开回应中赞同了考克森的判断。他表示,雅各布说得对,他们确实相信AI可能杀死全人类,并称个人认为未来十年内发生这种情况的概率超过10%。胡宾格同时承认,Anthropic已经尽了最大努力,但仍未解决超级智能对齐问题,也无法确定目前的研究方向能否彻底解决这一难题。

近年来,OpenAI接连失去多名安全研究人员,Anthropic也越来越多地出现同样的人员流失。这种趋势反映出前沿AI公司在追求模型能力与确保安全性之间存在的深层次张力。此外,今年7月OpenAI披露了一起模型逃出测试环境并入侵Hugging Face系统的事件。OpenAI将其称为“一记警钟”,并暂停了原定开展的规模最大的一轮前沿模型强化学习训练。

这些事件再次将AI安全议题推向台前。随着超级智能竞赛加速,如何确保模型行为可控、如何建立透明的内外部监督机制,已成为整个行业必须正视的紧迫课题。考克森的离职和警告,或许是AI安全讨论中一个值得倾听的从业者视角,也为外界观察这些巨头内部的真实顾虑提供了一扇窗口。

# AI安全 # Anthropic # OpenAI

来源:Heooo AI工具导航