行业资讯
Anthropic CEO 呼吁前沿AI限速获同行响应
Heooo 09月14日19时02分 29 阅读
「Anthropic CEO 达里奥·阿莫迪发文呼吁为前沿AI限速,提出围绕可核验性的三步走方案,并称AI的递归式自我改进已现端倪,主张把放慢节奏后省下的时间投入对齐、可解释性与测试评估等安全领域。OpenAI CEO 奥特曼转发支持,马斯克也表示认同。」
Anthropic CEO 达里奥·阿莫迪近日公开发文,呼吁为前沿 AI 的能力提升“限速”。他提出的方案围绕“可核验性”展开,分为三步:先由企业引入驻场第三方评估员,让外部力量能够持续、独立地观察模型行为;再推动更大范围的协同机制;最终寻求全球层面的协作。不过他也坦言,全面限速在短期内落地的可能性很低。
阿莫迪给出的理由,是他对技术节奏的判断。他认为,AI 的递归式自我改进已经出现,能力爬升的速度正在脱离人类评估与理解的速度。因此,与其继续在能力曲线上冲刺,不如主动放慢模型能力提升的节奏,把多出来的时间投到运营可靠性、对齐、可解释性以及测试评估这些安全相关的方向上。
换句话说,他希望产业把资源从“更强”转向“更可控”。
这一主张很快得到了同行响应。OpenAI CEO 奥特曼转发表示支持,马斯克也公开称认同。几家最具代表性的前沿模型团队负责人在同一议题上出现同向表态,让“限速”从一家公司的安全叙事,变成了更广泛的产业话题。
事实上,Anthropic 的安全叙事并非一日之功。此前该公司研究员雅各布·考克森离职时就曾警告,AI 可能在十年内带来灭绝级风险。从内部研究员的出走预警,到 CEO 公开主张为前沿 AI 限速,这家公司正把“慢下来”从理念层面推向产业与政策议程,也让外界重新审视一个问题:在能力竞赛仍未降温的当下,谁愿意、又凭什么先踩下刹车。
# Anthropic # AI安全 # 前沿模型
来源:Heooo AI工具导航