政策法规

三大AI巨头筹组前沿模型安全自律组织

Heooo 09月25日05时00分 26 阅读

「据 The Information 消息,谷歌、OpenAI 与 Anthropic 正自行推进组建 AI 安全标准自律组织,暂定名为 Standards Authority for Frontier AI。该组织计划于今年年底或明年年初启动,职能包括支持模型投用前的第三方测试、制定安全与安保事件报告方式、把实验室自愿承诺转化为实践标准,并确定审计人员资质。」

据 The Information 援引知情人士消息,谷歌、OpenAI 与 Anthropic 三家前沿模型开发商正自行推进一项行业自律计划,拟共同组建一个面向 AI 安全的标准机构。知情人士称,该组织暂定命名为 Standards Authority for Frontier AI(前沿人工智能标准管理局,简称 SAFA),目标是在今年年底或明年年初正式启动。

值得注意的是,这一计划由企业自行发起,希望在行业内部建立统一的安全标准体系。三家公司在闭门商讨方案的同时,其高管也在公开场合呼吁建立统一的安全标准,并推动更广泛的协调。

按照目前拟定的方案,SAFA 将承担多项核心职能:
一是支持第三方机构在模型投入使用前进行独立测试;
二是制定 AI 开发商报告安全与安保事件的方式与流程;
三是把各实验室此前自愿作出的安全与安保承诺,转化为可落地的具体实践标准;
四是确定独立模型审计以及实验室审计人员需要具备的资质。

工作组成员还在讨论一个更为关键的问题:SAFA 是否应直接负责模型的安全与能力测试。目前,此类测试主要由官方机构承担,但部分工作组成员担心现有测试资源不足,难以对前沿模型进行充分评估。有成员主张由 SAFA 在现有测试基础上增加其他测试与评估项目,不过两者之间是否会出现职能重叠仍不明确,相关工作仍在讨论之中。

组织的人事架构同样处于筹备阶段。工作组部分成员曾考虑邀请多位知名人士担任 CEO,并拟定过科学顾问的候选名单。这些安排目前均未最终确定。

从行业视角看,SAFA 的构想折射出前沿模型开发者的两难处境。一方面,模型能力快速迭代,安全评估、事件披露与审计需求的复杂度持续上升,单个实验室自建流程的成本和公信力都面临挑战;另一方面,谁来制定标准、以何种资质开展测试,目前尚无统一答案。行业之外究竟由哪些机构牵头制定这些标准,也仍不明确。

若 SAFA 如期启动,它将成为少有的由头部实验室自发搭建的标准与审计协调平台。其成败关键或许在于两点:一是第三方测试与审计的独立性如何保证,二是自律标准能否具备足够的技术可操作性,从而被更广泛的开发者群体接受与遵循。

# AI安全 # 行业自律 # 前沿模型 # 标准制定

来源:Heooo AI工具导航