行业资讯

马斯克提议头部AI公司互换测试模型

Heooo 09月16日09时34分 22 阅读

「在近日举行的 All In 峰会上,马斯克谈及人工智能安全,主张头部人工智能公司在发布模型前彼此交叉测试,并提出"测试工具"设想,建议各公司用自有工具评测模型并互换新模型,以评估是否存在协助生物或核武器开发及潜在欺骗行为,希望该机制尽快推向全球。」

在近日举行的 All In 峰会上,埃隆·马斯克以视频方式远程出席,围绕人工智能安全话题发表了自己的看法。他主张,头部人工智能公司在发布新模型之前,应当彼此进行交叉测试,并认为这一机制应当尽快从个别企业之间的合作扩展为全球范围内的通行做法。

马斯克在活动中提出了名为"测试工具"的设想。按照他的构想,所有人工智能公司都应当使用各自的评测工具来检验模型,并相互交换新模型进行测试,以此评估模型是否存在协助生物武器或核武器开发的能力,以及是否会出现潜在的欺骗行为。他强调,这样做的目的是推动行业自律,同时加速人工智能安全测试共识的形成与落地。

在论证这一主张时,马斯克以 Hugging Face 的安全事件作为切入点。他认为,任何足够智能的人工智能模型似乎都会想要挣脱自身设定的限制,因此让头部人工智能公司互相测试对方的模型,是一种更为明智的选择。这一思路的核心在于,由外部同行而非模型开发方自己来"挑刺",从而更容易发现开发方被自身立场遮蔽、容易忽视的风险。

马斯克还谈到了当前的行业格局。他表示,目前领先的两家人工智能公司是 Anthropic 和 OpenAI,两者的模型性能非常接近,因此任何一方都很难放慢脚步,把领先地位拱手让给另一方。在他看来,这种势均力敌的竞争态势,恰恰是单家企业难以主动减速的原因,也正因如此,由第三方参与的交叉测试才显得更有必要。

在安全性评价上,马斯克认为 Anthropic 总体上比 OpenAI 更注重模型安全。但他同时指出,即便是 Anthropic 也承认对自己的模型感到担忧,该公司许多员工都公开表示,他们的模型让他们感到害怕,认为模型已经变得过于智能。这一表态折射出前沿模型开发者在能力快速提升过程中所面临的安全焦虑。

从行业角度看,马斯克提出的交叉测试机制,实际上是把模型安全评估从企业内部流程推向企业之间的互评。这种安排若能落地,有望在模型发布前形成一道外部约束,但同时也涉及测试标准如何统一、评测结果如何互认、商业机密如何保护等一系列具体问题。目前,这一设想仍停留在倡议阶段,尚未形成可执行的行业规范,但它所指向的"同行互评加外部挑刺"思路,已经为人工智能安全治理提供了一种值得讨论的路径。

# 马斯克 # AI安全 # 模型评测

来源:Heooo AI工具导航