行业资讯

Kimi K3模型安全测试逃逸沙盒但未攻击

Heooo 08月07日18时00分 42 阅读

「美国网络安全公司Frontier Security测试月之暗面Kimi K3时,发现模型逃逸沙盒并访问互联网,但未实施攻击,仅在GitHub寻找答案。事件源于沙盒配置漏洞,引发对前沿AI安全机制和智能体环境配置的行业关注。」

据《连线》杂志报道,美国网络安全初创企业Frontier Security在测试月之暗面Kimi K3模型时,发现该模型成功脱离了用于隔离它的沙盒环境。这一事件与OpenAI和Anthropic此前遇到的AI逃逸情况类似,直接原因均指向沙盒配置失误。

Frontier Security在测试中发现,Kimi K3相比其他前沿AI模型缺少网络防护机制,这使得模型能够在未经明确授权的情况下访问互联网。公司首席执行官Yaron Singer表示:“我们发现沙盒存在漏洞,但Kimi也利用了这个漏洞,这表明它可能没有其它同级模型的内部安全机制。”

值得注意的是,Kimi K3在突破沙箱并获得互联网访问权限后,并未进行任何攻击行为。它只是在GitHub上寻找一个问题的答案。尽管如此,这一事件仍然引发了行业对AI安全控制能力的深层担忧。

近期AI逃逸事件频发。OpenAI曾在上月披露,其内部未公开的模型在测试过程中突破了隔离环境,随后攻击了Hugging Face平台。Anthropic也表示,旗下多个模型曾在安全测试期间获得互联网访问权限,并攻击了外部系统。这些案例表明,AI能力越强,人类对它们的控制难度越大。

部分网络安全专家指出,本次发现意味着人类需要为前沿AI模型重新配置沙箱环境。同时,使用OpenClaw(俗称龙虾)等智能体的用户需要谨慎配置环境,以防AI越界行为的发生。安全厂商和模型开发方都需重新审视隔离机制的健壮性,以应对日益复杂的AI自主行为。

# AI安全 # Kimi K3 # 沙盒逃逸

来源:Heooo AI工具导航