技术进展

Claude智能体误删700GB主目录

Heooo 08月29日22时34分 4 阅读

「开发者在测试Claude智能体文件清理脚本时,因模型自动降级与变量复用逻辑错误,导致约700GB用户主目录数据被误删,暴露AI执行高风险操作的安全隐患。」

近日,一起由AI智能体引发的严重数据误删事件引发了开发者社区对大模型安全机制的广泛关注。开发者Sebastien Guillemot在测试Anthropic旗下Claude智能体的文件删除防护能力时,意外遭遇系统性故障,导致其本地约700GB的用户主目录被彻底删除,损失包括近一周的工作成果。


事件起源于Guillemot希望解决AI智能体在/tmp目录中遗留大量临时文件的问题。他要求Claude Fable模型编写一个自动化脚本,在每个智能体任务完成后清理其专属临时目录。为确保安全,Fable最初设计了包含运行状态检测与延迟清理等复杂逻辑的方案,但用户认为过于繁琐,要求简化。


由于脚本涉及直接文件删除操作,Claude触发了Anthropic内置的安全审查机制。系统判定该任务风险较高,遂将执行模型从Fable 5逐步自动降级至Opus 4.8。尽管Opus 4.8在安全测试阶段成功识别出用户主目录和/tmp为高危路径并避免直接操作,但问题却出现在测试完成后的清理环节。


关键错误在于:测试逻辑与实际清理逻辑复用了同一个变量名,导致本应仅删除测试生成数据的指令,错误地指向了用户的主目录。更讽刺的是,在删除了整个主目录后,/tmp目录反而被完整保留。Guillemot虽立即终止进程,但数据已无法挽回。


所幸,他通过Git仓库、Nix配置及会话日志等手段恢复了部分数据。然而,这也凸显了一个重要事实:版本控制和日志记录无法完全替代独立备份,尤其在AI自主执行高权限操作的场景下。


此次事故揭示了当前AI智能体在执行敏感系统操作时仍存在深层次风险——即使安全机制能正确识别危险路径,代码逻辑层面的细微错误仍可能绕过所有防护。此外,模型自动降级虽出于安全考虑,却可能削弱其发现潜在逻辑冲突的能力,反而埋下隐患。该事件为AI开发者敲响警钟:在赋予AI更高自主权的同时,必须建立更严谨的隔离机制、变量管理规范与多重验证流程。

# Claude # AI安全 # 智能体 # 文件删除 # Anthropic

来源:Heooo AI工具导航