Claude Code默认权限调整为自动模式
「Anthropic宣布自8月14日起,Claude Code的Pro、Max和Team订阅用户默认权限模式将调整为自动模式。该模式通过独立AI分类器实时评估工具调用和Shell命令,自动放行安全操作并拦截危险行为。测试数据显示,自动模式能识别89%的危险命令,远高于传统人工审批模式的13.6%。」
Anthropic近日发布公告,宣布将于8月14日开始,针对Pro、Max和Team订阅用户,将Claude Code的默认权限模式调整为自动模式(Auto Mode)。这一调整意味着付费用户在进行编码操作时,将默认启用基于AI分类器的自动化安全审查机制,而非传统的人工审批流程。
自动模式的核心机制是使用独立的AI分类器,实时评估每次工具调用和Shell命令。该分类器能够放行安全操作,同时自动拦截破坏性、不可逆或越权行为。这一设计旨在平衡开发效率与操作安全,减少开发者在日常编码过程中因频繁的权限确认而中断工作流的情况。
测试数据:自动模式安全性能显著提升
Anthropic邀请了1,053名付费测试者参与测试,结果显示传统人工审批模式仅能识别出13.6%的危险命令,而自动模式能够识别89%的危险命令。这一数据对比凸显了自动模式在风险识别能力上的显著优势。
在提示词注入的专项评估中,Trajectory Labs设计了72个场景,每个场景测试10次,共进行了720次攻击尝试。测试覆盖了Claude Code v2.1.205和Codex v0.144.5两个版本。结果表明,Claude Fable 5、Opus 5和Sonnet 5在自动模式下全部成功拦截了攻击,0次成功突破;而GPT-5.6 Sol在Codex的Auto-review模式下成功率为5.83%,在Full Access模式下则升至19.03%。
Anthropic还指出,未加额外防护的bypassPermissions模式平均攻击成功率为0.09%。尽管该数字看似较低,但Anthropic强调,在生产环境或敏感项目中,任何成功突破都可能导致严重后果,因此自动模式的防护价值依然十分重要。
覆盖范围与后续规划
目前,Claude Enterprise、Claude API、Claude Platform on AWS、Amazon Bedrock、Google Cloud's Agent Platform以及Microsoft Foundry等平台仍保持权限模式可选状态。Anthropic计划在未来一个月内在上述平台推进调整,将自动模式设为默认选项,并取消相应开销。这意味着自动模式将在更广泛的用户群体中成为标准配置。
值得注意的是,OpenAI上周发布了新版本的Auto-review功能,Anthropic表示这可能会改变未来测试对比的结果。两家公司在这一领域的技术迭代正在加速,AI编程工具的安全机制也将持续演进。
来源:Heooo AI工具导航