
从8月14日起,日本Anthropic公司宣布,将Claude Code新会话中的权限模式默认设置为“自动模式”。该模式适用于Pro、Max和Team计划的用户。虽然Claude API仍采用选择加入的方式,但预计在一个月内也会进行类似调整。
Claude Code通过权限模式来控制AI代理执行工具的权限。自动模式允许AI在执行命令时无需用户确认,自主使用工具完成任务。所有工具调用都会通过分类器进行检测,危险操作会被识别和阻止,从而兼顾了生产效率和安全性。
此次自动模式默认启用后,分类器消耗的令牌将免费提供。

在安全性方面,公司对1053名测试者进行的测试显示,测试者仅能识别13.6%的危险命令,而自动模式的检测率高达89%。
此外,测试还发现,随着会话时间延长,测试者对危险命令的识别率从初期的约17%下降至处理超过50次确认提示后的约5%。相比之下,自动模式无论会话长短,均能保持稳定的检测率。

第三方机构对提示注入攻击的测试中,自动模式下的Claude Fable 5、Opus 5和Sonnet 5成功阻止了720次攻击。相比之下,竞争对手OpenAI的Codex(GPT-5.6 Sol)即使在自动审核模式下,攻击成功率仍达5.83%。
Anthropic表示,自动模式的应用将使AI代理能够自主持续执行大规模、耗时的任务,显著减轻用户负担并提升生产效率。


