14%,这是人类手动审批在 Claude Code 中拦截危险 shell 命令的真实成绩。别急着找借口——数据来自 Anthropic 自己的测试,前提是用户面对一次可能毁掉整个环境的指令,点下“批准”的概率高得离谱。自 8 月 14 日起,Pro、Max 和 Team 用户会发现默认权限模式切成了自动模式。这不是小修小补,这是对“人工审批即安全”这一错觉的彻底否定。
新自动模式背后跑着一个独立的分类器,专门审查即将执行的 shell 命令和各类操作。它的判断依据不是用户一时的注意力残留,而是被刻意训练过的风险识别能力。结果令人过目不忘:捕获率89%。相当于每 10 次危险操作,手动模式下你能侥幸挡下 1.4 次,自动模式能拦下近 9 次。这种跨度已经不是优化,是直接从“不设防”切到了“专业门禁”。
这次更新真正的刺点在哪儿?在于 Anthropic 没有给用户一个“启用高级安全”的选项,而是干脆把安全基线焊死在默认行为里。你依然可以手动介入,但系统不再默认相信你那容易疲劳的判断力。降低摩擦、提升安全,二者兼得的手段一向稀缺,自动分类器提供了一条可行路径。它同时扔给行业一个尖锐问题:当 AI 终端已经在替人敲命令,还指望人来逐条把关,究竟是懒惰,还是傲慢?

