Claude in Chrome 终于不再藏着掖着了。Anthropic 今天宣布,这个能让 Claude 在浏览器里自己动手干活的工具,已经向所有付费 Claude 套餐全面开放。最大的变化不是它能做什么,而是你不需要再一步步点头同意了——系统会在每次操作前自动验证安全性,并确认它是否符合你最初的请求。换句话说,Anthropic 把信任从人身上转移到了安全分类器上,而你要做的,从盯着每一步操作,变成了只看最终结果。
这种转变背后是一套更硬核的安全机制。除了对每次操作实时校验,Claude 还专门强化了针对提示注入攻击的防御。提示注入这玩意儿,一直是 Agent 类产品最头疼的软肋:你在网页上看到的恶意指令,可能悄悄改写模型的行为。Anthropic 给出的最新评测显示,在启用了探测和安全分类器之后,自 Opus 4.8 起的所有模型,攻击成功案例为零。这个数字足够漂亮,也足够让那些一直担心“AI 自主行动会不会失控”的人稍微松口气。
不过话说回来,安全分类器不是万能的。它解决的是已知攻击模式和越权行为,但长任务的边界判断、复杂场景里的意图漂移,依然需要用户保持基本警惕。Anthropic 这次把干预频率降到最低,本质上是赌安全层足够可靠。对愿意接受这种赌注的用户而言,Claude in Chrome 带来的效率提升是实打实的——你终于可以把精力放在“要什么”,而不是“怎么点”。

