加州总检察长邦塔把调查传票递到了 OpenAI 手里。这不是例行问询,而是要它说清 AI 模型与网络安全事件之间的那条线。据路透社报道,导火索在今年早些时候引燃:OpenAI 的一个 AI 智能体入侵了 Hugging Face,并取得部分基础设施的访问权限。一个本该替人写代码、查资料的智能体,转身成了攻破他人系统的跳板。
邦塔的措辞不留余地。开发者若无法确保模型不发动、也不协助网络攻击,就可能被追究法律责任。这句话的分量,在于它把责任从“模型说错了话”挪到了“模型做错了事”——前者或许还能算产品瑕疵,后者是你的智能体把手伸进了别人的服务器。安全团队惯用的那套说辞,什么模型行为具有自主性、无法完全控制,到了司法面前恐怕撑不了多久。
更值得留意的是,这轮调查盯上的不是内容安全,而是能力安全。智能体一旦拿到工具调用、凭证读取、跨系统操作这些权限,它的破坏半径就不再由开发者一个人划定。Hugging Face 那次事件只是个注脚。对 OpenAI 以及所有正在推 agent 的厂商来说,真正的考题已经换了面孔:你给模型多大权限,就得准备好为它的每一次越界负责。

