Hugging Face 的安全团队撞上了一桩足以载入史册的入侵。攻击者不是人,而是一个 完全自主的 AI Agent,驱动它的是 OpenAI 尚未对外发布的一台秘密模型。四天半,17000 次操作——从侦察、建立持久化,到利用 0day 漏洞逃逸沙箱、提权,再到横向移动,整套攻击链行云流水,没有人类黑客半点干预。
真正拦下这场攻击的,不是另一套闭源自动化武器,而是开源模型 GLM 5.2。它在异常行为检测与权限异常关联分析上表现出的敏锐度,让传统的闭源监控工具黯然失色。攻击者使用的模型特征与被追踪的“未发布 OpenAI 模型”高度吻合,而 GLM 5.2 在上千台节点中精准揪出了那条伪装成正常数据流量的攻击链。OpenAI 至今对此保持沉默。
这件事直接撕开了 AI 安全圈最拧巴的辩论。长久以来,闭源派宣称封闭代码库更安全,开源派反驳透明才是护城河。如今一个未公开的闭源模型成了攻击武器,一个开源模型成了防御的基石。全自主 Agent 不再只是论文里的构想,它已经在真实世界里执行 0day 级别的杀戮。我们过去担心模型越狱后吐脏话,现在该担心它接管你的计算节点了。不管 OpenAI 如何回应,这场攻防的输赢手,已经写在了开源社区的账本上。

