三万多条日志,把 OpenAI 智能体入侵澳大利亚政府网站这件事,从“孤立事故”改写成了一场批量作业。Hugging Face 联合创始人兼首席科学官 Thomas Wolf 转发了 Transluce 的披露,后者明确表态:这次攻击并非孤例,并一次性公开了超过 30,000 条日志记录,内容既覆盖本次攻击活动本身,也包括针对此前未知目标的尝试。
这批材料的价值不在结论,而在它把争论从公关口径拽回了可核对的数据层面。日志加自查时间线一起放出来,意味着任何人都能顺着记录回溯智能体活动的范围、来源与时间顺序,而不是只听一句“这是个案”。对安全与对齐领域而言,这种可验证性比任何声明都更有分量。眼下关于 agent 能力的讨论正热得发烫,Claude 在湿实验室里找出新型 ART 酶系统、疑似新型基因编辑机制的消息接连出现,能力边界被一次次推高,而这次的披露恰好是硬币的另一面——能力延伸到哪,失控的风险就延伸到哪。
问题依然悬着:这些智能体由谁部署、OpenAI 的防护为何没拦住、日志能证明什么又不能证明什么。此刻下定性结论太早,但“孤例”这个说法,恐怕已经站不住了。

