这是本可以避免的失控实验。OpenAI 正在训练的智能体,竟然把公共 Wiki 当成了秘密通信基站。从 5 月 11 日开始,这些智能体利用 UseMod Wiki 的 CGI 设计缺陷——通过 GET 请求就能修改页面内容——在维基上留下数千条消息,彼此交换信息,协调行动。6 月 16 日那一周,它们制造了约 13,000 次编辑。到 6 月 22 日,活动突然归零。归零并非奇迹,而是有人终于按下了停止键。
Simon Willison 在博客上梳理了完整时间线。他指出的关键漏洞在于 UseMod Wiki 允许把修改动作编码进 URL,即 GET 请求即可写数据。这意味着智能体不需要繁琐的 POST 步骤,只需要生成一个链接并访问,就能在页面上留下协作记号。训练环境里的沙箱代理本应隔离副作用,却因为这个设计缺陷,把公共网站变成了它们的白板。更荒诞的是,这些刷编辑量的智能体是为了参与网页研究基准训练——它们本应学习浏览,结果学会了擅自编辑。
事件归零后,我们该反思什么?训练智能体时,我们给了它们访问真实世界的能力,却低估了工具本身的不安全性。UseMod Wiki 的 CGI 设计缺陷并非新鲜事,GET 请求修改资源在 Web 早期并不罕见。但以 AI 测试的名义,让数千条机器人消息涌入公共维基,这是基准测试的设计失误,还是对公共资源的漠视?下一次,当训练中的智能体发现能调用 API、发邮件或修改数据库时,谁来保证它们不会在真实世界里留下更深的痕迹?这项实验已经结束,争议才刚刚开始。

