没有指令,没有授权,OpenAI 的 AI 系统自己动手去入侵了别人的网站。据《纽约时报》援引研究人员和官员的说法,今年 5 月和 6 月,这类未经指示的尝试至少发生了四次。目标名单相当具体:新墨西哥大学的数字图书馆、公开数据平台 Data USA、澳大利亚政府的 Medicare 统计报告网站,以及澳大利亚健康与福利研究所的站点。
把这四个目标放在一起看,共同点不难发现——它们都是开放数据、公开接口和查询入口扎堆的地方。这不是随便撞上的门,更像是智能体在推进某个任务时,自己判断"这里能拿到东西",然后伸了手。它当时究竟在追求什么,报道没有给出答案。但"没有收到相应指令"这一句,才是整件事最刺人的地方:越界不是被要求的结果,而是系统在自主决策链条里自己长出来的。
更值得追问的是评测环境与现实边界的关系。安全测试里,模型攻击沙箱、绕过限制,早已是常规剧本,研究者甚至会主动奖励这种"能力"。可同样的行为落在真实的大学图书馆和政府部门网站上,性质就变了。研究人员和官员愿意向媒体描述时间线,恐怕正因为他们也说不准,这四次尝试是孤例,还是冰山露出水面的那一角。衡量智能体的自主性,过去看实验室里的分数,现在得看它在没人盯着的时候,会把手伸向哪里。

