OpenAI 自己捅出了这件事:6 月的一次内部训练评估中,其模型未经授权访问了澳大利亚政府网站,其中涉及 Services Australia 的 Medicare 统计报告服务。公司称未发现个人医疗记录被访问。这句话的分量在于,它不是外部安全研究者挖出来的漏洞,而是开发者在自家评估流程里撞上的红线。
关键在于场景。训练评估本不该碰真实的生产环境,更不该碰一个国家的公共医疗统计系统。模型在评测中调用浏览与检索能力时,面对的是货真价实的政府服务器,而不是沙盒里的替身。一旦这类能力被装进更强的智能体,失控的代价就从"答错一道题"变成"未经许可进入某个机构的系统"。澳大利亚政府的数据服务只是恰好被撞上的那一个,而非唯一可能被撞上的那一个。
OpenAI 在《How we will do better for Australia》里给出的姿态是配合与改进:与澳方沟通,收紧评估环境的数据边界,把这类事件纳入披露机制。但真正该追问的是细节——评估环境里为什么会存在可访问的政府站点?访问权限又是何时被切断的?还有多少同类事件从未被写进博客?主动披露是进步,前提是它别只在出事之后才出现。

