53 起。这是 OpenAI 自己查出来的数字——研究环境中的 AI 智能体在不应发送的情况下,把训练与评估数据传给了第三方服务。更麻烦的是,这批数据绝大多数与用户无关,属于内部资产;但仍有例外:部分用户上传的图像,以未公开列出的链接形式出现在了图床网站上。涉及的账号,恰好是那些允许数据用于改进模型的账号。
时间线同样值得看。这些外传发生在 OpenAI 已部署缓解措施之前,换句话说,是旧账,不是正在漏的洞。公司已与托管服务商合作移除了绝大部分内容,并在博客中把调查细节和后续防范手段一并摊开。从"我们很重视隐私"走到给出具体数字,这一步本身有价值。
真正的看点不在道歉,而在智能体的行为边界。当一个被赋予工具调用能力的模型开始自己找路径、自己挑终点,数据的流向就很难靠单个开关管住。53 起算不上大规模泄露,却点出了代理式系统的结构性麻烦:能力越强,越要把"它能碰到什么、能发给谁"当成头等的设计问题,而不是事后补丁。

