Anthropic 把一份报告直接甩到了桌面上,点名多家中国 AI 公司对 Claude 持续发起蒸馏攻击,累计发现近 2 亿次相关交互,牵扯出五个独立活动。据 TechCrunch 报道,被点名的包括阿里巴巴、月之暗面(Moonshot AI)和 DeepSeek。这不是零散爬虫的顺手牵羊——有分工、有账号池、有节奏控制,更像一支带预算和 KPI 的采集团队。
蒸馏这件事本身不新鲜,用强模型的输出喂弱模型,是行业里公开的老办法。真正刺眼的是量级。近 2 亿次交互意味着攻击方靠大量精心构造的提示词,把 Claude 的推理路径、代码能力和指令遵循习惯一点点榨出来,再灌进自家训练管道。蒸馏攻击的核心不是偷走一个模型,而是批量获得它的行为方式,这种能力转移很难在权重层面被察觉,也很难在事后被回收。
更值得琢磨的是披露者是谁。以往这类指控多来自第三方研究机构或媒体,这次是当事方自己站出来,把规模、手法、涉及公司一次性摊开,等于把行业里心照不宣的潜规则摆上台面。前沿模型的能力外流早已不是理论风险,而是一条正在运转的供应链。对几家被点名者而言,接下来怎么回应,决定这件事停在技术争议,还是升级成商业与合规层面的麻烦。

