Anthropic 今年春天干了一件值得被记一笔的事:通过隐私保护工具 Anthropic Insights,向斯坦福大学 SALT Lab、牛津大学人类信息处理实验室以及 METR 三家外部机构开放了约 25 万段 2026 年 4-5 月的 Claude.ai 或 Claude Code 对话数据。这些数据不是给厂商自己写总结用的,而是供研究者独立设计问题、展开研究并公开发表结果。
关键点在于“独立”二字。过去评估大模型的社会影响,多少绕不开厂商的自说自话——数据你出,问题你定,结论自然好看。而 Anthropic 这次把真实使用数据交给外部团队,等于把裁判权让渡出去。研究者可以基于自己的研究框架去问“Claude 到底怎么被使用”“对用户产生了哪些可观测的影响”,并且所有结论都建立在可核验的聚合结果之上,而非厂商精选的案例。
值得注意的还有这套隐私保护机制。Anthropic Insights 本身在设计上就对敏感信息做了处理,不暴露个体可识别内容。外部机构拿到的是聚合后的洞察,而非原始对话流水。这让大型语言模型的真实影响研究第一次有了“既能看清,又不越界”的可能。未来如果更多厂商愿意把数据以类似方式开放,行业评估的含金量会完全不一样。

