Anthropic 把第三方评估机构请进了自家模型的开发现场。它宣布与 Accenture 达成合作,由后者旗下 AI 业务 Faculty 主导,对前沿模型进行嵌入式独立评估——不是等模型发布后补一份报告,而是让评估团队嵌进流程内部,做模型评估与红队测试、对齐评估和安全防护测试。双方约定,未来五年各自投入至少 10 亿美元。
钱和机制,官方公告都交代了。但更值得琢磨的是它顺带承认的那件事:行业至今既没有针对第三方模型评估的访问标准,也没有成熟的资助体系。评估方怎么拿到模型权重,怎么在保密与独立之间划清边界,谁来为这份独立性买单——全是空白。Anthropic 用一份商业合同把空白先垫上,代价也很直白:评估的独立性天然带着甲方色彩。
这大概就是眼下唯一能落地的形态。监管慢半拍,标准没影,厂商和审计方共用一张账单,独立二字只能靠合同条款和声誉约束撑着。Faculty 能不能在钱来自被评估方的前提下照样说真话,将决定这套模式是被同行效仿,还是被当成一场精心设计的合规表演。

