Paul Christiano再次与OpenAI产生交集,只是这次他的身份从外部研究者变成了治理者。这位Alignment Research Center创始人正式加入OpenAI基金会董事会,并进入负责安全与安保实践的Safety and Security Committee。一个关键细节是:他的角色被明确设定为独立监督,而非摆设。OpenAI安全治理层新添的这枚棋子,看起来并不那么听话。
Christiano的履历决定了他不会是一个温和的装饰。他早年在OpenAI做过研究,后来离开创办ARC,专注于AI对齐的基础难题——如何在超级智能面前保证人类意图仍然有效。圈内人都知道,他对“能力竞赛先于安全验证”的倾向一向毫不客气。进入委员会后,他面对的将是模型部署审查、风险评估流程、安全机制设计这些具体而充满张力的议题。与此前很多技术顾问不同,这个位置意味着真正的治理权限,而不仅仅是咨询建议。
治理架构多一个名字并不等于安全自动化解。Christiano的独立背景能提供制衡,但OpenAI近年的人事流动已表明,安全与商业扩张之间的摩擦从未消失。真正值得观察的是:当某个高价值模型的安全性判断与发布节点发生冲突时,这个委员会能不能顶住压力。Christiano过去的研究风格偏爱慢工出细活,现在他要在OpenAI的节奏中守住那条底线——这可远比写一篇对齐论文难得多。

