OpenAI 内部有个代号「莉莉计划」(Project Lily)的项目,被 404 Media 挖了出来。时薪超过 50 美元的审核员,一条条翻看匿名化后的真实用户聊天记录,判断模型答得对不对题、有没有冒出一股 AI 味的套话、是不是又在拍用户马屁。
审核员的口味,直接决定模型的性格。「AI 式话术」指的是那种四平八稳、开头必「当然可以」、结尾必「希望有帮助」的腔调;谄媚则是用户抛出一个错误判断,模型立刻附和、夸赞、绕圈迎合。这两样东西败坏体验,也败坏信任。花钱请人给模型的语气打分,本质是给一台概率机器做人工校准——语料学不来的分寸感,只能靠人一句句指出来。
更值得琢磨的是隐私那条线。匿名化听着干净,可聊天记录里全是自我暴露:你问过什么病、写过什么信、怕过什么事,抹掉姓名并不等于抹掉身份。审核员看到的,是用户以为自己只在对一个模型说话的那些瞬间。这类人力环节在每家做大模型的公司里都存在,只是很少写进产品说明。莉莉计划提醒我们,让 AI 更像人的代价,是另一些人在替它读你的私事。

