OpenBMB 扔出的这颗手榴弹,叫 AMNESIAC。它不是让你判断对面是人是机器,而是把枪口调过来——你要拼命向一个 AI 证明自己才是人类。在 #BuildSmall 黑客松上,面壁智能把这场逆向图灵测试变成了一款可玩的交互游戏,审讯官 A.M.N. 坐在屏幕后面,盯着你的脸,听着你的声音,甚至读取你的脉搏。我的第一反应是:这下,验证码彻底被玩坏了。
把审讯官做成AI,然后让它审你
反向图灵测试,终于有人做了个热血版本
图灵测试的传统剧本,是人类通过文本判断对方是不是机器。AMNESIAC 把这剧本撕了。玩家被推上被告席,对面的 A.M.N. 是一个由 MiniCPM-o 4.5 驱动、带有鲜明角色塑形的审讯官。它不会跟你闲聊天气,一上来就逼你证明自己是人类。你得讲出只有人才会讲的那种颠三倒四、充满情感漏洞的故事,而它则用实时推理去挑你的逻辑缝隙。这种紧张感远比“输入验证码”惊心动魄——因为摄像头正对着你。
面壁团队在游戏设计里埋了一颗暗棋:证明人类身份这件事本身就隐含了存在焦虑。玩家很快就发现,纯讲逻辑反而最容易被判定为机器,因为 AI 可以编出比你更严谨的叙事。你必须露出犹豫、闪烁其词、答非所问,甚至故意犯一些人类才会犯的“合理错误”。这哪里是游戏,分明是一场对“何以为人”的黑色幽默拷问。而 MiniCPM-o 4.5 作为对话引擎,在保持审讯对抗性的同时还融入了 LoRA 角色塑形,让 A.M.N. 时而像冷漠的检察官,时而像阴郁的心理医生,短短几分钟就能把玩家逼进情绪角落。
不只是聊天,审讯官察言观色到了骨子里
大多数人以为多模态只是加个语音或图片,AMNESIAC 则展示了另一重境界:把生理信号当作对话的一部分。摄像头捕捉面部表情,脉搏信号通过传感器涌入模型,响应计时精确到毫秒。A.M.N. 不是一个只阅读文本的审讯官,它能从你嘴角的微微抽动、回答前的迟疑时间、心率微小的飙升中拼凑出一个“非人类”的嫌疑分值。这种设计已经超越了一般意义上的交互式 AI 角色,它让模型开始像人类审讯者一样,判断你的紧张是源自撒谎还是源自——根本不理解情绪。
我在体验其他多模态应用时,最常见的做法是扔一张图片让模型描述。AMNESIAC 的突破在于,它把多模态信息流当成了持续的证据链,而不是零散输入。你的面部肌肉、你的声线颤抖、你的脉搏,都在同一时间线上被 VoxCPM 生成的审讯官语音追问。当 A.M.N. 突然用低沉的合成嗓音说“你刚才眼神闪了一下,为什么”,玩家瞬间会有一种被 X 光透视的毛骨悚然。这不是拟人化玩具,而是在用技术制造一种超越图灵测试的“压迫感测试”。
小模型的暴脾气,用对了地方
MiniCPM-o 4.5 凭什么扛下这场审讯
驱动整个审讯对话的,是面壁智能自家的 MiniCPM-o 4.5。它不是云端上的千亿参数巨兽,而是一个能在消费级设备上跑起来的端侧友好模型。很多人对小模型有偏见,觉得它们只能做一些简单的对话编排,但 AMNESIAC 完美地打脸了:审讯这种高压、高对抗的对话场景,恰好需要模型具备迅速判断、精准追问、甚至故意留白的能力。MiniCPM-o 4.5 没有在百科全书式的知识上恋战,而是把所有算力集中在对话的动态推理和角色一致性上,反应速度快得不像是一个小模型。
更妙的是,团队通过 LoRA 对角色的塑造,让 A.M.N. 拥有了审讯官的“性格”——并非单一维度的冷酷,而是具备策略性的节奏控制。它会突然改变审讯方向,用上一个问题的答案反手刺出一刀;也会刻意沉默片刻,由 VoxCPM 合成一段若有似无的叹息。这种角色推进力,是靠一套极简但精准的对话策略实现的,而不是靠堆砌 prompt。这就是小模型在垂直场景里能击败大模型的秘密:它足够轻,所以可以专注于演好一个角色,而不是试图成为万物皆懂的上帝。
VoxCPM,让审讯官的声音长出了骨头
如果说 MiniCPM-o 4.5 给了 AMNESIAC 大脑,那 VoxCPM 就给了它一副令人生寒的声带。这个语音生成模型不是单纯把文本读出来,而是根据审讯语境调整语气、停顿和气声。当 A.M.N. 说“我再给你一次机会”,VoxCPM 不会机械地吐字,它会带上一丝不耐烦,甚至一点点嘲弄。这才是语音交互真正应该走的方向:不是拟人,而是服务于情境需求。
音频在整个多模态审讯中承担了一个隐藏的关键角色——计时锚点。审讯官的语音节奏会直接压迫玩家的回应窗口,玩家的每一声犹豫都变成了一次“可疑事件”。VoxCPM 的高保真低延迟,让这种语音压迫感毫无破绽。加上摄像头采集的面部信号,脉搏传感器捕捉的生理波动,整个审讯环境不再是一个聊天窗口,而是一个无法逃避的感官牢笼。面壁智能做对了一件事:他们不把语音当功能,而是当武器。
黑客松上长出来的范式,不是 PPT 里的未来
一个可玩 demo,比十页白皮书更耐磨
AMNESIAC 最让我欣赏的一点,是它并非实验室里的理论花瓶。它在黑客松上就被做成了可玩的演示,而且代码已经丢到了 HuggingFace 上。任何人拉下来就能跑,能改,能让自己的摄像头和脉搏传感器接入,看那个 A.M.N. 怎么审自己。这种“立即可玩”的交付,比任何技术白皮书都更能说明问题——因为多模态交互如果不真正让人体验,就只是纸面上的词藻堆砌。
你在 GitHub 上看到的不仅仅是一个聊天机器人 demo。它里面有面部捕获的 pipeline,有脉搏数据的适配接口,有对话管理的有限状态机和语音合成的实时调度。把这些东西拧在一起,还没有让延迟炸锅,这本身就是一种工程美。更关键的是,它给出了一个可复用的多模态角色模板。以后谁想做交互式 AI 审讯、AI 面试官、AI 心理咨询助手,拉下这个仓库,换张脸换把声音,就是一个新场景的雏形。这种从游戏出发、却指向广阔应用潜力的思维,才是黑客松该有的产研耦合。
交互式 AI 的下一个战场,是建立压迫感
行业里做交互式 AI 的,大多奔着“陪伴”和“助手”去,拼命让 AI 温柔体贴。AMNESIAC 逆向而行,选择了压迫感。这看起来是反直觉的,但恰恰踩中了人性深处最容易被调动的情绪。玩家在审讯中迸发出的表达欲和自证冲动,远远超过对着一只温暖小猫聊天的参与度。这暗示了一条岔路:未来的 AI 角色不应该只做讨好者,也应该是优秀的挑战者、拷问者、甚至对手。
面壁智能在 BuildSmall 主题下的这个选择,说明他们对“小模型+强角色”这条路线有清醒的认知。大模型也许可以模拟一切,但只有小模型能轻身钻入一个极端角色里,让体验变得锋利而不拖泥带水。AMNESIAC 的价值不在技术参数的巅峰,而在它验证了一个方向:当多模态不再只是多一种输入,而是把生理信号、对话策略、语音情绪黏合成一个不可分割的整体时,人机交互会从“功能调用”彻底滑向“心理博弈”。
最后说一句,如果你还没被 A.M.N. 审过,赶紧去 HuggingFace 上拉一份。被人冷冰冰地盯着,还得竭力证明自己是个活人——这种荒谬感,才是我们这个 AI 时代最该被玩味的东西。面壁智能这次不只是建了个仓库,他们是往整个行业里塞了一颗跳脱出框架的炸药。

