OpenAI 内部正为一个叫 Astra 的模型兴奋不已,原因是它解起数学题来像个天才。但认知科学家 Gary Marcus 直接泼了盆冷水:这叫 合成谬误——把单科高分当成全能学霸。你以为它能搞定所有科学,甚至包揽一切认知任务?醒醒,那只是数学题给了你幻觉。Marcus 把话挑得很明,别急着把擅长某类数学推理,当成通往通用智能的通行证。
数学之所以屡屡成为大模型炫技的舞台,并不神秘。它的规则封闭,证明可以靠符号工具机械验证,对错一目了然。更重要的是,题目和推导链条几乎能无成本地生成海量 合成数据,要多少有多少。OpenAI 没透露 Astra 的具体方法,但 Marcus 的判断直抵核心:只要你有无限可再生的训练素材,模型就能在棋盘规则的领域里越滚越强。这更像一场精心设计的闭环游戏,而不是智能的全面觉醒。
可真实世界不给你这份特权。开放问题没有标准答案,无法自动批改,更无法廉价的批量制造“经验”。一旦跨出数学的围墙,那些让 Astra 耀眼的优势立刻失效。Marcus 提醒得狠:在 Open AI 公布方法细节之前,我们连这到底算不算真正的进步都无从判断。一切欢呼,都太早了。

