七百多份 AI 生成的数学证明文件一次性倒进公共视野,数学界没鼓掌,直接翻脸。AHM 组织在陶哲轩主持下发表声明,公开呼吁抵制 OpenAI,措辞不留情面:这是展示力量,不是学术行为。
OpenAI 给出的数字确实扎眼。内部模型一个月内解决逾 100 个开放数学问题;约 8000 道测试题的成功率约 5%,平均每题消耗 3 小时 GPT-Pro 级算力。5% 听起来寒酸,可放在开放问题上就是另一回事——那些是人类数学家几年都未必挪得动的硬骨头。问题也恰恰在这里。数学证明的价值不只在“做出来”,更在于能被同行读懂、复现、检验。批量投放未经充分评议的结果,等于把评审负担整体甩给整个领域,而署名、归属与责任链条却含糊不清。
抵制的靶心,其实是学术秩序,不是技术本身。用 AI 做数学早已不新鲜,陶哲轩自己就长期主张把它当协作伙伴。但当一家公司凭算力和发布节奏改写同行评议的排队规则时,争论就从“AI 能不能做数学”滑向“谁有权决定数学该怎么做”。这场冲突多半不会以抵制收场,它会留下一个更难回答的问题:当天才变得可批量生产,数学界拿什么标准去判断,什么才算数。

