ARTICLE · 1157131
陶哲轩急了?——AI做数学,动了数学界最后的奶酪
竞技场被拆掉了,赛道不存在了, 这个赛道上的优胜者道心破碎,心神恍惚。。。
2026年9月8日,OpenAI宣布:他们的内部AI模型用88小时,跑通了纳维-斯托克斯方程的形式化证明。这是克雷数学研究所七大“千禧年大奖难题”之一,悬赏100万美元,困扰了数学家近百年。
按理说,难题被解决,最高兴的应该是数学家。但三天后,25位菲尔兹奖得主联名发表公开声明,标题叫《人工智能在数学中的严重错位》,领头人之一,是陶哲轩。
这事本身已经够魔幻了——世界上最聪明的一群人,对着一个“解决了世纪难题”的成果,集体说:不,你们不该这么做。
更魔幻的是陶哲轩本人。半年前,他还是数学界最积极拥抱AI的人。2026年3月,他在IPAM会议上公开呼吁同行别太死板,说AI在数学和理论物理领域已经“ready for primetime”。他用GPT-5 Pro挑战一个三年没人解决的微分几何问题,11分钟就出了完整证明。他还预测过,“到2026年,AI将成为数学研究值得信赖的合著者”。
三个月后,他的原话变成了:“简直是疯了。AI公司无休止地加速,却对那之后会发生什么一无所知。必须慢下来。”
一个最拥抱AI的数学家,变成了最激烈的批判者。中间发生了什么?
一件事,把火药桶点着了
9月的公开信只是开始, 真正让事态升级的,是10月6日。
OpenAI在GitHub上一次性放出了722篇由内部模型生成的数学手稿,涵盖372个结果系列,涉及乘法函数、黎曼zeta函数零点区域、海勒猜想、霍奇猜想等多个前沿方向。
不是722页,而是722篇前沿数学论文 !
其中只有162篇的主要结果经过了Lean形式化验证。OpenAI自己在GitHub仓库的README里写了一句大实话:“一些未形式化的结果可能存在问题。”结果发布第二天,就撤回了3篇——因为一处符号错误引发了连锁反应。
但这还不是最让数学家愤怒的地方。
理论计算机科学家Dana Moshkovitz,一辈子研究“唯一博弈猜想”。当她打开OpenAI发布的文档时,发现这个猜想赫然写在其中,已被“证明”。但仔细一看,论文充斥着混乱、逻辑跳跃、人类从未见过的诡异构造。她的评价是:“像是吃了致幻剂的人写出来的东西。”
没有同行评审,没有可读的人类逻辑,没有对前人工作的引用和尊重。
700多篇这样的东西,一股脑砸在数学界脸上。
陶哲轩把这件事比喻成:“把生肉的尸体倒在我们村的公共餐桌上,说‘给你,我解决了你的食物问题’,然后就走了。”
他到底在骂什么 ?
陶哲轩的批评集中在三个层面。
第一,AI公司只管生成,不管消化。他说数学知识要走完五个阶段才算真正成立:创造、检查、解释、接受、消化。而AI公司只做前两个——把证明扔出来,后面的理解、教学、吸收全甩给数学界。他把这个叫“证明消化不良”:AI能高速生成命题、证明和反例,人类却来不及验证、理解、写作、教学和吸收,结果是大量无人能消化的证明堆积在那里。
第二,数学的价值不在答案。他用了一个比喻:未解决的数学问题就像灯塔。大多数人出海不是为了抵达灯塔,但灯塔照亮了整片海域。研究中产生的工具、理论框架、洞见,才是真正宝贵的东西。
第三,不可逆污染。他说问题一旦被公开“解决”,就几乎无法恢复为“未解决”状态,即便后来有人想寻找不同路径,选择空间也已经收窄了。
听着有道理。但这三条背后有一个共同预设:数学知识的生产有“正确”的节奏,这个节奏由数学共同体几百年实践确立,AI公司正在粗暴地打断它。
所以陶哲轩真正在意的,不是AI能不能做数学。他在意的是AI做数学的方式和速度。
“消化不良”这个词,藏着一个矛盾
陶哲轩用“消化不良”来描述AI批量生产证明的现象, 但这个词本身就有问题。
数学史上从来不缺“消化不良”。
怀尔斯1994年证明了费马大定理,正式发表又花了整整五年,中间还补过一次关键漏洞。佩雷尔曼2002到2003年发布庞加莱猜想的证明,数学界消化了三年才敢说“对了”。望月新一的abc猜想证明,争议吵了十几年,到现在还有人没咽下去。
这些“消化不良”从来没被叫过“污染”。因为当问题足够重要、证明者足够有分量的时候,慢,就叫“严谨”。
那为什么AI把“消化不良”从几年压缩到几周,它就成了“不可逆的污染”?
说白了,陶哲轩不是不喜欢慢, 他是不喜欢“别人替他快”。
真正的问题是:谁说了算 ?
陶哲轩反复用“数学共同体”这个词。他说AI公司“对数学共同体有害”,呼吁“回归以人类理解为核心的研究方式”。
但“数学共同体”从来就不是一个团结和谐的村子。
高斯当年发现非欧几何,压着不发,怕“引发比斯瓦比亚人的叫嚣”。布劳威尔和希尔伯特围绕数学基础吵了一辈子,把整个数学界撕成两半。这些人都属于“数学共同体”,可他们的意见从来就没统一过。
在这个江湖里,“理解”是通行证。你能不能进这个圈子,不光看你证了什么,更看你能不能讲清楚这个东西为什么重要、它跟已有知识怎么连接、它打开了什么新问题。这种“讲清楚”的能力,是数学界几百年攒下来的文化资本,也是圈内人身份的核心标识。
AI公司现在干的事,是把这套积累机制绕过去了。AI不需要“理解”一个证明的意义,它只需要生成一个逻辑上有效的证明。当这种证明以小时为单位往外冒的时候,数学界赖以维持权威的“理解垄断权”,就开始松动了。
陶哲轩的“消化不良”,翻译过来就是:消化是我的工作。你生产得太快,我消化不了。
这与其说是在担心数学真理,不如说是在担心数学共同体在知识生产链条里被边缘化。
陶哲轩自己其实也清楚。他承认数学的传统评价体系“仍适配人类主导模式”,而AI辅助成果的认定规范“尚未完善”。他真正害怕的,不是AI证明定理的速度,而是数学正在逐渐失去“由数学家来定义什么叫可靠理由”的权力。
这不是技术判断, 这是地盘意识。
换个角度看:AlphaGo也不解释
前OpenAI后训练副总裁Liam Fedus回应过陶哲轩。他赞同陶哲轩对“理解”的重视,但提了一个关键的反驳:你不能用今天AI的能力边界去框定它以后的样子。如果AI的训练目标从“把题做对”扩展到“解释为什么、提炼方法、帮人理解”,它以后可能既是答案提供者,也是思路提供者。
他还举了一个例子:AlphaGo。
AlphaGo不会解释自己为什么下那步棋。但人类棋手研究它的棋谱和胜率,水平实打实地提高了。
理解不一定非得由发现者提供。理解可以发生在接收者那一端。
陶哲轩的“生肉”比喻,还忽略了一件事:数学史上很多突破,最初也是“生肉”。拉马努金写给哈代的那些公式,当时有几个能严格证明的?哈代花了几年才部分搞明白它们的意思。但没人说拉马努金“污染”了数学。
最后说两句
陶哲轩骂OpenAI,不是完全没道理。OpenAI一次性扔出722篇手稿,只有162篇做了形式化验证,第二天就撤了3篇,这吃相确实难看。商业营销冲击学术规范,算力霸权取代同行评审,这些都该骂。
但骂AI公司的商业行为,和骂AI的数学能力,是两码事。
陶哲轩在这两者之间滑来滑去。他骂“营销叙事”的时候,站得住脚。他暗示AI的数学成果因为“缺乏理解”所以价值有限的时候,就有点不讲理了。
数学的价值在于可靠的真理,不在于获取真理的方式。如果AI能生成可验证的数学真理,那“谁理解了它”和“谁多快发现了它”,在真理面前是次要的。
陶哲轩在给一个正在消失的秩序唱挽歌。那首歌的名字叫“理解”。
但挽歌改变不了一件事:奶酪已经动了。