AI推翻80年数学猜想,菲尔兹奖得主一夜没睡:以为要出局

新智元·2026年08月07日 16:05
AI连破数学难题,数学家称价值仍在人类理解

过去三个月,AI在数学界连干了三件几十年没人干成的事。

5月,OpenAI一个还没公开的内部模型,推翻了埃尔德什1946年提出的单位距离猜想。

这道题悬了整整80年,普林斯顿的Noga Alon说它「大概是离散几何里最有名的问题」。

7月,Anthropic研究员Levent Alpöge发推,称Claude Fable找到了雅可比猜想(Jacobian conjecture)在高维的一个反例。

8月,OpenAI一口气公布了内部版Astra在数学和理论计算机科学上的十项进展,从高维球堆积、群论到格密码学。

跑出这些结果所消耗的token,按Sol的API价算,总共大约2000美元。

更狠的是,不到24小时,Levent又宣布,用已经公开的Fable复现了这10项里的5项。

数学,就快要被AI解决了?

菲尔茨奖得主Timothy Gowers,第一次听说单位距离被AI攻破的那天下午,他脑子里冒出来的第一个念头就是:完了,数学家是不是很快就要出局了。

那一整晚,他都在重新调整自己的世界观。

直到第二天早上他才弄明白,模型是推翻了这个猜想,不是证明了它,终于长舒一口气。

AI连闯「无人区」,20多位数学家却很淡定

带着「数学家该有多慌」的预期,Understanding AI的记者Kai Williams,在费城的ICM大会上,当面问了20多位数学家。

让他十分意外的是,很多人至少在短期内是乐观的。

这些人里,不少已经把AI用进了日常研究,只是用得相当克制。

布兰迪斯的博士生Neckrasov每月花200美元用Codex,检索文献、填补证明里的缺口、审自己的论文稿。

但他有条铁律:哪怕是让AI去证一个东西,动手前,整个项目的图景也得先在他脑子里成形:AI是帮他把想法跑得更快,不是替他想。

另一位数学家Castillo-Ramirez,用ChatGPT构造出一个满足特殊条件的元胞自动机实例,这只是他一个更大项目里的一块拼图。

刚拿到本届菲尔兹奖的邓煜,认为AI会帮数学家,而不是取代他们:

未来可能是数学家提出新理论、新框架,AI去做那些技术细节。AI会变强,但到那时,我们会重新定义什么叫技术细节。

2026年7月23日费城,本届四位菲尔兹奖得主同台,左起分别为邓煜、John Pardon、Jacob Tsimerman、王虹。邓煜认为,AI会帮数学家、而不是取代他们。

这套逻辑,数学家其实很熟。

计算器出现后,心算不再算「研究」;证明助手成熟后,一部分验算也交给了机器。

每次机器往前吃下一块,人类就往它还够不着的地方挪一步。

按照这个逻辑推演,假如AI就停在今天这个水平,数学这门行当的骨架不会变。

人类只要退到AI不擅长的地方,想出新点子,再用AI去加速那些重复劳动。

这种情况下,不用害怕AI。

因为眼下,它还只是一把更快的铲子。

可问题是,AI大概率不会停在今天。

Epoch AI专门做能力评测的Greg Burnham提醒道:很多人聊AI,容易只盯着「它现在能干什么」,却不去想能力的轨迹会往哪走。

AI也许会撞上一堵墙,再也造不出全新的理论;也可能随着训练规模继续往上爬,做出真正原创的数学。就现在的证据看,两种可能都排除不掉。

这里有一个数据不太好反驳。

今年5月28日,一项叫First Proof的独立评测,在受控条件下拿10道没公开过的研究级新题去考4套AI系统,专家按正确性和表达质量评审。

结果,10道里有7道,至少被一套系统做到了可发表的水平。

数学进入「证明过剩」时代

AI做数学到底有多强?

7月24日,陶哲轩在ICM大会做了场公开演讲。

台下坐满同行,等着听他回答那个所有人都在问的问题:AI,到底能不能做数学?

陶哲轩把问题放在了「数学界应该保护什么」上。

他先假设AI很快就能完成相当一部分研究级的数学工作,然后把一个数学成果的「一生」拆成了六步:

生成证明、验证正确、清楚写明白、正式发表、被同行消化,最后正典化,写进教材,成为这个领域的定论。

一道题从「开放问题」走到「定论」,要闯过生成、验证、阐释、发表、消化、正典化六道关,AI真正提速的只有最前面两道。

在这六步中,AI能瞬间加速的,是前两步。后面四步,慢,而且极度依赖人。

失衡正出现在这里。

陶哲轩说,我们已经非常非常接近这样一个场景:一个重大结果被证明出来、也被验证是对的,但没有任何人能理解它、解释它。

陶哲轩管这叫「证明消化不良」。

erdosproblems.com上已经堆了几十份AI生成的证明,很多大概是对的,但还没有哪位专家愿意站出来,逐一核验、背书。

陶哲轩给这个转变起了个名字:数学正在从「证明稀缺」的时代,走进「证明过剩」的时代。

过剩之后,还剩什么

陶哲轩的演讲,其实是在逼所有人回到一个更根本的问题上:数学家做研究,到底是为了什么?

7月ICM大会,陶哲轩在演讲中列出数学家做研究的多个理由,远不止「解题」一项。

他在台上列了连串目标:解开难题、建立新理论、理解世界、维系一个数学家共同体、培养下一代、给人类的知识网络添砖加瓦、留下有美感的作品……

过去,这些目标是一致的。

解开一道难题,往往顺带就把理论建了、把共同体也凝聚了。

所以大家默契地只盯着「解题」这一个,拿它当所有目标的替身。

但AI擅长的,恰恰是这一个。

一旦所有人都冲着「多解题、抢第一」使劲,其他目标就会被甩开。

陶哲轩还提到了古德哈特定律(Goodhart's law):一个指标一旦变成目标,它就不再是好指标。

过剩之后是什么,两个数学家给了两种截然相反的想象。

Gowers是悲观的那个。

他担心数学的文献会疯狂膨胀,却没有一群人真正共享着对它的理解,大部分数学会变得像今天那些没人再读的旧论文,躺在几十年前的纸堆里。

这不是危言耸听,数学史上,真发生过类似的事。

Thurston提过自己早年的一段经历:

那时他在叶状结构这个领域一口气证出一串漂亮定理,可他证得太快、又讲不清背后的想法,结果同行一个个撤走,整个子领域塌掉了。

他后来悟到:「我原以为人们想要的是答案。那只是故事的一部分。比起知识,人们更想要的是亲身的理解。」

风险就在这儿:如果AI证出一堆重要结果,方式却是人类看不懂的,大家还有什么动力去深挖数学?

年轻人没了可做的事,这门手艺就传不下去,人类会慢慢忘掉自己本来懂的那些理论。

多伦多的Daniel Litt站在乐观的一边。

他设想过一座极端的图书馆,里面藏着每一条定理的证明,还配了能带你找到答案、给你讲明白的向导。

数学家在这样一座图书馆里会干嘛?

Litt说他们会兴奋到发疯,然后立刻开工,一个个问出那些憋了很久的问题:

黎曼猜想怎么证?霍奇猜想怎么证?还有自己那个念念不忘的猜想,又该怎么证?

要干的活儿一点没少,还远没有结束。

说到底,「解出答案」从来只是数学众多目标里的一个。

AI改变的,是我们该去追求哪些价值,它没改变人类一开始为什么要做数学。

数学家David Bessis认为,数学家不可能仍沿用旧的做数学的方式,一定会有新的东西冒出来。

虽然不知道这个新东西会长什么样,但他确信人类会一直做下去某种很像数学的事情。

我们仍然想理解这个世界,我们仍然想理解数学。

答案会过剩,但人类的理解永远不会。

参考资料:

https://www.understandingai.org/p/mathematicians-are-grappling-with 

https://teorth.github.io/tao-web/slides/age-of-ai-icm-2026.pdf 

本文来自微信公众号“新智元”,作者:ASI启示录;编辑:元宇,36氪经授权发布。

+1
2

好文章,需要你的鼓励

参与评论
评论千万条,友善第一条
后参与讨论
提交评论0/1000

36氪AI测评

选靠谱AI,看真实评测
查看
36氪AI测评官方交流社区
加入

36氪项目推荐

咨询项目审核和入驻
联系
36氪项目推荐订阅号
关注

下一篇

黎曼动力联合两家企业,共建百万小时具身智能数据闭环

1小时前

36氪APP让一部分人先看到未来
36氪
鲸准
氪空间

推送和解读前沿、有料的科技创投资讯

一级市场金融信息和系统服务提供商

聚焦全球优秀创业者,项目融资率接近97%,领跑行业