群发资讯网

当数学圣杯被一万个 AI 用 88 小时尝试攻克(该证明仍等待数学界同行核验),

当数学圣杯被一万个 AI 用 88 小时尝试攻克(该证明仍等待数学界同行核验),很多人开始讨论:人类历史上最公平的 “纯智力赛道”,是否正在迎来巨变。

2026 年 9 月 8 日,OpenAI 扔出一枚炸弹。

一个未公开的内部 AI 模型,调动了大约一万个智能体并行工作。耗时 88 小时,交出了纳维 - 斯托克斯方程存在性与光滑性问题的完整证明。再用 17 小时完成 Lean 形式化验证。

这道题什么分量?2000 年克莱数学研究所列出的七大 “千禧年大奖难题” 之一,悬赏一百万美元。九十多年没人啃下来。描述流体运动的方程,在一切情况下是否永远平顺,还是会突然 “炸” 出数学奇点。OpenAI 称这份证明显示,流体确实会在有限时间内形成奇点。

一万个智能体,88 小时,拿出了一份人类顶尖数学家苦战近一个世纪难题的证明,目前有待学界核验。

同年 8 月,Anthropic 的研究版 Claude 向黎曼猜想发起冲击。黎曼猜想,另一个千禧年问题,另一个一百万美元悬赏。1859 年提出,一百五十多年没人拿下。

Claude 没完全证明,但它把黎曼 ζ 函数满足猜想的零点比例下界,从数学家苦苦追了五十年的 41.6%,一把推到 67.2%。一个内部员工 —— 还不是数学家 —— 向模型发出指令,要求它 “认真尝试”。

接下来 36 小时,Claude 测试了 650 种思路,调动 60 个子智能体分工协作,消耗 3100 万 token 的计算资源。2 个子智能体开发核心思路,13 个提供辅助想法,13 个负责验证,最后 2 个协助撰写论文。整个过程中,那个员工不断鼓励 Claude “继续干”“相信自己”。

一个非数学家,指挥一群 AI 智能体,把数学史上最硬的骨头啃下了一大块。

同一个月,Anthropic 的 Claude 进阶版模型,首次把安德鲁・怀尔斯已经完成的费马大定理人类证明,转化为计算机可验证的代码。

11 天,完成了一个人类预计需要 10 年才能完成的项目。罗格斯大学数论学家 Alex Kontorovich 说,一台机器能把人类数学家的工作变成 1300 万行铁板钉钉的证明,“彻底震撼了我”。

多伦多大学数论学家 Daniel Litt 说得更直接:“如果它能形式化验证费马大定理,那么它大概就能形式化验证很多东西。”

今年 2 月,AI 已经形式化验证了玛丽娜・维亚佐夫斯卡获得 2022 年菲尔兹奖的球体堆积成果。今年 7 月,AI 首次拿下国际数学奥林匹克官方满分金牌。今年 9 月,OpenAI 研究员苏炜杰借助 AI,把孪生素数领域素数间隔距离的上界降到了 186。

黎曼猜想、纳维 - 斯托克斯、费马大定理、孪生素数、IMO 满分。

这些名字放在一起,就是人类数学智力巅峰的完整清单。一年之内,AI 把它们挨个撬了一遍。

AI 的数学能力正以惊人速度迭代,2025 年它拿下 IMO 银牌、攻克竞赛难题,2026 年便斩获 IMO 满分金牌、进军黎曼猜想、纳维 - 斯托克斯等千禧年难题,进化速度远超人类。

不同于人类数学家依靠天赋、灵感与长期积累钻研求证,AI 依托海量文献、逻辑推演和大规模算力,以一万个智能体并行运转的模式,仅需 88 小时就能试错推演、整合可行结论,彻底颠覆了传统数学研究模式。

数学曾是人类最公平的智力赛道,无需设备资源,仅凭脑力与天赋,贫寒天才也能突围,奥数、菲尔兹奖体系也依托这份纯粹的智力公平被世人认可。而如今赛道规则被改写,数学比拼不再局限于脑力天赋,转而比拼 GPU 算力、预算资源,公平性壁垒开始松动。

AI 介入也引发学术体系争议,纳维 - 斯托克斯难题研究出现多方算力竞速,学术研究的优先权、署名权、归属权体系遭受冲击。众多数学家担忧 AI 会瓦解数学领域的核心价值,认为数学证明应归属具体研究者,但也有学者认为这一变革并无大碍。

不可否认,传统纯智力数学赛道已然巨变。往后数学竞争,天赋、灵感、积累不再是唯一标准,算力成本成为全新门槛。曾经仅凭纸笔与天赋逆袭的数学浪漫与公平性逐渐消逝,数学本身未变,但数学家的研究模式与行业生态,已被 AI 彻底重塑。

参考信息:红星新闻. (2026, 9 9). OpenAI 宣布:用约 1 万个智能体 88 小时解决人类 90 年数学难题,计算成本达数百万美元,放弃申领 100 万美元悬赏奖金。澎湃新闻.