【1万个Agent花88小时攻克千禧年难题】OpenAI下一代模型攻克千禧年难题 数学史级别的大新闻,愣是被OpenAI整成了一出连续剧。刚被数学家指控抢成果,OpenAI紧急官宣:一个尚未发布、能力显著超过GPT-6 Astra的内部模型,已经解决了纳维–斯托克斯存在性与光滑性问题。OpenAI宣布攻克千禧年难题
这是悬赏100万美元的七大千禧年难题之一,之前只有庞加莱猜想成功下榜。现在,OpenAI宣布第二道也被拿下了。陈立杰表示今年年初加入OpenAI时他还预测AI在2028年能解决千禧年难题,没想到进度条直接被AI拽飞了——5月破一个,9月一次破俩。
而且吧,OpenAI话里话外还剧透了下一代模型:真正完成证明的不是GPT-6,是OpenAI一个仍在训练中的内部模型,能力比刚发布没几天的Astra还要更更更强。Astra这次只能排在后面,负责检查作业。
为了做出这道题,OpenAI直接摇来约1万个Agent,并行工作88小时,发出270万条消息,消耗了约1300亿输出Token。Agent写完证明之后,GPT-6 Astra又跑了17小时,将整份证明形式化成Lean版本,逐步检查里面有没有漏洞。
全程总计产生490万条Agent消息和约*3000亿输出Token,其中纳维–斯托克斯一题就吃掉了1300亿Token。OpenAI还透露,这次实验花费了数百万美元。
这事儿吧,其实还有一个问题,OpenAI解决的真是大家平时理解的那道纳维–斯托克斯难题吗——算是吧,但又不完全是。
OpenAI证明的并非是核心的问题,“没有外力时,流体自己会不会爆”。它证明的是,在施加一个精心构造、但始终保持平滑的外力之后,流体会在有限时间内形成奇点。从克雷研究所公布的正式题面来看,C和D两种情况确实允许存在平滑外力。所以,只要证明最终经受住数学界检验,OpenAI确实完成了题目白纸黑字写下的要求。
这点没法硬说人家不算。但过去几十年,数学家真正关心的核心版本,通常是无外力情况下,三维纳维–斯托克斯方程能否自己形成奇点。于是现在的局面就有点微妙了。
按照官方题面,OpenAI可能已经通关;但按照大家脑海里默认的终极版本,它打的又不完全是同一个Boss。只能说,大家通常讨论的无外力纳维–斯托克斯正则性问题,还没有大结局。但不管这场争议最后怎么收场,OpenAI展示出来的能力还是有点吓人,甚至已经开始和数学家抢时间了。
数学界那么多悬赏,还有多少会变成AI的电费呢?(量子位)
