【协和医院医生攻克22年数学难题】AI跑了16小时证明22年未解数学猜想 “我很满意,我的猜想已成为定理。”8月20日,法国雷恩大学雷恩数学研究所荣休教授米歇尔·克鲁泽在给的邮件中写道。22年前,他提出了以自己名字命名的猜想。
今年夏天,围绕克鲁泽猜想,三篇声称运用AI完成证明的预印本论文接连公开。最早的一篇来自北京协和医院神经外科住院医师、博士后金山木。7月27日,他公开首版论文,供同行阅读和核验。
过去一年,美国康奈尔大学数学系副教授亚历克斯·汤森德常让ChatGPT尝试证明这一猜想。汤森德在接受采访时说,有时大模型会给出一套看似完整的论证,但继续检查却能发现错误;有时则停在某个关键步骤。
7月30日,汤森德像往常一样又试了一次。那次,ChatGPT搜索互联网后,把金山木的论文链接发给了他,并称没从中找到任何错误。汤森德说,初步浏览没有发现明显问题后,他开始仔细核验其中的数学论证。
随后,美国华盛顿大学应用数学系荣休教授安妮·格林鲍姆、克鲁泽等也从头检查了这一证明。多名接受采访的数学家表示,经过独立核验,他们均认为这项证明成立。
金山木在首版论文中就写明,ChatGPT提出了一项关键做法,通过改变计算中的取值和结果的组合方式,让原本论证中难以处理的部分恰好抵消。汤森德认为,这一步是证明成立的关键。
克鲁泽猜想研究的对象是矩阵。矩阵就是按行列排好的一组数,可以将其想象为一台对数字批量处理的“超级计算器”。克鲁泽猜想想解决一个问题:按照说明书,无论你怎么操作,这一“超级计算器”最终结果的“规模”,最多不会超过操作过程中可能出现的最大“规模”的两倍。
汤森德和格林鲍姆在一篇拟发表于美国工业与应用数学学会主办的新闻刊物SIAM News的评论中写道,金山木以OpenAI解另一个数学猜想的提示语为基础,改写后交给ChatGPT作为任务说明。任务说明显示,在运行中,GPT-5.6 Sol被设定为不能联网,也不能读取过往对话、其他项目内容或本地文件。模型被要求探索多条证明路线,反复检查证明是否存在漏洞,只有形成完整证明并通过检查,任务才能结束。
证明开启后,金山木没有中途干预。“金山木告诉我,ChatGPT最终给出证明的那次运行持续了16个小时。”汤森德向表示。不过,他并不清楚ChatGPT运行过程中的具体细节。就此,本刊记者多次联系金山木采访,均被婉拒。
英国雷丁大学数学与统计系博士后研究员瑞安·奥洛克林从2021年起研究克鲁泽猜想。8月23日,他与线上视频连线时,用一幅拼图形容这次突破。他认为,假如完整的克鲁泽猜想证明由十块拼图组成,过去多年相关研究已拼好了九块,如今AI补上了最后一块。克鲁泽直言,这次突破主要归于AI。不过,他也强调,金山木理解了这一猜想。看完金山木的证明后,奥洛克林意识到,研究者此前已离答案很近。他说,即使没有AI,他预计这一猜想也可能在5年内得到证实。(内容来自)