1万个AI打工88小时,把困扰数学家90年的难题给解了

0 阅读9分钟

9月8日,OpenAI在官网上扔出一篇论文,声称一个内部模型用88小时攻破了困扰数学界近90年的千禧年难题——纳维-斯托克斯方程的存在性与光滑性问题。消息发出12小时后,X平台上已经炸开了锅:有祝贺的,有质疑的,还有一群数学家在吵署名归属。

程序员 reaction:暗中观察

证据链拉满

一个88小时的证明是怎么出来的

OpenAI的公告页写得很简洁:9月1日启动项目,约一万个并发Agent协作,88小时后给出答案,再用17小时完成Lean形式化验证。整个NS专项消耗270万条消息、约1300亿输出Token;全部尝试问题合计490万条消息、约3000亿Token。

1万智能体的分工:谁在干什么

这次不是GPT-6 Astra单打独斗——那还是今年8月Theo管线发布时的角色。这次的模型OpenAI刻意没有公开名字,只说"能力远超GPT-6 Astra"。真正改变游戏规则的是协作架构:1万个Agent被组织成分组攻坚的形态,有的负责构造反例,有的负责证明解永远光滑,有的专门啃Euler方程的有限时间爆破。

中途一个意外收获改变了战局:约100个Agent花了50小时先解决了无外力Euler方程的有限时间爆破问题。这个副产品让团队临时调整策略,把资源向NS方向集中。

程序员 reaction:MeusingAlagentstocodewith

万级并发不是闹着玩的

Agent协作流水线架构

Agent协作流水线架构

分工上的关键不在于"人多",而在于"消息交换"。490万条Agent间消息是什么形态?OpenAI没细说,但业内常见做法是:每个Agent可以读论文缓存、调用符号计算库、生成LaTeX、实时编译Lean代码、还能互相质疑与反驳。这是一种研究级的交互协议,不是简单的RAG问答。

Lean形式化验证:为什么这一步比证明本身更重要

传统数学发表流程是:论文→同行评审→期刊录用。Peer review的门槛是"可信的人类阅读",但它有个固有缺陷——没人能保证评审人看全了每一个细节。

Lean的出现把验证变成了机器可检查的事务。

OpenAI这次把纳维-斯托克斯证明的Lean形式化代码开源了。更关键的是:整个证明仓库的"sorry计数"——Lean中表示"未完成证明步骤"的占位符——是零。也就是说,每一行论证都被形式化系统确认过。

大佬系列表情:或许这就是大佬吧

大佬点头

3000亿Token烧掉了多少钱

OpenAI研究负责人Mark Chen在媒体沟通会上透露,仅解决NS这道题消耗的算力成本达到"数百万美元"。按当前云算力市场均价估算,百万美元量级是合理区间。

但这笔钱花的值不值,要看跟谁比。

人类数学家攻克庞加莱猜想用了佩雷尔曼几年近乎孤绝的单人工作;NS问题悬了90年,无数聪明大脑在上面栽过跟头。这一次,AI用88小时、1万并发、数百万美元算力,给出了一个机器可验的答案。

这不是暴力破解,是并行试错+形式化收口的新范式。

程序员系列表情:我可能是个假程序员

数百万美元算力账单

纳维-斯托克斯方程到底在问什么

纳维-斯托克斯方程描述流体运动——从飞机机翼到天气预报都依赖它。克雷数学研究所2000年悬赏百万美元的版本问的是:在三维空间里,给定光滑初始条件,解是否会永远保持光滑?

答案是否定的。OpenAI构造出了一个特定的涡旋流:流体沿竖直轴螺旋向内、核心区域越旋越细,像一根不断拉长变细的意面。过程中速度在有限时间内趋于无穷,而总动能始终保持有界。

难点不在于暴力爆破,而在于让加速度、压力梯度、动量输运与粘性耗散这几项大数值精确抵消,只留下通往奇点的那条路径——这种精妙的平衡,正是过去90年人类数学家没能画出来的那一步。

程序员 reaction:向优秀程序员低头

90年的proof sketch都没过

用克雷的官方表述,这解决了千禧年问题中的备选项C和D:即推翻了"永远光滑"的猜想,并证明了有限时间爆破确实可以在光滑外力下发生。

AI解出来之后,数学界发生了什么

证明本身还在学界独立审查阶段,但署名风波已经先炸了。

纽约大学数学家Tristan Buckmaster在X上发布了一份四页声明,指控OpenAI在获悉他与Anthropic研究员Levent Alpöge已完成的相关工作后,才决定启动NS项目。他的核心意思是:你们的训练数据和前期调研,可能踩到了我们的边界。

Buckmaster同时要求把Alpöge从署名中移除,理由是他是Anthropic员工,存在利益冲突。

程序员反应图:你发誓,不改需求了

署名争议上线

数学家Buckmaster的指控

Buckmaster的研究建立在Diego Córdoba和Luis Martínez-Zoroa多年的工作基础上,并使用大量公开预印本作为起点。他认为OpenAI的系统在构造反例时走的思路与他的路线高度重合。

这不是第一次AI研究引发署名焦虑。2024年OpenAI的Theo管线用GPT-6 Astra解了十道十年未解数学题,当时学界反应是"惊喜为主";这次加上Buckmaster的指控,气氛明显不同。

OpenAI的回应与澄清

OpenAI的声明有几层:

第一,他们最初误以为Buckmaster和Alpöge也解出了NS题,后确认两人解决的是受迫Euler方程问题,并认可其在该问题上的优先权。

第二,他们强调双方证明方法存在差异,并称未直接接触对方的研究内容。

第三,他们不申领克雷百万美元奖金,将结果定位为"AI进步的快照"。

这番话是否足够平息争议?学界仍在观察。核心问题是:AI的训练数据里有没有Buckmaster团队的公开预印本?如果有,算不算"间接引用"?这目前没有明确的学术伦理框架可以裁定。

程序员 reaction:你在搞笑吗

这锅到底谁背

这件事真正意味着什么

把时间线拉长来看,NS证明的真正信号不是"AI打败了数学家",而是科学研究的工作单元正在发生变化。

OpenAI自己说的一句判断很精准:AI科学正在从单模型答题转向大规模并行探索与机器可检验收口——门槛由"能不能给出答案"移向"答案的来路能否追溯、能否被独立检查"。

这背后有两层含义。

第一层是工程上的。1万个Agent在88小时内产生270万条消息,这种规模的消息交换和协同筛选,是人类单个课题组做不到也耗不起的。形式化验证把论证钉死在机器可检查的层面上,减少了"漏看细节"的灰色地带。

第二层是认识论上的。90年未解的难题,人类数学家集体碰壁,AI用一种非人类直觉的方式给出了路径。这不意味着人类智力被超越——它意味着复杂系统的探索空间太大,单兵作战的天花板太低,而并行试错+机器收口是新的可行路径。

大佬系列表情:My dear dalao please daidaiwo

并行试错是新范式

当然也有边界需要说清楚。OpenAI的证明目前仍在独立审查中;署名争议未解决;训练数据边界问题没有答案。这些都不是否定AI能力的理由,而是科学共同体正常的工作节奏。

可以今天就做的三件事:

  1. 去OpenAI GitHub上拉一下NS证明的Lean代码,看一眼"sorry计数为零"是什么意思——这不是营销文案,是可执行的事实。
  2. 跟踪Buckmaster的后续声明,署名争议短期内不会有结论,但学术伦理框架会因此被推动。
  3. 如果你在做AI科研工具,把"形式化验证+并行Agent"加入你的技术雷达——这不是风口,是工作流的结构性迁移。

程序员 reaction:呦!这个nice!

胜利但争议未了

程序员 reaction:DLSS5Off

千禧年难题终于被撕开了一道口子

参考文献

[1] OpenAI官宣:88小时攻破千禧年难题!_搜狐网. m.sohu.com/a/107360231… [2] OpenAI官宣:88小时攻破千禧年难题!_Agent_问题_斯托克斯. www.sohu.com/a/107360231… [3] OpenAI官宣:88小时攻破千禧年难题!|Agent|庞加莱|BEC|纳维-斯托克斯|克雷_新浪新闻. k.sina.com.cn/article_595… [4] OpenAI官宣88小时突破NS方程千禧年难题. zhuanlan.zhihu.com/p/208096329… [5] OpenAI公布纳维–斯托克斯千禧年难题解答,并公开Lean形式化证明 — TradingView News. www.tradingview.com/news/panews… [6] OpenAI 宣称解出纳维–斯托克斯难题:AI 科学真正稀缺的是证明的来路 - 花花世界. shuweiyue.com/ai/viewpoin… [7] OpenAI 称破解千禧年难题却引学者抗议:1万个智能体88小时给出纳维-斯托克斯解答|数学家|openai_网易订阅. www.163.com/dy/article/… [8] Phoenix Yin on X: "今天是历史性的一天。 就在今天,美国时间9月8日,OpenAI 宣布用内部模型解决了纳维-斯托克斯存在性与光滑性问题,并且证明的方向是存在有限时间爆破。 千禧年七大难题里,纳维-斯托克斯问的是:给一个光滑的初始流场,这个方程的解是否永远保持光滑?还是会在某个有限时间内速度变成无穷大? OpenAI 这次的答案是后者。 他们的系统给出了一个解析证明和 Lean 形式化验证,证明初始完全光滑、能量有限、受到光滑外力作用的流体,可以在有限时间内发展出奇点。 奇点的具体形态是一个不断向内螺旋、同时被轴向拉伸的涡旋,像意大利面一样越缩越细,越转越快,速度趋于… / X. x.com/i/status/20…