用时1.5天,Claude突破了黎曼猜想的新纪录

0 阅读5分钟

讲真的!AI在数学界的突破真是越来越随意了。

事情的起因很随意,8天前 Anthropic 员工 Jarred Sumner 在跑步时,给一个尚未发布的研究版 Claude 提出一项“不合理挑战”:认真攻一下黎曼猜想。

image.png Claude的推理过程经过约 650 个思路失败、60 个子代理接力、一天半时间的连续推导,虽然黎曼猜想是没证明出来,但模型却顺手把一项与黎曼猜想直接相关的下界纪录,从 41.6% 抬高到 67.2%。

8月11日Anthropic 在官网公开了论文、过程记录和形式化证明。

image.png

让人想不到的是Anthropic这名员工 Jarred Sumner 不是数学家,16岁辍学,和Claude的交流大多是"继续推进"和"相信自己的"的鼓励式对话。

image.png

这一下让我好奇黎曼猜想难到什么程度?抬高底线有什么说法?

◈困住 167 年,Claude 抬高底线

黎曼猜想是数学界最有名的难题之一。

克莱数学研究所把它列进七个千禧年问题,悬赏 100 万美元,至今只有一个问题被解决。

image.png

黎曼猜想从 1859 年提出,到今天已经 167 年。其间无数数学家尝试解决,都没能做到。

了解黎曼猜想前,我们先把这几个词掌握。

素数看起来忽远忽近,2、3、5、7 之后跳到 11,再跳到 13。

黎曼 zeta 函数把素数分布的信息装进一个复数函数里。这个函数等于 0 的特殊位置,就是“零点”。

其中真正牵动黎曼猜想的那批,叫非平凡零点。

image.png

黎曼猜想说:这些非平凡零点,一个都不能跑偏,必须全部站在实部为 1/2 的临界线上。

这像数学家在无边无际的夜空里拉出一根极细的钢丝,然后断言:所有关键星星都钉在这根线上。

数学家至今没法证明“所有”。

于是他们先退一步:至少能证明多少比例的零点在线上?

1914 年,Hardy 证明临界线上有无穷多个零点。1942 年,Selberg 证明在线上的零点占正比例。1974 年,Levinson 把明确下界推到三分之一。1989 年,Brian Conrey 推过五分之二。到 2020 年,Kyle Pratt、Nicolas Robles、Alexandru Zaharescu 和 Dirk Zeindler 把纪录推到略高于 5/12,也就是约 41.67%。

然后,这个数字停了约 6 年。

直到这次Claude 给出的结果,是 67.25%。相比此前纪录,一口气提高约 25.58 个百分点。

当然67.2% 不是黎曼猜想的“完成度”。剩下的 32.8% 只是这套论证尚未分类的部分,不代表它们不在临界线上。Anthropic 也明确表示,不预期这套技巧直接通向 100%。

◈Claude的疯狂推理

Jarred 第一次让 Claude 尝试时,模型一口气生成并试验了约 650 个思路。

一个都没成。

正常情况下这里已经可以结束了。Claude 自己也知道黎曼猜想有多难,也一度怀疑自己不可能取得有意义的进展。

Jarred 没有放弃,只让它再试一次。

第二轮,Claude 不再像一个人坐在桌前死磕。它在 Claude Code 里协调约 60 个子代理,把任务拆成找思路、做计算、查反例、审证明和写论文。

image.png 60 个子代理中,只有 2 个发展出了关键数学想法;13 个提供辅助思路;30 个尝试新方向但没走通;13 个负责验证;最后 2 个帮助整理初始论文。

一半子代理都失败了。

一天半的时间,这支 Claude 队伍跑了约 2400 条 shell 命令,写了数百个 Python 脚本,对已知 zeta 零点做了数千次数值检查。找到结果后,它们继续寻找反例、让不同子代理从头重证,还下载了 54 篇 arXiv 论文检查相关结果是否已经出现。

两次会话合计消耗 3100 万输出 token。

最后,Claude 主动把结果写成论文。

Jarred 这一轮基本没插手,他的干预只剩下发鼓励消息:「继续」「相信你自己」。

◈论文一交出,四位数学家接手

开放问题最不缺的,就是“我证明了”。

Anthropic 内部数学家 Levent Alpöge 和 Ralph Furman 研究并验证了 Claude 的论文,还写了一份由人类专家简化的证明说明。

两位外部数论专家 Brian Conrey 和 Dan Goldston,也在临时收到论文后迅速查看了结果。

image.png

Conrey 曾在 1989 年把相关下界推过五分之二;Goldston 参与了 Claude 这次依赖的前置研究。

Claude 还与 Anthropic 员工 Eric Easley 合作,把论文中的结果写成 Lean 形式化证明。公开仓库称,这套代码没有留下 sorry 这样的未证明占位符,并通过了标准验证工具 comparator。

image.png

comparator会检查提交的证明,是否真的对应预先给定的定理陈述,而不是悄悄换了一道更容易的题。

这一切已经让这项成果拥有一条远强于普通 AI 演示的证据链。

这次突破不是 Claude 凭空造出来的。

Jarred 自己在帖子里写得很清楚:“自己在这篇论文中没有任何数学上的贡献”,更大的功劳在Claude。

image.png

Claude 推理过程中大量依赖 Baluyot、Goldston、Suriajaya、Turnage-Butterbaugh 近年关于零点间距的研究,以及 Bombieri 2000 年的论文。这些人类成果提供了必要的统计信息和分析工具。

AI 在数学上的进展,真的越来越快。

一天半的时间Claude 把一项卡了约 6 年的下界从 41.6% 抬高到 67.2%。

但照这个速度,AI 不会永远停在数学难题的外围。 下一次,我们或许看到的AI不只是顺手刷新一项下界,而是把某道真正的科学难题推过终点。

Claude Opus 5 来了!附国内五种使用方法(2026 最新)

2026 最新|GPT-5.6 Sol 国内使用完全指南:6 种方法+三版本对比+避坑建议