讲真的!AI在数学界的突破真是越来越随意了。
事情的起因很随意,8天前 Anthropic 员工 Jarred Sumner 在跑步时,给一个尚未发布的研究版 Claude 提出一项“不合理挑战”:认真攻一下黎曼猜想。
Claude的推理过程经过约 650 个思路失败、60 个子代理接力、一天半时间的连续推导,虽然黎曼猜想是没证明出来,但模型却顺手把一项与黎曼猜想直接相关的下界纪录,从 41.6% 抬高到 67.2%。
8月11日Anthropic 在官网公开了论文、过程记录和形式化证明。
让人想不到的是Anthropic这名员工 Jarred Sumner 不是数学家,16岁辍学,和Claude的交流大多是"继续推进"和"相信自己的"的鼓励式对话。
这一下让我好奇黎曼猜想难到什么程度?抬高底线有什么说法?
◈困住 167 年,Claude 抬高底线
黎曼猜想是数学界最有名的难题之一。
克莱数学研究所把它列进七个千禧年问题,悬赏 100 万美元,至今只有一个问题被解决。
黎曼猜想从 1859 年提出,到今天已经 167 年。其间无数数学家尝试解决,都没能做到。
了解黎曼猜想前,我们先把这几个词掌握。
素数看起来忽远忽近,2、3、5、7 之后跳到 11,再跳到 13。
黎曼 zeta 函数把素数分布的信息装进一个复数函数里。这个函数等于 0 的特殊位置,就是“零点”。
其中真正牵动黎曼猜想的那批,叫非平凡零点。
黎曼猜想说:这些非平凡零点,一个都不能跑偏,必须全部站在实部为 1/2 的临界线上。
这像数学家在无边无际的夜空里拉出一根极细的钢丝,然后断言:所有关键星星都钉在这根线上。
数学家至今没法证明“所有”。
于是他们先退一步:至少能证明多少比例的零点在线上?
1914 年,Hardy 证明临界线上有无穷多个零点。1942 年,Selberg 证明在线上的零点占正比例。1974 年,Levinson 把明确下界推到三分之一。1989 年,Brian Conrey 推过五分之二。到 2020 年,Kyle Pratt、Nicolas Robles、Alexandru Zaharescu 和 Dirk Zeindler 把纪录推到略高于 5/12,也就是约 41.67%。
然后,这个数字停了约 6 年。
直到这次Claude 给出的结果,是 67.25%。相比此前纪录,一口气提高约 25.58 个百分点。
当然67.2% 不是黎曼猜想的“完成度”。剩下的 32.8% 只是这套论证尚未分类的部分,不代表它们不在临界线上。Anthropic 也明确表示,不预期这套技巧直接通向 100%。
◈Claude的疯狂推理
Jarred 第一次让 Claude 尝试时,模型一口气生成并试验了约 650 个思路。
一个都没成。
正常情况下这里已经可以结束了。Claude 自己也知道黎曼猜想有多难,也一度怀疑自己不可能取得有意义的进展。
Jarred 没有放弃,只让它再试一次。
第二轮,Claude 不再像一个人坐在桌前死磕。它在 Claude Code 里协调约 60 个子代理,把任务拆成找思路、做计算、查反例、审证明和写论文。
60 个子代理中,只有 2 个发展出了关键数学想法;13 个提供辅助思路;30 个尝试新方向但没走通;13 个负责验证;最后 2 个帮助整理初始论文。
一半子代理都失败了。
一天半的时间,这支 Claude 队伍跑了约 2400 条 shell 命令,写了数百个 Python 脚本,对已知 zeta 零点做了数千次数值检查。找到结果后,它们继续寻找反例、让不同子代理从头重证,还下载了 54 篇 arXiv 论文检查相关结果是否已经出现。
两次会话合计消耗 3100 万输出 token。
最后,Claude 主动把结果写成论文。
Jarred 这一轮基本没插手,他的干预只剩下发鼓励消息:「继续」「相信你自己」。
◈论文一交出,四位数学家接手
开放问题最不缺的,就是“我证明了”。
Anthropic 内部数学家 Levent Alpöge 和 Ralph Furman 研究并验证了 Claude 的论文,还写了一份由人类专家简化的证明说明。
两位外部数论专家 Brian Conrey 和 Dan Goldston,也在临时收到论文后迅速查看了结果。
Conrey 曾在 1989 年把相关下界推过五分之二;Goldston 参与了 Claude 这次依赖的前置研究。
Claude 还与 Anthropic 员工 Eric Easley 合作,把论文中的结果写成 Lean 形式化证明。公开仓库称,这套代码没有留下 sorry 这样的未证明占位符,并通过了标准验证工具 comparator。
comparator会检查提交的证明,是否真的对应预先给定的定理陈述,而不是悄悄换了一道更容易的题。
这一切已经让这项成果拥有一条远强于普通 AI 演示的证据链。
这次突破不是 Claude 凭空造出来的。
Jarred 自己在帖子里写得很清楚:“自己在这篇论文中没有任何数学上的贡献”,更大的功劳在Claude。
Claude 推理过程中大量依赖 Baluyot、Goldston、Suriajaya、Turnage-Butterbaugh 近年关于零点间距的研究,以及 Bombieri 2000 年的论文。这些人类成果提供了必要的统计信息和分析工具。
AI 在数学上的进展,真的越来越快。
一天半的时间Claude 把一项卡了约 6 年的下界从 41.6% 抬高到 67.2%。
但照这个速度,AI 不会永远停在数学难题的外围。 下一次,我们或许看到的AI不只是顺手刷新一项下界,而是把某道真正的科学难题推过终点。