Claude 将黎曼 Zeta 函数零点下界提升至 67.2% —— AI 模型如何推动解析数论的发展

Claude 将临界线上黎曼‑zeta 零点的已证下界提升至 67.2%

Claude 是 Anthropic 大语言模型的一个未发布研究版本,它将黎曼 zeta 函数非平凡零点落在临界线上的严格比例从 41.6% 提高到了 67.2%。这是几十年来对“线上比例”下界最重大的改进,证明了 AI 可以为深奥的解析数论问题做出实质性的贡献。


数学背景:为什么下界比例至关重要

黎曼猜想 (RH) 断言 $\zeta(s)$ 的每个非平凡零点的实部均为 $\tfrac12$。虽然完整的证明仍悬而未决,但研究人员长期以来一直在寻求定量保证,即有一定比例的零点满足该猜想。这类界限非常有用,因为许多素数理论中的条件性结果一旦比例超过某个阈值,就会变成无条件结论。之前的研究(以 Baluyot, Goldston, Suriajaya, 和 Turnage‑Butterbaugh 在 2023 年发表的一系列论文为巅峰)确立了 41.6% 的下界。Claude 的结果通过将这些技术与 Bombieri 在 2000 年的二次型分析相结合,将这一数字推向了 67.2%


Claude 证明背后的核心技术洞察

Claude 的方法可以概括为三个步骤:

  1. 构建 Weil 诱导的二次型:在一个函数空间上构建,该空间将临界线上的零点贡献(正定子空间)与线外的零点贡献(负定子空间)区分开来。
  2. 推导不等式:将该二次型的秩与从对偶素数侧图像中获得的阶与二阶矩数据联系起来(本质上是 Hilbert 变换控制)。
  3. 应用现有结果:应用 Baluyot‑Goldston‑Suriajaya‑Turnage‑Butterbaugh 的论文和 Bombieri 2000 年的工作来评估矩,从而得出新的 67.2% 界限。

其新颖之处在于对整个函数空间进行统一处理——允许二次型是非对角线的,并同时考虑正定性和负定性。这种整体处理方式解锁了比以往分别考虑子空间的分析更强的秩不等式。


Claude 的发现过程:多智能体探索

Anthropic 员工 Jarred Sumner 向 Claude 发出了一个开放式挑战:“尝试解决黎曼猜想”。Claude 的工作流程在总计 3100 万个输出 token 的两个会话中展开:

  • 想法生成:Claude 最初产生了 650 种不同的策略,但没有一种成功。
  • 子智能体协作:在第二次尝试中,Claude 在一天半的时间里编排了 ≈60 个子智能体。这些智能体执行了 2,400 条 shell 命令,编写了 数百个 Python 脚本,并针对已知的 zeta 零点进行了 数千次数值检查
  • 自我审查:子智能体相互交叉验证证明,寻找反例,并下载了 54 篇 arXiv 论文 以确保新颖性。
  • 人类鼓励:Sumner 唯一的输入是周期性的鼓励信息(例如,“继续加油”),社区指出这些信息似乎帮助 Claude 克服了其对取得进展的自我怀疑。

整个流程最终形成了一个 正式的 Lean 证明(参见 GitHub 仓库 anthropics/zeta-23-lean),该证明通过了标准的 Lean 比较器验证。


专家验证与形式化验证

两位 Anthropic 数学家 Levent AlpögeRalph Furman 审查了 Claude 的手稿,并为专家编写了一份总结该证明的非正式笔记。独立专家 Brian ConreyDan Goldston 也应邀进行了快速审查并确认了其正确性。正式的 Lean 版本为每一次推导提供了机器检查的保证,这标志着 AI 生成的结果同时经过同行评审和形式化验证的罕见案例。


Hacker News 上的社区反应

HN 的讨论突出了几个反复出现的主题:

"在整个过程中,Jarred 的输入主要限于向 Claude 发送鼓励信息……这似乎帮助 Claude 克服了一些最初的怀疑,即它是否能取得实质性的进展。" — simonw

"我不确定什么是更疯狂的:AI 提高了 RH 的下界,还是 AI 提高了 RH 的下界却甚至没能登上 HN 的首页。" — bryan0

"非常重要的一点是,之前已经存在一份带有弱条件的 2025 年 arXiv 预印本,其比例 >66%;Claude 去除了该条件,完成了向 67.2% 的跨越。" — rockmeamedee

这些评论既表达了对这一突破的热情,也对将整个改进完全归功于模型本身持谨慎态度。共识是,Claude 扮演了现有数学知识的强大整合者的角色,而不是从零开始发明底层思想。


对 AI 驱动数学的意义

Claude 的结果展示了一种新的 AI 辅助研究模式:

  • 探索广度:模型生成和测试候选方法的速度远快于人类。
  • 严谨验证:通过产生 Lean 形式化证明,AI 弥合了启发式洞察与可证明数学之间的鸿沟。
  • 人机协作:极少的人类提示(鼓励)结合广泛的自主计算,产生了实质性的进展。

虽然黎曼猜想仍未解决,但 LLM 提高重大解析数论界限的能力表明,未来的模型可能会常规性地为前沿数学做出贡献,特别是当它们与系统的子智能体流水线和形式化证明助手结合使用时。


延伸阅读


本文总结了 Anthropic 的公告及相关的 Hacker News 讨论,对 Claude 的数学成就及其更广泛的影响进行了独立的概述。

Sources

相关