AI Pulse

人类留一句话 AI 独自干一天半推进150年数学难题

人类留一句话 AI 独自干一天半推进150年数学难题

黎曼猜想是数学里最有名的未解问题之一,悬置超过 150 年。它和素数的分布规律有关。完整证明的悬赏是 100 万美元,至今没人领走。

Anthropic 宣布,一个尚未发布的模型在这道题上取得了进展。它显著提高了黎曼猜想成立解的下界。

起点很有意思。一位没受过系统数学训练的员工,只给模型留下一句话:“认真尝试”证明黎曼猜想。然后他放手,让模型自己安排。接下来 36 小时,模型拆解任务、验证结果,没有人类逐步干预。

论文脚注记录了过程。模型一共测试了 650 个思路,协调 60 个子代理,消耗了 3100 万个输出 token。分工很清楚:2 个提出关键数学思想,13 个给这些思想添砖加瓦,30 个试了新方向但没产出,13 个负责检查论证,最后 2 个参与写论文初稿。像一个临时凑起来、自动分工的研究团队。

结果过了两道检查。Anthropic 的两位内部数学家确认了推理,再用开源证明助手 Lean 做了形式化验证。

这不是 AI 第一次在数学上出成绩。Anthropic 的另一项工作推翻了一个长期存在的雅可比猜想。OpenAI 公布了其内部模型 Astra 证明的 10 个主要结果。今年,AI 已经解决了好几个 Erdős 问题。模型越强,结果越惊人。

这些成果在数学界既带来兴奋,也带来不安。今年 6 月,一批著名数学家签署公开声明,担心 AI 会破坏这个领域的核心标准。这个标准是:真正的数学证明应当归因于特定作者,由他们为发现负责,也为正确性负责。

菲尔兹奖得主 Timothy Gowers 在回应那封公开声明的博客文章里提出另一种视角:“如果有一天,数学定理不再与某个数学家相关联,也许这不会比星星不以天文学家命名、大多数星星根本没有名字更有问题。”

阅读原文
📚 相关主题 数学研究大语言模型

订阅 AI Pulse

每天 08:00 · 12:30 · 18:30 · 23:50 更新