
新智元报道

上个月刚拿到菲尔兹奖的 Jacob Tsimerman,在颁奖典礼上宣布即将加入 OpenAI 做 AI 安全研究。

拓展阅读:害怕AI灭绝人类,菲尔兹奖得主请假去了OpenAI!要用数学驯服AI
8 月初,他与 OpenAI 研究科学家 Sébastien Bubeck 在旧金山总部召集约 40 位数学家开了场闭门峰会,其中一场报告的标题叫「数学的终结」。
OpenAI 研究科学家 Sébastien Bubeck
报告人、多伦多大学教授 Daniel Litt 说:
有可能我们最终走向一个没有高质量数学研究、人类数学专业知识完全消失的世界。

他认为极端结局不太可能出现,但数学家必须行动起来。
MIT 数学家 Drew Sutherland 把话说得更直接、冷酷:
也许我们只是矿井里的金丝雀,数学家先遭殃。

数学被选为 AI 的试验场,因为它是高智力活动的代理指标——能在数学上做到的事,迟早会复制到其他领域。
AI 正在批量「做数学」
密集的成果发布,是这场峰会的直接背景。
5 月,OpenAI 一个尚未发布的模型推翻了单位距离猜想。
拓展阅读:OpenAI彻底震撼数学界,80年核心猜想被破解!菲尔兹奖得主惊呼坐不稳
这个关于「无限平面上点的排列方式」的老问题悬而未决了多年,AI 解题用的是代数数论中一种已知但难以操作的技巧,等于跨子领域调用工具。
Tsimerman 当时的评价是,这个结果放到任何期刊,他都会「毫不犹豫地接受」。
这被许多数学家视为 AI 的第一个重大数学突破。
此后成果接连涌出。
8 月,OpenAI 一口气公布了 10 项 AI 生成的数学与计算机科学新发现,覆盖多个通常需要数年才能入门的子领域。
拓展阅读:突发!OpenAI下一代AI攻克10项菲尔兹奖级难题
Anthropic 这边也没闲着。
Anthropic 员工 Levent Alpöge 用 Claude 辅助构造了 668 维超立方体上的垂直向量对。
数学家一直相信这种构造存在,但没有人真正造出来过。
Alpöge 公布结果的方式是在 X 上发了一条 24000 字符的帖子,内容全是 + 和 - 号。

https://x.com/__alpoge__/status/2087504785952182273
传统数学研究有一条固定管线:研讨会讨论、同行传阅、贴上预印本网站 arXiv、经同行评审后发表在期刊上。
AI 生成的成果正在绕过这条管线。
常驻深圳的创业者 Dmitry Rybin 让 ChatGPT「做个突破」来推翻一个网络流假设,模型每次失败他就催它继续,化身 AI 鼓励师。

ChatGPT 最终给出了一个反例,Rybin 验证之后发了条推文。当时他正和朋友一起看电影。

https://x.com/DmitryRybin1/status/2079904005652893709
拓展阅读:GPT-5.6证伪30年图论猜想!北大校友5天连破6题
数学家 David Bessis 对此提出了质疑:
你一边煮意面一边发推说证了个大问题?当然会刷屏。
问题是,刷屏之后呢?谁来整理这堆东西、搞清楚到底怎么回事?

上周,Anthropic 还宣布其一名员工让内部版 Claude 去「认真试试」黎曼假设。
黎曼假设悬而未决了一百多年,至今无人攻克,悬赏 100 万美元。
在「继续」「再想想」之类的反复催促下,模型在一个相关问题上产出了新发现。
拓展阅读:突发,Claude首破黎曼猜想新纪录!
3000 人签了联名信,然后呢?
数学界的反应是分裂的。
6 月,一封名为「莱顿宣言」的公开信发布,超过 3000 名数学家签名。
拓展阅读:给AI立规矩!AI刚破80年数学难题,数学家们慌了
信中呼吁研究者负责任地使用 AI 工具,确保成果经过验证、引用规范。
另一批数学家则走得更远,主张彻底拒绝 AI 和 AI 公司,以保住人类在数学中的位置。
西北大学数学教授 Bryna Kra 参加了峰会,也是莱顿宣言 16 位发起人之一。

她说:
数学的核心是理解结果,不只是证明结果。
一个没有被理解的证明,不会成为文献的一部分。
AI 能证题,但能不能讲清楚自己怎么证的?
哈佛大学数学家 Melanie Matchett Wood 帮 OpenAI 的单位距离猜想结果写了人类版本的证明。

她发现,顶级 AI 模型在解释上有一个共同毛病:简单的部分说一大堆,难的部分一笔带过。
她说:
顶级 AI 模型还做不到识别论证中真正困难的部分,并把它讲清楚。
德国数学家 Andreas Thom 给出了更精确的区分。

OpenAI 公布的 10 项新成果中有一项关于「非 sofic 群」的新构造,填补了 Thom 与合作者 Gábor Kun 在 2016 年和 2019 年两篇论文之间的空白。
两人随后发表了后续论文,对 AI 的发现做了简化和拓展。
Thom 说:
AI 在以非常聪明、有分量的方式解决问题。
但新概念是人类参与证明过程之后才浮现的,目前还不是 AI 自己做到的。
面对分裂,峰会组织者 Bubeck 在会后描述了四种可能的未来:
数学变得像软件工程,AI 帮助数百人协同攻克同一个问题;
变得像物理学,靠堆算力和 AI 模型替代粒子加速器;
变成博物馆策展,AI 负责产出,人类负责挑选和解读;
或者数学家集体转型做 AI 安全。
Bubeck 说:
我们必须把人、把数学家放在第一位。
数学只有在数学家从中学到东西的时候才有意义。
「没有人的文明,毫无意义。」
但 40 位与会者没有达成共识。
Tsimerman 说:
数学界想要什么,目前没有定论。
这次会议的目的更多是开启对话,而不是做出某个决定。
他本人尚未正式入职 OpenAI。
一位菲尔兹奖得主选择去 AI 公司做安全研究,这件事本身就是数学界处境的一个缩影。
至于他接下来做什么,下一步的信号可能比这场峰会上的报告更值得关注。
参考资料:
https://www.washingtonpost.com/technology/2026/08/19/mathematicians-ask-whats-left-humans-when-ai-can-do-math-research/
编辑:马可