OpenAI 公开 722 篇 AI 数学手稿:称涉及黎曼猜想等难题,均未经同行评审
WSJ 美东时间 10 月 6 日晚报道(explainx.ai 同日核验仓库):OpenAI 把 722 篇由内部未公开模型生成的数学手稿放进公开 GitHub 仓库 openai/math,覆盖 372 个问题家族,号称其中涉及三个剩余千禧年大奖难题(含黎曼猜想)的进展;平均每个结果约 3 小时算力。722 篇全部未经同行评审——数学界连夜开始验算。

事件经过
数字先列清楚:722 篇手稿,372 个问题家族,公开 GitHub 仓库 openai/math;生成方是 OpenAI 内部未公开模型(不是任何已发布产品);发布时间美东 10 月 6 日晚;平均每个结果约 3 小时算力(explainx.ai 称为“约 3 小时 ChatGPT Pro 级算力”);WSJ 称其中涉及三个剩余千禧年大奖难题的进展,含黎曼猜想;罗格斯大学数学教授 Alex Kontorovich 在 X 上写道,如果是人类做出其中关于黎曼的结果,会直接拿菲尔兹奖,毫无疑问。
此前 OpenAI 已多次发布数学成果:8 月内部模型 Astra 连解十个数学与理论计算机难题(含 Lean 证书);9 月 8 日 OpenAI 发表 166 页 Navier-Stokes 论文加 Lean 形式化仓库,并声明不申领千禧年奖金;9 月 21 日官方博客确认内部模型(8 月 28 日开始训练)已解决 100 多个长期悬而未决的数学问题,同时组建了设在普林斯顿高等研究院的独立数学顾问组;25 位菲尔兹奖得主此前联署“严重失调”声明,指责实验室用不公开模型抢跑数学前沿。10 月 6 日晚的 722 篇是其中数量最多的一次。
关键事实
- 722 篇,0 篇同行评审:全部 722 篇手稿都未经同行评审。Lean 形式化只覆盖了部分结果——explainx.ai 在 10 月 7 日的跟进里逐条核了 8 个 headline 结果的 Lean 状态,结论各不相同。
- “相关进展”不等于证明了黎曼猜想:WSJ 的原话是 advances related to three of the five remaining Millennium Prize Problems——“相关进展”,不是“解决”。此前 Claude 的黎曼 zeta 界(67% 零点在临界线上)曾被误报成“接近证明黎曼猜想”,而那一结果不覆盖其余 33% 的零点。OpenAI 这次的官方口径同样是“相关进展”。
- 平均约 3 小时一个结果:约 3 小时 ChatGPT Pro 级算力出一个结果。AGMAI(独立数学顾问组)9 月 29 日发布的规则卡要求公开模型名、prompt、算力成本和失败样本清单。OpenAI 这次给了公开仓库(满足 deposit 一项),但未公开模型,也没给 prompt 和成本——按那张卡打分,最多两分。
- 发布规范之争:25 位菲尔兹奖得主要求实验室停止用不公开模型测试难题;AGMAI 的规则是:引用、改写、独立存档、记录成本、附 Lean、列出失败次数。Hacker News 相关讨论有 91 赞、114 条评论。
背景
2026 年其他 AI 数学成果:5 月 DeepMind 用 LLM-Lean 循环解出 9 个 Erdős 猜想;8 月 OpenAI Astra 解出十个难题;10 月 3 日 Meta 发布 6 篇 Muse Spark 协助的数学论文;Google 的 Cogentic 拿下 5 个理论计算机结果。OpenAI 这次一次发布 722 篇,以仓库形式公开。
为什么重要
这是 OpenAI 数学发布中数量最多的一次:722 篇、372 个问题家族,全部未经同行评审;生成它们的内部模型未公开,prompt 和算力成本也未公布。
相关公司OpenAI
评论
今天
10月12日 星期一- 早报亚马逊被曝洽购 AI 初创 Decart,交易估值约 70 亿美元
共 10 条 · 10月11日
- 三问
- 预测
