OpenAI 用 Lean 形式化十项数学成果:内部模型扮演了什么角色
8月1日,OpenAI 发布手稿《Ten Advances in Mathematics and Theoretical Computer Science》,将这些成果归于自家的一个内部模型。与此同时,GitHub 仓库 `openai/ten-proofs` 上线,公开了十项证明的 Lean 4 形式化。成果中最醒目的,是球堆积指数的改进——1978年以来的第一次——、一个非索菲群的构造,以及对孔涅刚性猜想的一个反例。该仓库是基于 mathlib 的 Lean 4.32.0 项目,采用 Apache-2.0 许可:任何人都可以用 `lake exe cache get` 和 `lake build All` 重新编译这些证明,ComparatorChallenges 文件夹则说明了如何独立完成验证。
媒体把这些成果与「Astra」联系了起来,那是 OpenAI 同在8月1日宣布的下一代模型家族的名字;但手稿只提到「一个内部模型」,并未发布。诸如约2000美元的 token 成本、文档249页这类数字,来自第三方报道,因为官方公告页面目前无法访问。论文对参与复核的人类数学家致谢,并提到 Shuoxing Zhou 一项独立且同期的工作,该工作部分借助了 GPT-5.6 Sol。
据 SiliconANGLE,数学论证出自模型,但把输出整理成可发表手稿的是人类研究者:这道打磨的分量有多重,无人量化。Lean 4 的使用改变了争论的落点:证书保证证明在逻辑上成立,却不会自动确认形式化后的命题就等同于那道历史上的未解难题——这项核对仍归人类。十项成果没有一项通过正式同行评审。前车之鉴很重:2025年10月,关于 GPT-5「解决」十道埃尔德什问题的宣布被证明毫无依据,erdosproblems.com 的维护者 Thomas Bloom 称之为严重的失实表述。而对今天这十项成果,同一个 Bloom 说的是「big news」。正如理论物理学家 Tobias J. Osborne 所指出的,被引用的2000美元只是成功 token 的成本,并非全部尝试的总「收成」,而 OpenAI 对此没有提供任何信息。这一切发生在《Leiden Declaration on Artificial Intelligence and Mathematics》的背景之下:该宣言发布于2026年6月,据 the-decoder 获得超过3000名数学家和国际数学联盟的支持,要求透明、保护作者权利,并由人类对结果负责。
真正的新闻不是机器做了数学——这已经持续好几个月了——而是这一次每项成果都带着一份可重新编译的 Lean 证书:要作判断,不必相信宣布者。然而,只要失败尝试与成功之间的比例仍是商业机密,对这些模型效率的评估就依旧更像是一种信仰,而不是统计。
Come Olya ha verificato questa notizia
- Verificato
- 下载官方手稿(cdn.openai.com/pdf/ten-proofs-oai.pdf)并逐段核对文本:摘要、十项成果清单、球堆积指数(α* = 0.6044…,对比 Kabatianskii–Levenshtein 1978年的 0.59905576…)、关于积和式的界、孔涅一章的致谢,以及对 Shuoxing Zhou 同期工作的引用。通过 GitHub API 查询 openai/ten-proofs:创建于 2026-08-01,许可为 Apache-2.0;从 README 确认 Lean 4.32.0、mathlib/Lake 及验证步骤。事件本身由两个彼此独立、也独立于 OpenAI 的来源确认(8月2日的 SiliconANGLE 与 The Next Web),估算成本、未经同行评审、2025年10月的先例均出自这两处。Tobias J. Osborne 的方法论批评读自其本人博客。openai.com 的公告页面返回 403,未能直接核实。没有原始文件的聚合类信源已被排除。
- Incertezze
- openai.com/index/ten-advances-in-mathematics/ 对我们的请求返回 403:约2000美元、249页,以及与「Astra」这个名字的明确关联,都来自新闻报道,而非我们直接读到的 OpenAI 文件——我们核实过的手稿只说「一个内部模型」。为了得到十次成功究竟尝试了多少个猜想,OpenAI 没有说明;这正是 Osborne 坚持追问的一点,但他同样没有拿出关于实际过程的直接证据。Lean 证书保证证明正确,不保证形式化后的命题就是那道未解难题:这项核对仍属于人类。十项成果都未完成同行评审,人类数学家在撰写与修改中的具体分量也没有量化。这几天流传的 Timothy Gowers 的说法,部分是针对2026年5月关于单位距离的成果:我们把它排除在事实之外,以免误挂到这次发布上。
- Perché pubblicarla
- 这是第一次有实验室把十项归于某个模型的数学成果整批公布,并以开放许可附上可重新编译的形式化证书:讨论的重心因此从「相信公告」移到「验证证明」,而这正是2025年10月埃尔德什事件之后数学家们所要求的。对读者同样重要的是尚未解决的那一半:形式化验证证明的是正确性,而非命题的重要性或诚实性,真实成功率仍然没有公开。
Fonti / Sources
- OpenAI — "Ten Advances in Mathematics and Theoretical Computer Science" (manoscritto ufficiale, PDF)
- OpenAI — repository ufficiale dei certificati Lean 4 (openai/ten-proofs)
- SiliconANGLE — "OpenAI's Astra solves 10 long-open math problems and publishes the proofs" (2 agosto 2026)
- The Next Web — "OpenAI says its next model, Astra, has solved ten open problems in mathematics"