OpenAI 公开分享 AI 数学推理最新进展

发布时间 2026-10-07 3 小时前
来源 Hacker首页帖子
字数 1,505 字
查看原文

智能总结

OpenAI 发布了一款内部前沿模型在数学领域取得的大量新成果,并将证明、模型推理摘要与统计等资料整理在 GitHub 仓库中公开分享,其中许多证明已给出 Lean 形式化版本。

平均每项成果所耗算力约相当于 ChatGPT Pro 三小时思考时长,相关发布方式参考了高等研究院数学与人工智能顾问组的建议。

分享 AI 在数学领域的进展

October 6, 2026

Research Publication

我们正在发布由一款内部前沿模型产出的大量新数学成果。

在我们思考如何更好地与数学社区分享研究成果时,一直在与独立机构——高等研究院的数学与人工智能顾问组⁠(在新窗口打开)进行磋商,以制定最佳实践。我们也参考了他们的建议以及其公开发布的推荐意见⁠(在新窗口打开)来指导本次成果的发布方式。

在本次发布中,我们将成果发布在一个 GitHub 代码仓库中,并附带论文修订和引用的相关协议。我们仍在探索其他符合顾问组指南、由社区托管的发布替代方案。对于未来的发布,我们承诺通过完善引用、数学论述以及成果展示方式,进一步提高论文质量,以便读者更好地理解。

作为 GitHub 代码仓库的一部分,我们正在分享其中许多证明在 Lean(一种允许由计算机检查数学证明的编程语言)中的形式化版本。我们将在获得更多形式化结果后持续更新该仓库。

为了推动科学透明与开放,我们还在仓库中公布了获得这些成果的更多细节。其中包括 10 份模型推理过程摘要、按 ChatGPT Pro 使用量估算的计算消耗,以及尝试解题数量的统计数据。平均每项成果所消耗的计算量大致相当于 ChatGPT Pro 三小时的思考时长。

我们希望这些进展能够推动人类知识的前沿,并助力数学领域的进一步发展。我们将资助一系列围绕理解 AI 所产出的重大成果而举办的工作坊、会议与专项项目,并将很快分享更多相关信息。

我们希望直接赋能科学家以最先进的能力,并正努力以负责任的方式发布产出这些成果的模型。这也是为什么继续在数学及其他科学领域评估我们的内部前沿模型如此重要,以便我们加速开发推进这些领域的工具。我们将继续根据社区反馈采取行动,并更新我们对未来重大科学进展披露的标准。

作者

OpenAI

继续阅读

查看全部

与 Ironclad 共同推进计算机使用 2026 年 10 月 6 日

Image 2: Mental Health Bench art card

推出 MentalHealthBench 2026 年 9 月 23 日 发表

Image 3: Introducing GPT-6 Sol and Luna — Art card

推出 GPT-6 Sol 与 Luna 2026 年 9 月 22 日 产品


Research

最新进展

安全

Products

API Platform

Business

Developers

Company

Support

More

Terms & Policies

OpenAI © 2015–2026