在新标签页中打开
茉莉花
新闻网
2026-10-09 · 星期五近12小时收录 94 条最近更新 07:35

快讯美国2026财年联邦赤字2万亿美元 比上年多2180亿美元

OpenAI公开700多篇AI生成的数学论文 称涉及三个千禧年大奖难题

茉莉花综合报道

OpenAI的一场发布活动,屏幕上是OpenAI的标志(资料照片)

OpenAI日前把一个未公开的内部模型生成的数学成果集中公开:发布时共722篇论文,归入372组成果,覆盖数论、代数几何等领域;OpenAI说,其中包括与剩下的五个千禧年大奖难题中三个有关的进展,黎曼猜想也在其中。OpenAI说,这个模型一共被问了约4000个问题,平均每项成果用了约三小时的ChatGPT Pro思考算力。

要消化这批成果的是数学家:OpenAI把证明集中公开,留给数学家去消化。OpenAI在说明中写明,这些结果处在不同的验证阶段,约42%的主要结果已有Lean形式化证明,没有形式化的结果可能有问题;仓库目前列出的是719篇论文、372组成果。说明还写到,黎曼ζ函数一个无零点区域的工作不是按固定流程完成的,其中一篇论文的文字经过人工编辑。

罗格斯大学数学教授孔托罗维奇(Alex Kontorovich)在X上谈到黎曼猜想相关的结果时说,如果这是人类做出来的,会立刻拿到菲尔兹奖;Anthropic内部一名研究人员也说,这次发布是数学史上最重要的时刻。OpenAI说,是听说Anthropic已经至少解决了一个千禧年大奖难题之后,才把自己的尖端模型派去攻关这些难题,并投入了数以百万美元计的算力;一名与Anthropic研究人员合作的学者说,OpenAI的模型可能借鉴了这名学者尚未发表的研究(未经证实),OpenAI否认。

数学界的反对没有停:20多位菲尔兹奖得主发表公开信,题为“AI在数学中的严重对齐失准”,警告AI行业急于解决数学问题,可能动摇数学的根本目的。由顶尖数学家组成的独立咨询小组上周根据数百名数学家的意见,提出了AI实验室发布成果的指导原则;OpenAI说发布时借鉴了这些建议,只有一点例外:数学家要求停止用不公开的模型测试高深数学问题,OpenAI回应说,继续在数学和其他科学领域评估内部尖端模型很重要。

茉莉花观察

这一节是茉莉花的看法,依据是上文的事实。

我们的分析这批成果眼下有多大分量,取决于还没有做完的核实。OpenAI一次交出700多篇论文,主要结果里约42%有机器可以检查的形式化证明,OpenAI自己也说,没有形式化的结果里有些可能有问题。

不同看法孔托罗维奇说,与黎曼猜想有关的结果如果出自人类之手,会立刻拿到菲尔兹奖。我们同意,这些成果如果经核实成立,分量会很重;但一篇论文要被数学界接受,靠的是有人逐篇核对,而OpenAI一次交来的是700多篇。

我们的预判仓库里有机器可检查证明的比例会涨多快。我们判断,到2026年12月31日,OpenAI这个数学仓库里有Lean形式化证明的主要结果会超过一半。目前已有约42%,OpenAI说会在取得形式化证明后陆续更新仓库。数学家上周要求停止用不公开的模型测试高深数学问题;OpenAI说继续评估内部模型很重要,随后一次公开了700多篇论文。

综合风传媒、OpenAI报道

相关报道

在 Telegram 关注茉莉花

更正与撤稿0 条记录

本文暂无更正或撤稿记录。若本文发布更正、澄清或被撤稿,相关说明将按时间顺序列于此处。版权异议或撤稿请求:见 版权与撤稿,或致函 [email protected]。