← 返回每日热点
BiFish original · 2026-09-22

OpenAI 24天攻破100道数学难题?先别高潮,这玩意儿可能是个公关烟雾弹

别急着跪 OpenAI 又搞了个大新闻。8 月 28 日开始训练的一个神秘模型,24 天,解决了 100 多个数学开放问题,包括那个让无数数学家头秃的纳维-斯托克斯方程。消息一出,我朋友圈里的

别急着跪

OpenAI 又搞了个大新闻。8 月 28 日开始训练的一个神秘模型,24 天,解决了 100 多个数学开放问题,包括那个让无数数学家头秃的纳维-斯托克斯方程。消息一出,我朋友圈里的 AI 信徒们直接沸腾了,好像人类明天就要被数学之神接管。

但说白了,这玩意儿我越看越觉得不对劲。

不是说不信 AI 能搞数学,而是 OpenAI 这波操作太像一场精心策划的公关秀。你想想,一个能解决千禧年大奖难题的模型,不先发论文,不公开细节,反而先成立一个“顾问组”,还特意强调“独立运作”“不领报酬”。这就像你邻居突然说自家孩子考上了哈佛,但成绩单死活不给你看,只拉了一群退休教授来站台。


越是强调“独立”,越说明它不独立。

之前什么样

去年这个时候,AI 搞数学还是个笑话。你让 GPT-4 算个微积分,它能给你编出三种不同的错误答案。数学家们普遍的态度是:AI 就是个高级计算器,别来碰瓷真正的数学发现。

陶哲轩去年还在公开场合说,AI 在数学上的表现“令人失望”,顶多能帮忙验证一些简单引理。邓煜、彼得·舒尔茨这些顶尖数学家甚至联名发公开信,警告不要把解决数学开放问题当作 AI 的基准,因为这会产生“负面影响”——说白了,就是怕 AI 乱拳打死老师傅,把数学界的水搅浑。

然后呢?OpenAI 这次直接甩出一个“24 天破 100 题”的成绩单。如果属实,这进步速度确实吓人。但问题在于,没人能验证。纳维-斯托克斯方程是千禧年大奖难题之一,克雷数学研究所悬赏 100 万美元,至今无人拿下。你 OpenAI 一个模型 24 天就搞定了?那这 100 万美元是不是该打到你账上?

这次改了什么

表面上看,OpenAI 这次学乖了。成立顾问组,拉来九位数学家,其中三位是菲尔兹奖得主——Timothy Gowers、Martin Hairer、Edward Witten,这阵容确实豪华。而且特意说明,顾问组有权提出公司未请求的建议,可以公开评论 OpenAI 对数学的影响,还能自行调整成员。

但仔细看,有个关键细节:顾问组不负责就公司内部数学研究的推进节奏提供建议。翻译一下就是:你们可以随便说,但我们听不听,是我们的事。

这就像你请了个独立董事,但公司章程里写明了“独立董事不得干涉公司日常经营”。那这个独立董事到底是来干嘛的?

更微妙的是,九位成员里,只有 Camillo De Lellis 一人是那封公开信的签署者。其他八位,包括三位菲尔兹奖得主,之前都没怎么对 AI 搞数学发表过激烈反对意见。OpenAI 这选人标准,明显是挑过的。


请来的都是体面人,但体面人往往不会掀桌子。

对行业意味着什么

如果 OpenAI 说的是真的,那影响确实大。数学是所有基础科学的基础,AI 能搞数学,就意味着它能搞物理、搞化学、搞材料。这玩意儿一旦成熟,药物研发、材料设计、密码学,全都要被颠覆。

但竞争对手们不会坐以待毙。Google DeepMind 去年就用 AlphaGeometry 在几何证明上拿了银牌,虽然跟“解决千禧年难题”不是一个量级,但人家至少发了论文,代码开源,结果可复现。Anthropic 的 Claude 也在尝试攻克黎曼猜想,虽然还没成功,但至少路线图是公开的。

OpenAI 这次呢?公告里连模型叫什么名字都没说,只说是“8 月 28 日开始训练的一个神秘模型”。参数规模?训练数据?用了多少算力?一概不知。

我上周刚跟一个做 AI for Science 的创业者聊,他说得很直接:“OpenAI 这波操作,要么是憋了个大招准备发 Nature,要么就是在给下一轮融资讲故事。”

跟你有什么关系

如果你是个普通读者,这事跟你的关系可能比你想的大。

假设 AI 真能解决数学难题,那最先受益的是制药行业。一个新药从靶点发现到上市,平均要 10 到 15 年,烧掉 26 亿美元。如果 AI 能把其中数学建模的部分加速 10 倍,那药价至少能降一半。

如果你是个程序员,那更直接。数学是算法的底层,AI 搞数学意味着它能自己设计更高效的算法。你现在用的推荐系统、搜索引擎、加密协议,可能两年内全部要重写。

但如果你是个数学家,那心情可能很复杂。一方面,AI 能帮你验证猜想、探索新方向,省掉大量枯燥的计算。另一方面,如果 AI 真能独立发现定理,那数学家的核心价值——提出好问题——会不会也被替代?

陶哲轩最近在 X 上说了句话,我觉得很到位:“AI 不会取代数学家,但会用 AI 的数学家会取代不用 AI 的数学家。”

我赌什么

OpenAI 这波操作,说到底是信任赤字。你越不公开细节,外界越怀疑。顾问组再豪华,也挡不住一个基本事实:科学发现需要可验证性。

我赌三个月内,OpenAI 要么被迫公开更多技术细节,要么就会有独立团队出来打脸,说“我们复现不了”。

如果一年内,这个模型能像 AlphaFold 那样,把代码和论文都公开,让全世界数学家一起验证,那我第一个道歉,承认自己看走眼。

但如果一年后,这事还是只有 OpenAI 的单方面说法,没有第三方验证,没有同行评审,那说白了,这玩意儿就是个高级 PR 工具。


数学不会骗人,但搞数学的人会。

我赌半年内,至少有两家顶级数学机构会公开要求 OpenAI 提供可验证的证据。如果没人吭声,那说明数学界也被这波 AI 叙事给忽悠瘸了。

本文基于 media 公开报道编译解读

本文基于 media 公开报道编译解读,查看原文

公开来源
  1. OpenAI 宣布成立数学与 AI 顾问组,神秘新模型 24 天攻破 100+ 世界级难题