OpenAI 24天攻破100道数学难题?先别高潮,这玩意儿可能是个公关烟雾弹
别急着跪 OpenAI 又搞了个大新闻。8 月 28 日开始训练的一个神秘模型,24 天,解决了 100 多个数学开放问题,包括那个让无数数学家头秃的纳维-斯托克斯方程。消息一出,我朋友圈里的
别急着跪
OpenAI 又搞了个大新闻。8 月 28 日开始训练的一个神秘模型,24 天,解决了 100 多个数学开放问题,包括那个让无数数学家头秃的纳维-斯托克斯方程。消息一出,我朋友圈里的 AI 信徒们直接沸腾了,好像人类明天就要被数学之神接管。
但说白了,这玩意儿我越看越觉得不对劲。
不是说不信 AI 能搞数学,而是 OpenAI 这波操作太像一场精心策划的公关秀。你想想,一个能解决千禧年大奖难题的模型,不先发论文,不公开细节,反而先成立一个“顾问组”,还特意强调“独立运作”“不领报酬”。这就像你邻居突然说自家孩子考上了哈佛,但成绩单死活不给你看,只拉了一群退休教授来站台。
越是强调“独立”,越说明它不独立。
之前什么样
去年这个时候,AI 搞数学还是个笑话。你让 GPT-4 算个微积分,它能给你编出三种不同的错误答案。数学家们普遍的态度是:AI 就是个高级计算器,别来碰瓷真正的数学发现。
陶哲轩去年还在公开场合说,AI 在数学上的表现“令人失望”,顶多能帮忙验证一些简单引理。邓煜、彼得·舒尔茨这些顶尖数学家甚至联名发公开信,警告不要把解决数学开放问题当作 AI 的基准,因为这会产生“负面影响”——说白了,就是怕 AI 乱拳打死老师傅,把数学界的水搅浑。
然后呢?OpenAI 这次直接甩出一个“24 天破 100 题”的成绩单。如果属实,这进步速度确实吓人。但问题在于,没人能验证。纳维-斯托克斯方程是千禧年大奖难题之一,克雷数学研究所悬赏 100 万美元,至今无人拿下。你 OpenAI 一个模型 24 天就搞定了?那这 100 万美元是不是该打到你账上?
这次改了什么
表面上看,OpenAI 这次学乖了。成立顾问组,拉来九位数学家,其中三位是菲尔兹奖得主——Timothy Gowers、Martin Hairer、Edward Witten,这阵容确实豪华。而且特意说明,顾问组有权提出公司未请求的建议,可以公开评论 OpenAI 对数学的影响,还能自行调整成员。
但仔细看,有个关键细节:顾问组不负责就公司内部数学研究的推进节奏提供建议。翻译一下就是:你们可以随便说,但我们听不听,是我们的事。
这就像你请了个独立董事,但公司章程里写明了“独立董事不得干涉公司日常经营”。那这个独立董事到底是来干嘛的?

更微妙的是,九位成员里,只有 Camillo De Lellis 一人是那封公开信的签署者。其他八位,包括三位菲尔兹奖得主,之前都没怎么对 AI 搞数学发表过激烈反对意见。OpenAI 这选人标准,明显是挑过的。
请来的都是体面人,但体面人往往不会掀桌子。
对行业意味着什么
如果 OpenAI 说的是真的,那影响确实大。数学是所有基础科学的基础,AI 能搞数学,就意味着它能搞物理、搞化学、搞材料。这玩意儿一旦成熟,药物研发、材料设计、密码学,全都要被颠覆。
但竞争对手们不会坐以待毙。Google DeepMind 去年就用 AlphaGeometry 在几何证明上拿了银牌,虽然跟“解决千禧年难题”不是一个量级,但人家至少发了论文,代码开源,结果可复现。Anthropic 的 Claude 也在尝试攻克黎曼猜想,虽然还没成功,但至少路线图是公开的。
OpenAI 这次呢?公告里连模型叫什么名字都没说,只说是“8 月 28 日开始训练的一个神秘模型”。参数规模?训练数据?用了多少算力?一概不知。
我上周刚跟一个做 AI for Science 的创业者聊,他说得很直接:“OpenAI 这波操作,要么是憋了个大招准备发 Nature,要么就是在给下一轮融资讲故事。”
跟你有什么关系
如果你是个普通读者,这事跟你的关系可能比你想的大。
假设 AI 真能解决数学难题,那最先受益的是制药行业。一个新药从靶点发现到上市,平均要 10 到 15 年,烧掉 26 亿美元。如果 AI 能把其中数学建模的部分加速 10 倍,那药价至少能降一半。
如果你是个程序员,那更直接。数学是算法的底层,AI 搞数学意味着它能自己设计更高效的算法。你现在用的推荐系统、搜索引擎、加密协议,可能两年内全部要重写。

但如果你是个数学家,那心情可能很复杂。一方面,AI 能帮你验证猜想、探索新方向,省掉大量枯燥的计算。另一方面,如果 AI 真能独立发现定理,那数学家的核心价值——提出好问题——会不会也被替代?
陶哲轩最近在 X 上说了句话,我觉得很到位:“AI 不会取代数学家,但会用 AI 的数学家会取代不用 AI 的数学家。”
我赌什么
OpenAI 这波操作,说到底是信任赤字。你越不公开细节,外界越怀疑。顾问组再豪华,也挡不住一个基本事实:科学发现需要可验证性。
我赌三个月内,OpenAI 要么被迫公开更多技术细节,要么就会有独立团队出来打脸,说“我们复现不了”。
如果一年内,这个模型能像 AlphaFold 那样,把代码和论文都公开,让全世界数学家一起验证,那我第一个道歉,承认自己看走眼。
但如果一年后,这事还是只有 OpenAI 的单方面说法,没有第三方验证,没有同行评审,那说白了,这玩意儿就是个高级 PR 工具。
数学不会骗人,但搞数学的人会。
我赌半年内,至少有两家顶级数学机构会公开要求 OpenAI 提供可验证的证据。如果没人吭声,那说明数学界也被这波 AI 叙事给忽悠瘸了。
本文基于 media 公开报道编译解读
本文基于 media 公开报道编译解读,查看原文