← 返回每日热点
BiFish original · 2026-09-09

OpenAI用一万个AI智能体88小时破解千禧年难题,但我劝你先别急着高潮

圈内炸了 跟几个做AI产品的朋友聊了一圈,发现大家对OpenAI这次宣布用内部模型攻克纳维-斯托克斯方程的看法其实很分裂。有人激动得连夜发朋友圈,说人类数学要变天了;也有人冷笑一声,说这不就是

圈内炸了

跟几个做AI产品的朋友聊了一圈,发现大家对OpenAI这次宣布用内部模型攻克纳维-斯托克斯方程的看法其实很分裂。有人激动得连夜发朋友圈,说人类数学要变天了;也有人冷笑一声,说这不就是一场精心策划的PR秀吗?毕竟上个月Anthropic刚说自家Claude在黎曼猜想上取得了突破,把临界线上零点比例的下界从41.6%提到了67.2%,这才过了几天,OpenAI就甩出一个更炸的——直接解决千禧年大奖难题,还号称用了10000个AI智能体协作,88小时搞定。这时间点卡得,你说巧不巧?

我第一反应是:真的假的?数学界90年没啃下来的硬骨头,就这么被一群AI智能体给嚼碎了?而且OpenAI还特意强调,这个内部模型性能远超刚发布的GPT-6 Astra,这不就是明摆着告诉全世界:我们手里还有更猛的牌,只是没打出来而已。

支持派:这是数学的“阿波罗计划”

先说说支持方的观点。OpenAI的研究员塞巴斯蒂安·布贝克(Sébastien Bubeck)说这是“过去十二个月所看到轨迹的一个惊人顶点”,听起来确实带劲。他们给出的证明核心是构造了一个特殊的“涡流”,让流体在有限时间内发展出奇点,同时能量保持有限,这正好对应了问题陈述中的C和D情形。更关键的是,他们用Lean编程语言做了形式化验证,这就相当于给证明加了一道机器可查的保险锁,比传统的人工审稿靠谱多了。

我个人的判断是:如果这个证明真的通过了同行的严格复核,那绝对是AI数学史上的一座里程碑。 因为它不仅证明了AI能解决一个具体的难题,更重要的是展示了大规模智能体协作的潜力——10000个智能体分工合作,这已经不是简单的“大力出奇迹”,而是一种全新的科研范式。

而且成本方面,虽然估算高达1500万到2250万美元(约合人民币1.01亿到1.51亿元),但想想看,人类数学家团队花90年时间都没做出来,这钱花得其实不冤。OpenAI还大度地表示不打算申领那100万美元的奖金,颇有点“我不在乎钱,我只是想证明我能”的土豪气质。

OpenAI用一万个AI智能体88小时破解千禧年难题,但我劝你先别急着高潮(OpenAI)

反对派:这瓜有蹊跷

但反对方的质疑也不是空穴来风。纽约大学的数学教授特里斯坦·巴克马斯特(Tristan Buckmaster)和Anthropic的研究员莱文特·阿尔珀格(Levent Alpöge)前一天刚发布了相关流体方程的研究成果,结果OpenAI第二天就宣布解决了这个问题,这时间线也太巧了吧?巴克马斯特直接怀疑OpenAI是听到了他们的进展后,才把资源转向了“外力驱动”这个方法。更让他不安的是,他和阿尔珀格存储在OpenAI Codex模型中的研究数据,可能被用于训练或参考,但OpenAI没有给出明确答复。

OpenAI的布贝克否认了这些指控,说研究人员和AI智能体都没有访问具体用户数据,但OpenAI在声明中又承认“不排除”匿名化数据帮助改进了模型。这种模棱两可的态度,反而让人心里犯嘀咕。

我的另一个判断是:这次事件很可能成为AI科研伦理的一个分水岭。 以前我们担心AI抢工作,现在开始担心AI“偷思路”了。如果OpenAI真的用了别人的未发表研究成果,那这性质就变了,不是数学问题,而是学术不端的问题。

陶哲轩的担忧

陶哲轩的评论很有意思,他一方面把这比作吸引科学家努力的“灯塔”,另一方面又警告说,如果AI能解决最困难的问题而无需人类深度参与,可能会削弱人类对数学的理解。这话说到点子上了。我实测过用AI辅助做研究,它确实能快速给出一些我没想到的路径,但那些路径往往缺乏直觉上的美感,就像是一个没有味觉的厨师做菜,营养均衡但难吃。

这跟普通读者有什么关系? 如果你以为这只是数学圈的事,那就错了。想想看,如果AI能解决纳维-斯托克斯方程,那意味着它能处理流体力学中几乎所有的问题——从飞机机翼设计到天气预报,从石油勘探到心血管血流模拟。而这些领域,恰恰是工程和医学的基石。以后你坐的飞机可能就是用AI验证过的气动布局,你吃的药可能就是在AI模拟的流体环境中测试过的。

OpenAI用一万个AI智能体88小时破解千禧年难题,但我劝你先别急着高潮(OpenAI) 配图2

但更现实的问题是,AI科研的成本高得吓人。这次花了1500万到2250万美元,这还只是算力成本,没算人力。如果以后顶级科研都要靠这种级别的投入,那普通高校和科研机构还玩什么?数学可能会变成大厂的“军备竞赛”,而不是人类智慧的公平竞技场。

我的看法

说到底,这次OpenAI的宣布,技术上可能确实是真的,但时机和方式都透着一种“抢头条”的焦虑。Anthropic上个月刚在黎曼猜想上出风头,谷歌的AlphaProof Nexus也攻克了两道悬置56年的数学难题,OpenAI再不拿出点硬货,风头就被抢光了。但问题是,这种急于求成的态度,反而暴露了AI领域的一个尴尬现状:大家都在追求“我能解决最难的问题”,却很少有人问“我们为什么需要解决这些问题”。

我个人的经验是,AI在数学上确实能成为超级助手,但它更像是望远镜,而不是火箭——它能帮你看到更远的地方,但登月还得靠你自己。陶哲轩的担忧是对的,如果人类数学家变成了AI的“注释员”和“验证员”,那数学的灵魂——那种来自人类直觉的、带着瑕疵的美感——就消失了。

三个月内见分晓

所以,别急着高潮。我赌三个月内,至少会有两个顶尖数学团队宣布对OpenAI的证明进行独立复核,而且很可能发现一些“小问题”——不是错误,而是那种需要人工补丁的漏洞。就像当年佩雷尔曼证明庞加莱猜想后,花了三年才被完全确认。AI的证明再快,人类的数学共同体也不会轻易点头。

本文基于media公开报道编译解读

本文基于 media 公开报道编译解读,查看原文

公开来源
  1. 继Claude尝试攻克黎曼猜想后:OpenAI宣布用10000个AI智能体88小时攻克千禧年大奖难题,陶哲轩既点赞又担忧