9 月 22 日,一条消息在数学圈和 AI 圈同时炸开:OpenAI 在普林斯顿高等研究院(IAS)挂牌成立"数学与 AI 顾问组",并声称其内部模型在 24 天里解决了 100 多个开放数学问题,其中包括著名的纳维-斯托克斯(Navier-Stokes)千禧难题。随之集结的,是 Edward Witten、Timothy Gowers、Martin Hairer 等 9 位顶尖数学家的名字。
这不是又一篇"AI 通过考试"的爽文。它牵扯的是数学公认真难题、一个成立在顶级学术机构门口的顾问组、以及"顾问组无权让 OpenAI 放慢"这个耐人寻味的细节。
纳维-斯托克斯为什么是根硬骨头
先说清楚这道题的分量。纳维-斯托克斯方程是描述流体运动的基本方程,千禧年大奖难题(Clay Mathematics Institute 悬赏 100 万美元)问的是:在三维空间中,这个方程的解是否永远光滑、不会"炸裂"出无穷大的速度或压力?
这个问题难,难在它处在物理直觉和严格证明的断层上。工程师天天用它算飞机机翼和天气,但"解是否全局存在且光滑"这件事,一百多年来没人能给出完整的数学证明。它是七个千禧难题里最贴近现实、却也最磨人的一个。如果真有一个可验证的证明,那将是本世纪数学最重大的事件之一。
所以 OpenAI 抛出"我们内部模型解决了它",分量之重,足以让整个数学界放下手头活来围观。
顾问组是谁,又"能"做什么
根据陶哲轩(Terence Tao)的公开描述,这个顾问组由普林斯顿 IAS 承办,成员包括 Witten(量子场论与数学物理的桥梁人物、菲尔兹奖得主)、Gowers(组合数学与泛函分析大家)、Hairer(随机偏微分方程大家)、De Lellis 等 9 位重量级人物。陶哲轩本人也是推动者之一——他是近年来最积极呼吁"数学界必须认真对待 AI"的顶尖数学家。
但有一个细节被反复强调:这个顾问组无权让 OpenAI 放慢任何脚步。它的 Immediate job(当务之急)是帮助 OpenAI 协调这些结果的发布。换句话说,它更像是一个"如何把成果稳妥地端出来"的顾问,而不是一个"刹车"机制。
这与两周前 Dario Amodei 那篇《We Must Pace the Frontier》(我们须放慢前沿)形成微妙对照——那边喊"慢",这边一边喊着数学突破、一边明确表示没有制动权。节奏叙事与发布节奏,又一次跑在两条轨道上。
质疑来得比掌声快
数学家的第一反应不是庆祝,而是追问:证明在哪?
Berkeley 的 Burt Totaro 在评论陶哲轩的帖子时直接警告:OpenAI 可能只是在一段 PR 低谷期,借用这些数学家的 credibility(公信力)。这话不客气,但点中了一个真问题:一个商业公司宣布"攻克千年难题",却没有把完整证明摊在阳光下接受同行评审,社区有理由先存疑。
历史上"AI 证明了某某"的宣称不少,能站住脚的极少。数学证明的门槛不是"看起来对",而是每一步都能被严格验证。大模型生成的内容流畅、自信,但恰恰容易在数学这种需要绝对严密的领域"编造看似合理的步骤"。在没有可复现、可审计的证明链之前,"解决了"三个字的分量,要打个大问号。
还有一个耐人寻味的点:上个月联名公开信、警告 AI 鲁莽冲进数学领域的 25 位菲尔兹奖得主里,只有一位加入了这个顾问组。也就是说,绝大多数顶尖数学家的态度,是"先看看",而不是"我来了"。
这件事为什么重要
抛开具体成果真假,OpenAI 把顾问组直接挂在 IAS 这种数学圣殿门口,本身就是个信号:AI 公司意识到,要在数学这种"真理不容商量"的领域建立可信度,必须借重学术共同体的背书,而不是自说自话。
对数学研究本身,如果真有可验证的辅助能力,意义是巨大的——不是替代数学家,而是帮他们扫清繁琐验证、生成猜想、检查证明漏洞。陶哲轩长期主张的,正是"AI 作为数学家的协作者"这一路径。
但对整个行业,这也立了一面镜子:当一家公司能宣布"攻克千年难题",却没有义务先交出证明,公众该信谁?顾问组的存在,至少把"需要数学家把关"这件事制度化了——哪怕它目前看起来更像发布协调者,而非质量守门人。
冷静的判断
当下最该问的不是"OpenAI 是不是世界第一",而是"证明在哪里、谁能验证、按什么标准验收"。千年难题不是推特官宣就能封板的,它要过的是全球数学界几十年积累的同行评审铁律。
如果未来几周,OpenAI 真的公开完整、可被独立验证的证明链,那将是 AI 与数学共同的里程碑。如果只是顾问组协调发布一堆"声称解决"的清单、却经不起细推,那这次事件更大的价值,反而是提醒所有人:在真理面前,再响的宣布也要让位给再慢的验证。
数学不认公关,只认证明。这一点,OpenAI 这次碰上的,恰恰是最不能糊弄的对手。