9 月 21 日,OpenAI 宣布成立独立的"数学与人工智能咨询小组"(Advisory Group on Mathematics and Artificial Intelligence),由普林斯顿高等研究院(IAS)主办,成员包括巴黎高师-巴黎文理研究大学的 François Charles、IAS 的 Camillo De Lellis 等职业数学家。菲尔兹奖得主陶哲轩在自己的博客上发布了这一消息,并说明小组的成立是与 OpenAI 协商的结果。

[1][2]

nut graf:在 GPT-6 Astra 连续制造数学新闻——从 Erdős 难题、素数间隔纪录到两天前引爆社区的哥德巴赫 Liouville 弱形式证明——之后,OpenAI 没有继续自说自话,而是主动把一批外部数学家请进了评审席。但请注意这个安排的边界:咨询小组可以对 OpenAI 公开发表质疑,却对公司的内部研究节奏没有任何权力。这是一个"有声音、无刹车"的设计。

这个设计的微妙之处在于它的位置。小组设在普林斯顿高等研究院,而不是 OpenAI 的旧金山办公室;成员是职业数学家而非公司雇员;职责是就"如何评审与沟通新兴 AI 数学结果"提供建议——翻译过来,就是 OpenAI 承认自己最近两年在数学成果的"发布口径"上出了问题,需要外部权威来补信用。此前围绕 OpenAI 声称解决的 100 多个数学问题,尤其 Navier-Stokes 相关工作,数学界对"实验室自报+媒体放大"的做法争议不断;哥德巴赫事件更是把这种不信任推到了顶点——声明来自匿名社区账号,OpenAI 官方始终沉默,而数学共同体只能靠 Lean 4 文件自己验。

把这两件事放在一起看,时间线很说明问题:先是匿名声明引爆舆论,两天后 OpenAI 成立独立咨询小组。小组成员可以公开质疑、但无权叫停——这个权力结构恰好是数学界最想要的"审计员"形态:能指出错误,但不能替你踩刹车。对 OpenAI 来说,这是用"让渡一部分叙事权"换取"数学共同体的信任";对数学界来说,这是第一次有前沿实验室把成果评审的流程问题,正式交给外部。

当然,咨询小组解决的是"沟通"问题,不是"证明"问题。小组没有义务去复算 OpenAI 的每一个 Lean 项目,其建议也不构成同行评审;一个声明的可信度最终仍取决于证明本身能否被数学共同体独立验证。这个小组的真正价值,是给"实验室说自己证明了一个定理"这件事,第一次装上了一道公共的、可问责的审查流程。后续要看的是它如何运作——成员名单、公开声明、以及对争议结果的实际回应,才是这场实验的判据。

[1][2]
清晨的数学研讨厅,一位数学家背影站在长桌前,桌上摊开草稿纸与一份文件,讲台后方黑板上写满公式,窗外晨光斜照进大厅
数学评审的机构实验, AI 生成插画,非新闻照片