OpenAI回应菲尔兹奖批评:24天解决100+数学难题,成立顾问组却明确排除节奏控制权

数学图

📊 发布时间:2026年9月21日

🎯 主要主体:OpenAI、Timothy Gowers、Edward Witten、陶哲轩


一、事件概述:同一个模型又解出100+题

学术图

9月21日,OpenAI发布声明称,自8月28日开始训练的一个内部新模型,除了之前宣称解决的Navier-Stokes千秮年难题之外,现已又解决了涵盖数学大部分领域的超过100个长期未解决的开放难题。这意味着,9月8日引发Tristan Buckmaster公开质疑与25位菲尔兹奖得主联名声明的那个Navier-Stokes结果,与现在这100+题,来自同一个持续运行的训练任务。OpenAI在声明中称,其内部数学家对此进度“感到惊讶”。

值得注意的是,这100+题目前仍属于OpenAI单方自报数字——声明中未附任何难题清单、证明过程或形式化验证文件,也未获得任何独立数学家的验证。


二、顾问组九人名单:Gowers的特殊身份

会议图

同一份声明宣布,OpenAI在普林斯顿高等研究院(IAS,爱因斯坦与哥德尔曾工作过的机构)设立了“数学与人工智能顾问组”,初始成员包括九位数学家:François Charles(ENS-PSL)、Camillo De Lellis(IAS/GSSI)、Timothy Gowers(法兰西学院/剑桥)、Martin Hairer(EPFL/帝国学院)、Nikhil Srivastava(伯克利)、Ulrike Tillmann(牛津)、Ravi Vakil(斯坦福)、Edward Witten(IAS)以及Melanie Matchett Wood(哈佛)。

最值得注意的细节是:Gowers本人就是9月11日那份菲尔兹奖得主联名声明的共同签署人——他既是批评方,也现在成为被批评对象的顾问组成员。Witten则是在世物理学家中最获荣无数的一位,亦因数学与物理学之间的交叉工作获颁菲尔兹奖。这两位重量级人物的就位,被视为这不是一个“只找友好人士”的受控顾问组的最明显信号。


三、顾问组能做什么,不能做什么

天平图

OpenAI对该组的职责范围作了明确划定:它可以就新结果的审查与传播提供建议、帮助评估结果重要性、建议传播协调方式、建议学术与专业研究标准,以及建议如何让OpenAI的工具服务于数学研究与教学。但声明明确指出:“该组将不会负责建议我们如何控制内部数学进度。”OpenAI保留了完全的开发节奏自主权——顾问组管的是传播与标准,不是研发路线图。

声明还声称,顾问组保持独立运作,可以主动提出OpenAI未请求的建议,可以就OpenAI对数学领域的影响公开发声,并可将其建议公开。成员不领取报酬,可自主决定组织成员变动。但这些“独立性承诺”目前仅是OpenAI单方提出,尚未经过任何实际公开行为的检验。


四、囤积传言与时间线的巧合

时间线图

完整时间线值得回顾:9月8日OpenAI宣布用一个万人级Agent集群在88小时内解决Navier-Stokes;不到一天内,Buckmaster公开质疑其独立性,声称该结果可能源于他与合作者Alpöge的未发表研究;9月11日,25位菲尔兹奖得主联名发布《严重错位》声明;9月16日,计算机科学家Scott Aaronson传转一个未经验证的传闻,称各实验室可能因恶意回应而选择囤积已解决的题目而不发布;9月21日,OpenAI确认100+题并同时宣布顾问组成立,并在声明中直接引甑9月11日那份声明。

这个时间线同时完成了两件看似矛盾的事:它披露的数学成果比任何人预期的都多(反驳五天前Aaronson提出的“囤积”传言),同时又搭建了菲尔兹奖得主要求的机构体制。这可能是OpenAI选择“带监管地公开”而非沉默,也可能只是把一次大宣布与信任修复公告凌在一起发布的时间巧合。


五、这场回应能否消除疑虑

报纸图

值得注意的是,声明中仍有三个关键缺口:未公开100+题目的具体名单或任何证明文件;未对Buckmaster/Alpöge的署名争议作任何回应;也未直接回应Aaronson提出的“囤积”传言。这正是菲尔兹奖得主之前批评的核心问题——“我们做到了”与“这里是证据,自行验证”之间的差距。用一个旨在修复传播问题的顾问组,去发布一份仍沿用同样披露模式的声明,这个矛盾本身很值得回味。

未来几个月的真实测试将是:顾问组是否会发布任何对OpenAI不利的公开意见,而不仅仅是被引用作为“良好治理”的证据。


六、参考来源

💬 欢迎交流:你觉得Gowers同时作为批评者与顾问组成员,能为这个顾问组带来真实的监管力吗?