25 位菲尔兹奖得主联名“开炮“:AI 正在毁掉数学吗?——从《人工智能在数学中的严重错位》看刷榜式 AI 研究之争(附 Lean 4 验证实战)

25 位菲尔兹奖得主联名“开炮“:AI 正在毁掉数学吗?——从《人工智能在数学中的严重错位》看刷榜式 AI 研究之争(附 Lean 4 验证实战) 核心文案平台无关深度稿。三平台适配的唯一事实来源。事实均有信源编号对应02-情报.md标我的判断处为个人观点与其他内容明确区分Lean 4 代码按 mathlib 语法编写运行方式见实战节。引子72 小时从欢呼到开炮9 月 8 日OpenAI 宣布未公开模型约 88 小时提出纳维-斯托克斯方程存在性与光滑性问题的新证明思路[5]——数学界一片沸腾。72 小时后风向急转9 月 11 日陶哲轩Terence Tao、邓煜、彼得·舒尔茨Peter Scholze、皮埃尔·德利涅、玛丽娜·维亚佐夫斯卡等25 位菲尔兹奖得主——数学界最高荣誉的拥有者——联名发布公开信《人工智能在数学中的严重错位》A Severe Misalignment of AI in Mathematics措辞罕见地严厉[1][2]。随后两天OpenAI 撤回对加州理工学院一项数学活动的赞助[3]署名风波持续发酵[9]。本文梳理这场AI vs 数学争端的全貌给出我的三个明确判断并用 Lean 4 做一个直接回应争议的实战把 AI 生成的证明放进机器检查器里验一验。一、事件全景一周之内数学界为何集体转身1.1 时间线9/8OpenAI 宣布 88 小时攻克 NS 难题思路本系列 9/9 篇已详述[5]9/11陶哲轩在个人博客Whats New?发布公开信全文邓煜、彼得·舒尔茨等 25 位菲尔兹奖得主首批联署全文同时刊载于专门设立的网站mathandai.org开放学术界联署[1][2]9/12联署人数已达2415发现AI报道OpenAI 撤回对加州理工数学活动赞助[3][7]1.2 这份公开信是什么25 位初始签署人全部为菲尔兹奖得主陶哲轩、邓煜、彼得·舒尔茨、皮埃尔·德利涅、玛丽娜·维亚佐夫斯卡、雨果·迪米尼科潘等[2]陶哲轩的说明声明源于过去一周的讨论我们没有时间像莱顿宣言那样走更充分的咨询流程但我们判断局势的紧迫性要求我们尽早发声而不是再等下去[4]这不是个别学者的抱怨而是数学共同体最高荣誉群体的集体表态——分量完全不同。二、声明核心主张拆解刷榜为什么错位2.1 声明说了什么综合各信源对公开信要点的转述[1][2][6]核心主张可归纳为三点AI 公司正把解决数学难题当作能力基准与营销奖杯——百年难题变成榜单分数这与数学研究的真实目标严重错位数学要的是理解、提出新问题、培养人才而不是得到答案长此以往AI 驱动的刷题-刷榜模式会掏空数学的根基——研究动机、训练体系、共同体信任。2.2 我理解的错位度量体系冲突我的理解这不是 AI 能力问题而是两套度量体系在同一动作上得出相反结论——AI 公司衡量是否解对数学界衡量是否推进理解。公开信说的严重错位本质是基准之争谁有权定义AI 在数学上做得好[1][6]。三、导火索署名风波与撤赞助3.1 Buckmaster 事件公开信发布前纽约大学数学家Tristan Buckmaster公开指责 OpenAI 向他施压要求他将一位在 Anthropic 工作的合作者从论文中剔除OpenAI 被指施压学者隐去合作者贡献[3][9]。需要说明这是被指层面的单方指控OpenAI 的正式回应未见公开报道但事件本身已进入公共讨论。3.2 OpenAI 撤回加州理工赞助本周四OpenAI 撤回对加州理工学院一项数学活动的赞助——此前该校数学家发表公开信[3]。撤资的具体金额与事由未见完整披露时点与争议高度重合。我的观察真正激怒数学界的不是 AI 有多强而是AI 公司开始用商业手段干预学术共同体的规范——署名是学术信任的基石触碰它等于触碰底线[3][9]。四、我的三个判断个人观点以下为作者观点与事实部分明确区分。4.1 判断一解题正确 ≠ 数学贡献AI 给出 NS 难题的证明思路价值如何取决于它能否被复现、理解、推广。目前该结果未经完整同行评审更未形式化验证——一个正确的答案和一个数学贡献之间隔着一整条学术生产链。刷榜把证明压缩成得分恰恰丢掉了数学最有价值的部分。4.2 判断二真正的冲突在署名与透明度如果 AI 公司一边宣称我们解出了难题一边用商业压力左右论文署名那么伤害的不是某个结果而是整个信任机制。数学共同体可以接受 AI 强但无法接受规则被改写而不参与修订。撤赞助是资本表态联名是学术表态——两边都在用自己最有力的方式说话。4.3 判断三出路是让 AI 产出可验证反对刷榜 ≠ 反对 AI。数学界自己就有现成的和解工具形式化证明Lean 4 / Coq。把 AI 的解题输出变成机器可检查的证明AI 就从刷榜者变成可验证的同事——这既保住 AI 的用处也守住学术的底线。下文实战即演示这条出路。五、开源实战用 Lean 4 验证 AI 生成的证明5.1 为什么 Lean 4 是裁判Lean 4mathlib 社区是一个证明检查器你给它一个定理和一个证明它逐条检查逻辑——通过就是通过不通过就报错没有中间地带。这正是可验证性的最硬实现[要点2]。5.2 工作流AI 生成 → Lean 验证 → 人工审阅5.3 反例AI 的疑似证明被 Lean 拒绝先看一个 LLM 常见的错误证明——它看起来合理但跳了关键步骤把n m m n当成平凡成立-- 反例AI 生成的疑似证明含逻辑缺口 theorem add_comm_bad (n m : Nat) : n m m n : by simp -- ❌ simp 无法证明交换律Lean 报错 -- error: unsolved goals -- 这不是证明是看起来像证明的文本Lean 的实际行为simp解不开Nat加法交换律编译器报unsolved goals——机器不会因为看起来对就放行。5.4 正例正确证明通过 #check用数学归纳法写完整证明-- 正例完整归纳证明mathlib 已证此处演示工作流 theorem add_comm_ok (n m : Nat) : n m m n : by induction n with | zero simp [Nat.zero_add, Nat.add_zero] -- 0 m m 0 | succ n ih rw [Nat.succ_add, ih, Nat.add_succ] -- 归纳步 done -- #check add_comm_ok → ✓ 通过proposition is proved运行方式把代码粘贴到Lean Playground在线无需安装或本地lean --run file.lean正例会打印#check通过反例会打印错误[要点3]。5.5 这个实战回应了什么对 AI 公司想要数学贡献的名分就把输出变成 Lean 可检查的证明——公开信的核心诉求是可验证对研究者Lean 4 LLM 是当下最有生产力的组合LLM 生成候选Lean 把关正确性人把关价值对争议本身如果 OpenAI 的 NS 结果最终能通过形式化验证争议会立刻降温一半——验证是争议的终点不是起点[要点2]。六、总结与展望三个关键结论这场争端把AI 科学贡献如何被承认摆上台面公开信不是反 AI而是反对解题贡献的度量偷换——这是 2026 年 AI 与科学共同体最重要的一次正面交锋[1][2][6]署名与透明度是信任的底线Buckmaster 风波与撤赞助表明商业逻辑越界学术规范学术共同体会用最强方式反击[3][9]可验证是唯一共识出路Lean 4 这类证明检查器同时满足AI 有用与数学可信——把裁判交给机器把价值留给人类[要点2]。对开发者的启示无论你站在哪一边有一件事确定无疑——AI 说的正在被要求变成机器验证过的。学会用 Lean 4 / 形式化工具校验 AI 输出是这场争议留给每个 AI 从业者的最实在的功课。参考资料信源编号对应02-情报.md信源清单。[1] 陶哲轩个人博客 mathandai.org《人工智能在数学中的严重错位》2026-09-11[2] 腾讯新闻2026-09-12陶哲轩、邓煜等 25 位菲尔兹奖得主联合声明[3] 界面新闻2026-09-1225 位菲尔兹奖得主联名愤怒OpenAI 退出赞助[4] 36氪2026-09-12陶哲轩等菲尔兹奖得主开炮含陶哲轩表态[5] 虎嗅2026-09-12背景时间线9/8 OpenAI NS 难题[6] 湖南日报/知识分子2026-09-12/13声明核心主张转述[7] 发现AI2026-09-122415 名支持者联署[9] 至顶网2026-09-12OpenAI 与数学家争端持续升级[8] 第一财经 AI 周报2026-09-13本周 AI 大事综述补充说明①我的判断三节为作者个人观点与事实报道明确区分②Buckmaster 事件与撤赞助细节为被指/报道层面以相关方正式回应为准③Lean 4 代码按 mathlib 语法编写建议在 Lean Playground 或本地 Lean 4 环境运行验证反例会报unsolved goals正例#check通过。