)
核心文案平臺無關深度稿。三平臺適配的唯一事實來源。事實均有信源編號對應02-情報.md標我的判斷處為個人觀點與其他內容明確區分Lean 4 代碼按 mathlib 語法編寫運行方式見實戰節。引子72 小時從歡呼到開炮9 月 8 日OpenAI 宣布未公開模型約 88 小時提出納維-斯托克斯方程存在性與光滑性問題的新證明思路[5]——數學界一片沸騰。72 小時后風向急轉9 月 11 日陶哲軒Terence Tao、鄧煜、彼得·舒爾茨Peter Scholze、皮埃爾·德利涅、瑪麗娜·維亞佐夫斯卡等25 位菲爾茲獎得主——數學界最高榮譽的擁有者——聯名發布公開信《人工智能在數學中的嚴重錯位》A Severe Misalignment of AI in Mathematics措辭罕見地嚴厲[1][2]。隨后兩天OpenAI 撤回對加州理工學院一項數學活動的贊助[3]署名風波持續發酵[9]。本文梳理這場AI vs 數學爭端的全貌給出我的三個明確判斷并用 Lean 4 做一個直接回應爭議的實戰把 AI 生成的證明放進機器檢查器里驗一驗。一、事件全景一周之內數學界為何集體轉身1.1 時間線9/8OpenAI 宣布 88 小時攻克 NS 難題思路本系列 9/9 篇已詳述[5]9/11陶哲軒在個人博客Whats New?發布公開信全文鄧煜、彼得·舒爾茨等 25 位菲爾茲獎得主首批聯署全文同時刊載于專門設立的網站mathandai.org開放學術界聯署[1][2]9/12聯署人數已達2415發現AI報道OpenAI 撤回對加州理工數學活動贊助[3][7]1.2 這份公開信是什么25 位初始簽署人全部為菲爾茲獎得主陶哲軒、鄧煜、彼得·舒爾茨、皮埃爾·德利涅、瑪麗娜·維亞佐夫斯卡、雨果·迪米尼科潘等[2]陶哲軒的說明聲明源于過去一周的討論我們沒有時間像萊頓宣言那樣走更充分的咨詢流程但我們判斷局勢的緊迫性要求我們盡早發聲而不是再等下去[4]這不是個別學者的抱怨而是數學共同體最高榮譽群體的集體表態——分量完全不同。二、聲明核心主張拆解刷榜為什么錯位2.1 聲明說了什么綜合各信源對公開信要點的轉述[1][2][6]核心主張可歸納為三點AI 公司正把解決數學難題當作能力基準與營銷獎杯——百年難題變成榜單分數這與數學研究的真實目標嚴重錯位數學要的是理解、提出新問題、培養人才而不是得到答案長此以往AI 驅動的刷題-刷榜模式會掏空數學的根基——研究動機、訓練體系、共同體信任。2.2 我理解的錯位度量體系沖突我的理解這不是 AI 能力問題而是兩套度量體系在同一動作上得出相反結論——AI 公司衡量是否解對數學界衡量是否推進理解。公開信說的嚴重錯位本質是基準之爭誰有權定義AI 在數學上做得好[1][6]。三、導火索署名風波與撤贊助3.1 Buckmaster 事件公開信發布前紐約大學數學家Tristan Buckmaster公開指責 OpenAI 向他施壓要求他將一位在 Anthropic 工作的合作者從論文中剔除OpenAI 被指施壓學者隱去合作者貢獻[3][9]。需要說明這是被指層面的單方指控OpenAI 的正式回應未見公開報道但事件本身已進入公共討論。3.2 OpenAI 撤回加州理工贊助本周四OpenAI 撤回對加州理工學院一項數學活動的贊助——此前該校數學家發表公開信[3]。撤資的具體金額與事由未見完整披露時點與爭議高度重合。我的觀察真正激怒數學界的不是 AI 有多強而是AI 公司開始用商業手段干預學術共同體的規范——署名是學術信任的基石觸碰它等于觸碰底線[3][9]。四、我的三個判斷個人觀點以下為作者觀點與事實部分明確區分。4.1 判斷一解題正確 ≠ 數學貢獻AI 給出 NS 難題的證明思路價值如何取決于它能否被復現、理解、推廣。目前該結果未經完整同行評審更未形式化驗證——一個正確的答案和一個數學貢獻之間隔著一整條學術生產鏈。刷榜把證明壓縮成得分恰恰丟掉了數學最有價值的部分。4.2 判斷二真正的沖突在署名與透明度如果 AI 公司一邊宣稱我們解出了難題一邊用商業壓力左右論文署名那么傷害的不是某個結果而是整個信任機制。數學共同體可以接受 AI 強但無法接受規則被改寫而不參與修訂。撤贊助是資本表態聯名是學術表態——兩邊都在用自己最有力的方式說話。4.3 判斷三出路是讓 AI 產出可驗證反對刷榜 ≠ 反對 AI。數學界自己就有現成的和解工具形式化證明Lean 4 / Coq。把 AI 的解題輸出變成機器可檢查的證明AI 就從刷榜者變成可驗證的同事——這既保住 AI 的用處也守住學術的底線。下文實戰即演示這條出路。五、開源實戰用 Lean 4 驗證 AI 生成的證明5.1 為什么 Lean 4 是裁判Lean 4mathlib 社區是一個證明檢查器你給它一個定理和一個證明它逐條檢查邏輯——通過就是通過不通過就報錯沒有中間地帶。這正是可驗證性的最硬實現[要點2]。5.2 工作流AI 生成 → Lean 驗證 → 人工審閱5.3 反例AI 的疑似證明被 Lean 拒絕先看一個 LLM 常見的錯誤證明——它看起來合理但跳了關鍵步驟把n m m n當成平凡成立-- 反例AI 生成的疑似證明含邏輯缺口 theorem add_comm_bad (n m : Nat) : n m m n : by simp -- ? simp 無法證明交換律Lean 報錯 -- error: unsolved goals -- 這不是證明是看起來像證明的文本Lean 的實際行為simp解不開Nat加法交換律編譯器報unsolved goals——機器不會因為看起來對就放行。5.4 正例正確證明通過 #check用數學歸納法寫完整證明-- 正例完整歸納證明mathlib 已證此處演示工作流 theorem add_comm_ok (n m : Nat) : n m m n : by induction n with | zero simp [Nat.zero_add, Nat.add_zero] -- 0 m m 0 | succ n ih rw [Nat.succ_add, ih, Nat.add_succ] -- 歸納步 done -- #check add_comm_ok → ? 通過proposition is proved運行方式把代碼粘貼到Lean Playground在線無需安裝或本地lean --run file.lean正例會打印#check通過反例會打印錯誤[要點3]。5.5 這個實戰回應了什么對 AI 公司想要數學貢獻的名分就把輸出變成 Lean 可檢查的證明——公開信的核心訴求是可驗證對研究者Lean 4 LLM 是當下最有生產力的組合LLM 生成候選Lean 把關正確性人把關價值對爭議本身如果 OpenAI 的 NS 結果最終能通過形式化驗證爭議會立刻降溫一半——驗證是爭議的終點不是起點[要點2]。六、總結與展望三個關鍵結論這場爭端把AI 科學貢獻如何被承認擺上臺面公開信不是反 AI而是反對解題貢獻的度量偷換——這是 2026 年 AI 與科學共同體最重要的一次正面交鋒[1][2][6]署名與透明度是信任的底線Buckmaster 風波與撤贊助表明商業邏輯越界學術規范學術共同體會用最強方式反擊[3][9]可驗證是唯一共識出路Lean 4 這類證明檢查器同時滿足AI 有用與數學可信——把裁判交給機器把價值留給人類[要點2]。對開發者的啟示無論你站在哪一邊有一件事確定無疑——AI 說的正在被要求變成機器驗證過的。學會用 Lean 4 / 形式化工具校驗 AI 輸出是這場爭議留給每個 AI 從業者的最實在的功課。參考資料信源編號對應02-情報.md信源清單。[1] 陶哲軒個人博客 mathandai.org《人工智能在數學中的嚴重錯位》2026-09-11[2] 騰訊新聞2026-09-12陶哲軒、鄧煜等 25 位菲爾茲獎得主聯合聲明[3] 界面新聞2026-09-1225 位菲爾茲獎得主聯名憤怒OpenAI 退出贊助[4] 36氪2026-09-12陶哲軒等菲爾茲獎得主開炮含陶哲軒表態[5] 虎嗅2026-09-12背景時間線9/8 OpenAI NS 難題[6] 湖南日報/知識分子2026-09-12/13聲明核心主張轉述[7] 發現AI2026-09-122415 名支持者聯署[9] 至頂網2026-09-12OpenAI 與數學家爭端持續升級[8] 第一財經 AI 周報2026-09-13本周 AI 大事綜述補充說明①我的判斷三節為作者個人觀點與事實報道明確區分②Buckmaster 事件與撤贊助細節為被指/報道層面以相關方正式回應為準③Lean 4 代碼按 mathlib 語法編寫建議在 Lean Playground 或本地 Lean 4 環境運行驗證反例會報unsolved goals正例#check通過。