OpenAI 宣稱用上萬個 AI Agent 解開 Navier-Stokes 千禧年難題:88 小時燒掉 3000 億 token,卻被 NYU 數學家指控「偷跑搶先發表」(2026)

OpenAI 於 2026 年 9 月 8 日宣布,其未公開的新一代內部模型在約一萬個並行 AI Agent 協作下,88 小時內解出 Navier-Stokes 千禧年難題的爆破證明,全案消耗約 3000 億輸出 token(按 Astra 費率約 2250 萬美元),並以 Lean 形式化驗證。但 NYU 數學教授 Tristan Buckmaster 指控 OpenAI 得知其團隊進度後才啟動強攻、要求把 Anthropic 合作者除名,甚至以「毀掉職涯」相脅,掀起 AI 時代首場學術倫理大戰。

  • Dennis
  • 6 分鐘閱讀
OpenAI 宣稱用上萬個 AI Agent 解開 Navier-Stokes 千禧年難題:88 小時燒掉 3000 億 token,卻被 NYU 數學家指控「偷跑搶先發表」(2026)

OpenAI 宣稱旗下未公開的新一代模型解開了 Navier–Stokes 千禧年難題,成為 AI 首次攻克百萬美元懸賞的世紀數學問題;但 NYU 數學家指控 OpenAI 是得知他們的研究進度後才「偷跑」,用算力硬碾搶先發表,雙方 9 月 8 日同一天公開對質。

Navier–Stokes 方程式是描述流體運動的基石,從飛機設計、天氣預報到血液流動都要用它,但「三維流體會不會在有限時間內突然爆掉(singularity)」這個數學問題,已經卡了人類將近 90 年,是克雷數學研究所(Clay Mathematics Institute)七個千禧年難題之一,懸賞一百萬美元。2026 年 9 月 8 日,兩組人馬幾乎同時宣布接近或達成解答——只是隨之而來的是火藥味十足的「誰先偷跑」指控。

時間線:兩條平行線如何交會

flowchart LR
    A["8/28 OpenAI 開始訓練<br>數學能力更強的新內部模型"] --> B["9/1 聽到「兩個千禧年難題被解出」傳言<br>啟動全難題攻關"]
    B --> C["9/2 Buckmaster & Alpöge<br>完成三篇預印本與 Lean 驗證"]
    B --> D["9/5 約一萬個 Agent 協作 88 小時<br>產出 Navier-Stokes 爆破證明"]
    D --> E["9/6 GPT-6 Astra 完成 Lean 形式化驗證<br>同日主動聯繫 Buckmaster"]
    C --> F["9/8 雙方同日公開對質"]
    E --> F

OpenAI 這邊:一萬個 Agent、三千億 token 的「算力輾壓」

OpenAI 在官方部落格《On the Navier–Stokes Millennium Prize Problem》公布了完整內幕:

  • 模型:一個「比 GPT-6 Astra 顯著更強」的未公開內部模型,8 月 28 日開始訓練,目前仍在持續訓練中;
  • 規模:9 月 1 日聽到「兩個千禧年難題已被解決」的傳言後,OpenAI 把所有難題丟給協作式 Agent 大軍平行攻關——其中負責 Navier–Stokes 的小組動用了約一萬個並行 Agent,Agent 可以讀取快取的網頁、執行程式碼,組內還能互相溝通;
  • 成本:全部難題加起來,Agent 們互傳了 490 萬則訊息、消耗約 3000 億輸出 token——TechCrunch 以當時 Astra 的 API 費率估算,相當於 2250 萬美元的算力;光 Navier–Stokes 就佔了 1300 億 token;
  • 結果:9 月 5 日(開跑約 88 小時後)產出證明:一個初始靜止的流體,在光滑外力的驅動下,會在有限時間內產生奇異點(速度無限增長,但總能量保持有限)——幾何上像一團不斷內旋、被拉成麵條狀的渦流。這對應官方難題陳述中的「選項 C 與 D」,也就是爆破反例
  • 驗證:隨後由 GPT-6 Astra 花了 17 小時把證明形式化到 Lean 證明助手中,論文與程式碼都已開源(GitHub: NavierStokesAndEuler)。OpenAI 強調「無意申領千禧年獎金」,並承認 Buckmaster 團隊在 forced Euler 問題上的優先權。

Buckmaster 這邊:三個 Lean 驗證過的證明,外加一份指控聲明

NYU Courant 研究所教授 Tristan Buckmaster 與 Anthropic 的數學家 Levent Alpöge(研究以個人名義進行,非代表 Anthropic)在 9 月 8 日公開了三篇預印本:不可壓縮多孔介質方程式(IPM)、二維無黏 Boussinesq 系統、三維無黏 Euler 方程式——都是在「光滑外力」下構造有限時間爆破,且全部通過 Lean 形式化驗證、程式碼開源。陶哲軒(Terence Tao)在 Mathstodon 上稱這是「一項卓越的成就」(a remarkable achievement)。

但真正引爆話題的,是 Buckmaster 隨論文發布的個人聲明

  1. 偷跑指控:他們在收尾階段得知「研究進度被傳到了 OpenAI」。聯繫後 OpenAI 表示「已經有完整證明」,但追問「何時開始研究、人類介入多少」時答案開始閃爍——最後承認第一個 prompt 是在「過去幾天內」才送出,也就是得知他們的工作後才啟動。Buckmaster 說:「幾乎沒有別人走這條技術路線。這不是把題目丟給模型幾天就會出現的方向。」
  2. 除名要求:9 月 6 日的電話中,OpenAI 的 Sébastien Bubeck 提出聯合發布方案,但兩次要求把 Alpöge 從論文中除名,理由是他在競爭對手 Anthropic 任職「很尷尬」;
  3. 威脅言論:Buckmaster 拒絕並表示要公開對話內容後,據他轉述,Bubeck 說:「你為什麼要毀掉自己的職業生涯?」「如果你不想讓我保持友善,那我也不必保持友善。」(Bubeck 事後承認用詞不當並道歉,稱當下立刻收回,原意是擔心 Buckmaster 發布「沒有根據的指控」傷害自己。)
  4. 數據疑慮:過去一年,兩人的研究草稿都存在 OpenAI 的 Codex 環境裡。Buckmaster 質疑:OpenAI 有權拿 Codex 互動資料訓練模型(用戶可選擇退出)——如果內部模型用了他自己的 Codex 資料,會不會「吐出」他的想法?

OpenAI 的回應:否認到底,但留了一條灰色地帶

OpenAI 在官方文章中否認竊取:「無論是研究人員還是 Agent,在他們公開發表前,都沒有以任何方式看到他們的工作——尤其沒有存取任何特定用戶資料。」但緊接著一句話讓 Buckmaster 抓住不放:「雖然可能性很低,但我們無法排除,從他們使用我們產品所衍生的去識別化資料,幫助改善了我們的模型。」Buckmaster 反駁:OpenAI 的模型在他們 8 月底密集使用 Codex 衝刺之後「仍在持續訓練」。

OpenAI 另外強調:雙方的證明「差異顯著」,連 Euler 情形證明的具體結果都不同(forced vs unforced);執行長 Sam Altman 也公開表態支持 Bubeck。而關於「OpenAI 的證明是不是真的對」——數學界還沒有人背書:陶哲軒就明確表示,他先前對這條技術路線的樂觀評估,「不應被解讀為對 OpenAI 那份手稿正確性的背書」;Princeton 數學家 Stan Palasek 也指出,要把爆破方法延伸到「無外力」的原始千禧年難題,黏性造成的能量流失會壓倒不穩定機制,仍有嚴重障礙。

為什麼這件事值得你注意

  1. 數學的「深藍時刻」來了:Buckmaster 自己形容,數學家與 LLM 合作在一個月內完成這種規模的工作,將徹底改變「我們怎麼訓練學生、怎麼分配學術credit、怎麼審稿」。而且 OpenAI 的證明正確性已經超越可讀性——第一版證明被他形容為「最面目可憎的文字」,最終論文甚至被形容為「AI 廢料」。未來的同行評審,可能變成「交給編譯器(Lean)檢查」。
  2. 「被雲端服務商截胡」的恐懼成真:這件事最讓學界膽寒的不是 OpenAI 多強,而是「我把草稿存在 Codex 上,雲端業者會不會拿去訓練、再用算力把我碾過去?」如果這個信任破產,數學家可能拒絕使用一切雲端 AI 工具——對整個 AI 輔助研究生態是毀滅性的。
  3. 算力霸凌成為新常態:學術團隊用一年慢慢打磨的路線,OpenAI 用 2250 萬美元算力在 88 小時內走完。當「研究」的勝負取決於燒多少 GPU,傳統科學合作的公平性還剩下什麼?

資料來源

延伸閱讀

📬 訂閱 most.tw 電子報

每週精選 AI 工具教學與技術乾貨,直接送到你的信箱。免費、隨時可退訂。

💬 有問題想討論?加 LINE 聯絡我

歡迎透過 LINE 官方帳號直接留言,我會盡快回覆你的問題。

加入 LINE 好友