TechMoon 科技月球
WordPress、SEO 與 AI 工具實測指南
TechMoon 科技月球
WordPress、SEO 與 AI 工具實測指南

OpenAI 於 2026 年 9 月 8 日宣稱以約一萬個協同 AI Agent 在 88 小時內產出 166 頁 Navier-Stokes 有限時間爆破證明與 Lean 驗證,同日 NYU 數學家 Buckmaster 的聲明掀開 Codex 草稿信任問題,克雷研究所截至 9 月 9 日仍將問題標為 Unsolved。
用 AI 摘要這篇文章:
2026 年 9 月 8 日,OpenAI 在官方部落格發布公告,宣稱其內部系統證明了流體力學的納維-斯托克斯方程(Navier-Stokes equations)會在有限時間內產生奇點。公告同步公開一份 166 頁的論文與 Lean 形式化驗證專案。依公告自述,這個系統由一個仍在訓練中的內部模型驅動,整個評估在 9 月 1 日啟動,負責這一題的 agent 群約有一萬個併發實體,在約 88 小時的運行後於 9 月 5 日得出解答。同一份公告也寫明:OpenAI 不打算為這個結果申請千禧年大獎。

先把結論面講清楚:這是一則重大宣稱,還不是定案。截至 9 月 9 日查核,克雷數學研究所(Clay Mathematics Institute)官網上這個問題仍然標著 Unsolved。依研究所規章,證明要先在同行評審期刊發表,再經至少兩年的社群檢視期,才會進入獎項審議。這篇作者欄只署名 OPENAI 的論文,連第一關都還沒開始。數學社群的獨立審查剛剛起步。

再看事件面,這場新聞其實是兩個故事疊在一起。一個是能力故事:一萬個 AI agent 用 88 小時寫出千禧難題等級的證明。另一個是信任故事:在公告前一天,紐約大學 Courant 研究所數學教授 Tristan Buckmaster 發表四頁聲明。他是 2019 年 Clay Research Award 得主,得獎工作正好就在 Navier-Stokes 弱解。聲明描述他與任職 Anthropic 的數學家 Levent Alpöge 進行一年的同路線研究、把全部草稿存放在 OpenAI Codex 裡,以及 9 月 6 日兩通電話中發生的事。兩個故事都值得看懂,因為它們後來都指向同一個問題:當你把未發表的點子放進雲端 AI 工具,你實際上交出了什麼。
克雷研究所在 2000 年選定七個千禧年大獎難題,Navier-Stokes 的存在性與平滑性是其中之一,方程本身在 19 世紀寫下,「解是否永遠保持平滑」這一問則懸了大約 90 年。公告宣稱解開的是官方表述中的選項 C 與 D:構造一個帶平滑外力的三維不可壓縮流體解,它從靜止出發、動能全程有界,但流速在有限時間內衝向無窮大。論文摘要的原文寫的是「develops unbounded velocity in finite time while maintaining uniformly bounded kinetic energy」。官方給的直覺描述是一團螺旋向內收縮、同時被拉長的漩渦,像義大利麵一樣越轉越細越快。
值得區分的是「帶外力」這三個字。千禧難題的官方表述列出四個選項:A 與 B 是證明解永遠平滑,C 與 D 是構造出會爆破的解。走這條路的人很少,Buckmaster 在聲明裡寫道,他幾乎不認識其他還在做這條路線的人,而 Diego Córdoba 與 Luis Martínez-Zoroa 多年來正是在上面經營帶外力爆破的構造方法。C 或 D 的構造在 OpenAI 的敘事裡同樣算解開這個難題,這也是「解開千禧難題」說法的來源。
系統面細節全部來自 OpenAI 單方自述,目前沒有外部管道可以核對。模型是 8 月 28 日開始訓練的內部版本,官方說它在多項基準上出現階躍式表現。agent 有工具可讀快取版網頁、可執行程式碼,分成可互相通訊的群組。9 月 1 日 OpenAI 聽到「兩個千禧難題已被解開」的傳聞後,決定讓系統嘗試所有仍公開的千禧難題。整個嘗試過程 agent 共發送 490 萬則訊息、用掉約 3000 億輸出 tokens,其中 Navier-Stokes 部分是 270 萬則訊息、約 1300 億 tokens。Lean 形式化與驗證又花 17 個小時,由 GPT-6 Astra 完成。
另有一個讓研究圈特別吃驚的插曲:agent 群先被派去嘗試一批較簡單的問題,其中一項是非外力版的 Euler 方程正則性問題,結果約一百個 agent 合作 50 小時就解掉了。外力可以把能量灌進流體,拿掉外力的版本是更古典的公開問題,OpenAI 在公告裡也說這個結果出乎團隊意料,並因此把資源集中轉向 Navier-Stokes。若用第三方估算給個量級感,Simon Willison 依 GPT-6 Astra 公開牌價換算,3000 億輸出 tokens 約當 1500 萬美元。這是模型用量換算,不代表 OpenAI 的實際成本。
Buckmaster 的聲明把人類側的時間軸寫得很完整。他與 Alpöge 的合作是純個人計畫,沒有機構協議,一年來斷續把 Córdoba 與 Martínez-Zoroa 的帶外力爆破方法從粗糙外力推向平滑外力。工具用 Anthropic 的 Claude 與 OpenAI 的 Codex,主力是 GPT-5.6 Sol,近期才用 Astra 協助撰稿與檢查論證。8 月 15 日兩人取得 Boussinesq 與 Euler 方程的平滑外力爆破結果,8 月 22 日完成 Lean 驗證,之後全力把機器生成的證明改寫成可讀的論文。
傳聞本身就帶著失真。Buckmaster 在 9 月 3 日聽到的版本是「Anthropic 解開了重大難題」,而 OpenAI 公告自述 9 月 1 日聽到的版本更誇張,說是「兩個千禧難題已被解開」。實際上兩人當時手上的是多孔介質、Boussinesq 與 Euler 三項成果,沒有一項是千禧難題;最接近的次耗散 Navier-Stokes 論文因 Lean 驗證未完成,根本還沒釋出。Buckmaster 因此主動寫信給 OpenAI 一位知名數學家澄清事實,信裡明白寫著外界對「確切解開了什麼」有很多混淆。對方當天回覆希望避免雙方重複投入,並表示樂於提供算力。
9 月 6 日中午過後的兩通電話,OpenAI 的 Sébastien Bubeck 加入。Buckmaster 記下的核心訊息是:內部模型已證出帶外力 Navier-Stokes 爆破,對應 Fefferman 官方表述的 C 與 D 選項,證明約一百頁,他本人沒有看過。他也記下了一個逐漸修正的過程:Alpöge 事前被告知「很少人為輸入」,他被展示了 prompt、被告知模型只是拿到問題表述。但隨著 OpenAI 團隊內部傳來修正,輪廓慢慢變成:整個團隊在操作、這是多個嘗試之一、工作從非外力問題開始、展示的 prompt 本身也是用 Codex 寫的、用了不可思議的算力。
OpenAI 公告版的時間軸則是:9 月 1 日因傳聞啟動評估(公告說後來才知道傳聞與 Alpöge、Buckmaster 有關),9 月 5 日 agent 得解,9 月 6 日完成 Lean 驗證並主動聯繫兩人提議聯合發布,9 月 8 日公告上線。附帶一提,公告前一天 Terence Tao 才在部落格撰文解讀兩人釋出的三項成果,稱這條路線接下來完成 Navier-Stokes 爆破「看來很快就能做到」。也就是說,人類路線當時離終點在旁觀者眼裡已經很近,而 OpenAI 的系統在同一週衝線。

兩條時間軸在「誰先知道什麼」上並沒有實質衝突:OpenAI 自己也寫明啟動點在傳聞之後,Buckmaster 轉述 OpenAI 最終同意第一個 prompt 是在「關於兩人工作的資訊到達 OpenAI 之後」的幾天內送出。真正的爭議在於這個先後順序代表什麼,而這恰好是雙方各執一詞的地方。
Buckmaster 的四頁聲明發布在 NYU Courant 的個人頁面,內容必須以「他的單方陳述」來讀。聲明說,9 月 6 日的電話中 OpenAI 提出兩個方案:一是兩人先發表 Euler 結果、OpenAI 隔天發布 Navier-Stokes。二是兩人發表後,由 Buckmaster 一人撰寫呈現 Navier-Stokes 結果的論文,並註明由 OpenAI 內部模型解出。他寫道,Bubeck 兩度主張把 Alpöge 從作者名單移除,並抱怨 Alpöge 任職於 Anthropic 帶來麻煩。他拒絕兩案並表示將公開過程。得到的回覆是「Why would you ruin your career?」(你為什麼要毀掉自己的職業生涯)。他追問對方為什麼這樣想,又得到一句「If you don’t want me to be nice, then I don’t have to be nice.」(如果你不想我客氣,那我也不必客氣。)
聲明裡也有他自己劃下的界線,這段值得逐字看:「我沒有看過 OpenAI 的證明。我不知道他們的模型做了什麼、怎麼做的。我不知道我們的資料有沒有被使用。我不指控任何人。我陳述我被告知的事、被告知的時間,以及我被提出的條件。」他同時強調,如果 OpenAI 的模型真的補上了 Navier-Stokes 的最後一哩,那是了不起的成就,應該由 OpenAI 大聲說出來、把完整歷史一起說。
否認面同樣存在。Bubeck 在 9 月 8 日於 X 發文回應,全文兩點。他先貼出自己主動聯繫 Alpöge 協調發布時間的訊息截圖,說明他們「帶著最好的意圖」來談;接著寫下「我從未、從未要求把 Levent 從他自己工作的作者身分中移除」。這與聲明中「兩度主張移除作者」的說法直接衝突,也沒有公開的錄音或第三方紀錄可以裁決。目前能確定的只有:雙方對「有過接觸、談過聯合發布」這件事本身說法一致。
比對之下,資料面的問答反而是整份公告裡最誠實的一段。Buckmaster 說他在電話中問過,存在 Codex 裡的草稿有沒有被拿去訓練,得到的回覆是模型不會查閱使用者資料,但訓練這一問沒有答案。OpenAI 公告的寫法是:研究員與 agent 在兩人公開釋出之前,都沒有透過任何方式看過兩人的工作,也沒有存取任何特定使用者資料,「雖然可能性不大,我們無法排除源自他們使用我們產品的去識別化資料,幫助改善了我們的模型」。一句「無法排除」,就是整場草稿信任風暴的核心。
這次事件沒有任何產品變動、收費調整或強制更新,一般使用者的日常完全不受影響,不需要因此改變任何設定。真正該停下來想的是兩種人。一種是把未發表研究、機密程式或商業點子長期放在雲端 AI 工具裡的研究者與開發者。這次的事件把服務條款裡「資料可能用於模型改善」那行字,從抽象風險變成了有名字、有日期的具體案例,而且廠商自己都承認排除不了。另一種是把 AI 帶進數學或形式化驗證工作流的人,從輔助論文寫作的工具(例如競賽論文用的 MathModelAgent)到 Lean 驗證專案。接下來幾個月「機器生成的證明要怎麼被審」會是實際工作裡的問題,這份 166 頁論文與它的 Lean 證書就是頭一個大型測試案。
如果落在前一種,可以做的分層動作很具體。查一遍自己所用方案的資料使用政策,搞清楚對話內容預設會不會進入模型訓練、有沒有關閉選項。真正敏感的草稿考慮移出雲端工具,例如改用本機優先的開源 agent 工作區、或以沙箱隔離的方式跑有工具權限的 agent。不想把專案記憶綁在單一服務裡的,也有把專案記憶搬出工具的開源方案。這些不是要你放棄雲端工具,而是讓「哪種內容可以放哪」變成一個你做過的決定,而非讓預設值代勞。
四件事在截稿時仍是未知。一是證明本身的正確性:166 頁論文與 GitHub 上 Apache-2.0 授權的 Lean 專案之間對應得多完整,數學社群正在檢查,MathOverflow 與幾個大型討論串都有進行中的技術討論。二是獎項歸屬:克雷研究所的認定流程需要期刊發表加兩年考驗,短期內不會有答案,而 OpenAI 已聲明不申請獎金。三是資料問題:模型訓練是否沾到兩人的 Codex 內容,連 OpenAI 都只說無法排除,沒有第三方查證管道。四是 9 月 6 日那兩通電話的真相:單方逐字記錄對上明確否認,在新的當事人說法或紀錄出現前,只能並列。
這是標準的新聞保存期限問題:本文的查核基準是 2026 年 9 月 9 日,建議一週內回看三個地方,分別是克雷研究所問題頁的狀態、Lean 專案的審查進度,以及兩造有沒有新的聲明。任何一層翻盤,上面的結論都要跟著改。Buckmaster 在聲明裡用的比喻是 Deep Blue 對上 Kasparov 的時刻:重點已經不是這一局誰贏,而是之後所有人訓練學生、分配功勞、決定研究路線的方式都得重新想。對不在數學圈裡的人,這句話換個說法也成立:模型能力的曲線在變陡,而你放在雲端草稿紙上的東西,價值只會越來越高。