OpenAI 數學顧問團 AGMAI 成軍,管發布不管研發速度

OpenAI 於 2026 年 9 月 21 日宣布與獨立數學顧問團 AGMAI 合作,處理內部模型宣稱解開逾百道長期未解數學問題後的評估與發布問題。九位成員掛在普林斯頓高等研究院專案下、不收 AI 公司報酬、建議必須公開,但 OpenAI 明文把研發速度排除在諮詢範圍外,團體也自述在任何 AI 公司都沒有決策權。

用 AI 摘要這篇文章:

台北時間 9 月 22 日凌晨 1 點 50 分,OpenAI 在 X 發布一則消息:公司正在與一個由數學家組成的獨立顧問團合作,一起處理 AI 數學成果要怎麼評估、怎麼對外溝通的問題。同一天,openai.com 的公告頁出刊,把團體名稱、成員與運作方式一次寫清楚。團體叫 AGMAI,全名 Advisory Group on Mathematics and Artificial Intelligence。

這不是新模型發表。公告裡沒有產品名稱、沒有開放時間、沒有價格,一般 ChatGPT 使用者短期內不會感覺到任何變化。真正變動的東西在研究治理這一層:當 OpenAI 宣稱內部模型已經解開超過 100 個長期未解的數學問題,這些成果先給誰看、順序怎麼排、什麼時候公開,第一次出現外部數學家參與的制度化安排。

把時間軸拉直,這條新聞有四個錨點:

  • 8 月 28 日,OpenAI 開始訓練一個新的內部模型(該公司公告自述)。
  • 9 月 8 日,OpenAI 公開 Navier-Stokes 千禧年難題的證明與 Lean 形式化版本,隨後在數學圈引爆一輪信任爭議
  • 9 月 11 日,27 位費爾茲獎得主連署的公開信出版;同一天,主管千禧年難題的 Clay 數學研究所發布對 Navier-Stokes 案的正式回應。
  • 9 月 21 日(美東),OpenAI 宣布與 AGMAI 合作,對應台北時間 22 日凌晨。

管發布、不管研發速度,這條界線是 OpenAI 自己畫的

X 貼文的開頭寫得很保守:「我們正在與一個獨立的數學家顧問團合作,幫助 OpenAI 負責任地分享 AI 與數學的進展。」真正的細節都在同日出刊的公告頁,而整份公告最值得逐字讀的,是關於權力範圍的那一段。OpenAI 寫道:團體將獨立於 OpenAI 運作,「可以提出我們沒有請求的建議、評論 OpenAI 對數學的影響,並把它的建議公開」;「它的成員不會由 OpenAI 支薪,而且團體可以依自己的判斷調整成員」。

同一段還有一句話把制度的邏輯講白了:「它的價值取決於成員能不能行使自己的判斷、並挑戰我們的判斷。」

OpenAI 公告中顧問團獨立性條款的段落截圖Pin
OpenAI 公告原文:顧問團獨立運作、可提出未經請求的建議、成員不收 OpenAI 報酬,並明文排除就內部數學進展速度提供建議。(圖片來源:OpenAI)

同一段的最後一句話鋒一轉:「重要的是,這個團體不負責就我們內部數學進展的速度提供建議。」

這條界線劃出了 AGMAI 的真實形狀。它管的是成果出爐之後的事:怎麼評估重要性、怎麼安排發布順序、怎麼維持學術標準。它不管成果產出的速度,也管不了。AGMAI 官網的自述講得更直白:團體獨立於任何 AI 公司、成員不收報酬,而且「我們在任何 AI 公司都沒有決策權」,要不要採納建議、什麼時候發布,責任都在公司自己身上。

對照過去一個月 AI 業界在「速度」議題上的動作,這個排除格外明顯。Dario Amodei 提出讓外部評估者進駐的設速方案,OpenAI 的 Altman 隨後承諾跟進,Anthropic 又公布了量測研發自動化程度的報告。這些機制處理的都是「研發要多快」。AGMAI 直接被排除在這個問題之外,它處理的是另一個瓶頸:題目解出來之後,數學界來不及消化的那一段。

約束力從哪裡來?公告的設計給的答案不是權力,而是透明。建議必須公開,外界就能比對「數學家建議了什麼」與「公司最後做了什麼」,落差本身就是可問責的證據。這套機制能不能真的咬住,取決於 OpenAI 之後願不願意逐項回應,這一點目前沒有任何保證。

九位初始成員,掛在普林斯頓高等研究院的專案下

初始成員九位,OpenAI 公告、普林斯頓高等研究院(IAS)的專案頁、AGMAI 官網三份名單一致:

  • François Charles(法國高等師範學院 ENS-PSL)
  • Camillo De Lellis(IAS、義大利格蘭薩索科學研究所 GSSI)
  • Timothy Gowers(法蘭西學院、劍橋)
  • Martin Hairer(洛桑聯邦理工學院 EPFL、倫敦帝國學院)
  • Nikhil Srivastava(柏克萊、Simons Institute)
  • Ulrike Tillmann(牛津、劍橋牛頓數學科學研究所 INI)
  • Ravi Vakil(史丹佛)
  • Edward Witten(IAS)
  • Melanie Matchett Wood(哈佛)

AGMAI 不是一個掛在網域上的空殼。它在 IAS 的 Jonathan M. Nelson 協作研究中心底下立案,屬於 2026 春季通過審核的專案,兩位計畫主持人是 De Lellis(IBM von Neumann 講座教授)與 Witten(自然科學學院榮退教授)。專案頁對宗旨的寫法是:就「AI 公司與數學研究及數學社群的互動」提供建議,包括「數學結果的負責任呈現與發布」,並扮演數學家與 AI 產業之間的一個溝通管道。

普林斯頓高等研究院專案頁的 AGMAI 內容截圖Pin
高等研究院 Nelson Center 專案頁:兩位計畫主持人、團體宗旨與九位成員名單。(圖片來源:Institute for Advanced Study)

官網自述還補了兩個制度細節。第一,團體不只為 OpenAI 服務:只要某家 AI 公司的模型可能對數學造成重大影響,都可以找它提建議。第二,它正在向數學社群徵求意見,透過表單收件,未經提交者同意不會公開回覆內容。

起點是個妥協:從「外部顧問委員會」談成獨立團體

這個團體的誕生過程,AGMAI 官網有一段直接的自述:一開始是 OpenAI 主動接觸部分成員,希望成立一個外部顧問委員會;後來雙方達成共識,決定改成創立一個獨立團體,再邀請其他數學家加入。

這段起源值得單獨看。企業顧問委員會常見的樣貌是:公司出錢、公司設定議題、會議紀錄不公開。AGMAI 最後的形態剛好相反:成員不收 AI 公司的報酬(OpenAI 公告與官網自述都寫明)、議題可以自己開(「可以提出我們沒有請求的建議」)、建議必須公開。數學家們把一個被邀請的顧問位置,談成了一個自己握有議程的獨立組織。

目前它手上唯一的具體任務,用官網的說法,是建議 OpenAI「怎麼協調發布大量重要的數學成果」,也就是那 100 多個宣稱已解開的問題接下來怎麼出場。發布順序為什麼重要?公開信描繪的消化流程是:新結果要經過數學社群漫長的講演、討論與簡化,才會走進教科書。照這個速度,題目解得越多,排隊等待驗證的隊伍只會越長;誰先被看、誰可能被淹沒,會直接影響哪些新方法有機會進入數學知識的主幹。AGMAI 要做的,就是替這條隊伍想出大家能接受的排法。

背景是一座消化不完的題庫

要理解 AGMAI 為什麼在此時出現,得把三份第一手文件並排放著看。

第一份是 OpenAI 自己的宣稱。公告首段寫道:8 月 28 日開始訓練的新內部模型,「除了解開 Navier-Stokes 千禧年難題,已經解開橫跨數學多數領域、超過 100 個長期未解的問題」,而且進展速度「令 OpenAI 內部的數學家感到吃驚」。注意這是公司單方的主張:100 多項成果的完整清單至今沒有公開,難度、正確性與重要性都還無法逐項檢驗。

第二份是數學界的反彈。9 月 11 日出版的公開信《A Severe Misalignment of AI in Mathematics》,連署欄位列出 27 個名字,每一位的註記都是費爾茲獎與得獎年份。信裡的核心批評是:「AI 公司把解開數學問題當作新系統的基準來推進,對數學這門科學與數學社群都是傷害」,因為解題只是工具與代理指標,真正的目標是概念理解,而量產的真偽命題「可能摧毀孕育新想法的沃土」。信裡還點出兩個很具體的痛點:搶時間宣布的解答往往來不及好好寫作、提煉新方法並引用前人工作,這會帶來嚴重的歸屬與抄襲問題;而沒有數學家自願接手消化,AI 想出來的點子永遠不會真正活著,師徒之間的傳承鏈會斷掉。

OpenAI 的公告明確引用了這封信,並寫下「他們的批評凸顯了 AI 公司必須與數學社群認真往來的需要」。因果鏈是官方自己承認的。

數學家公開信標題、出版日期與首段截圖Pin
公開信於 2026 年 9 月 11 日出版並附 DOI,首段直言把解開問題當基準對數學這門科學與數學社群都是傷害。(圖片來源:mathandai.org)

兩份名單之間有一座橋:Martin Hairer 是公開信連署人與 AGMAI 成員之間唯一的交集。批評者與被批評的公司之間,至少有一個人同時站在兩邊。

第三份是 Clay 數學研究所 9 月 11 日的公告。先補一句背景:Navier-Stokes 方程式描述水與空氣這類流體的運動,飛機設計、天氣預報都靠它;千禧年難題問的問題說白了只有一句,從平滑狀態出發的三維流體,會不會在有限時間內長出速度無限大的奇點。對於此案宣稱已解開,Clay 的措辭是「看來已被解決」(apparently been settled),並強調「程序刻意不趕,但我們會持續更新」。

依 Clay 的正式規則,一個解答要走進獎項考慮程序,必須先在合格刊物發表、經過至少兩年,並獲得全球數學界普遍接受,三個條件缺一不可。到目前為止,Clay 官網的千禧年難題頁面仍然列著 Navier-Stokes,沒有除名。

把三份文件疊起來,AGMAI 要補的缺口就清楚了。Lean 形式化證明能回答「每一步是否符合指定的邏輯系統」,這是機器擅長的。但題目有沒有被正確建模、證明帶來什麼新方法、成果怎麼嵌進既有知識、誰先誰後,這些仍是數學共同體的慢功夫。當 AI 產出證明的速度超過學界閱讀的速度,排隊規則就變成治理問題。9 月初圍繞 Navier-Stokes 草稿的信任爭議已經預演過一次,AGMAI 是 OpenAI 對這個問題的第一個制度化回應。

對一般使用者:現在能等到的改變是零,研究者會先感覺到

公告全文找不到任何產品、功能、價格或地區資訊。OpenAI 談的是內部模型與研究成果的發布流程,不是消費端能力。把這則消息讀成「ChatGPT 要能一鍵解數學難題」,超出了官方資料支持的範圍。

會先接觸到影響的是數學研究社群,而且方向可以從顧問團的任務範圍推得出來。第一,未來 AI 參與的數學論文,貢獻標示會被要求更清楚:模型做了什麼、人做了什麼、驗證工具做了什麼。第二,大量成果可能改走分批發布,避免把審查壓力一次砸在少數專家身上。第三,OpenAI 在公告裡說要「把有能力的工具放到數學家手裡,讓他們去追自己最了解的問題」,工具設計的目標有機會從直接給答案,轉向協助理解、檢查與延伸證明。這三點都是從任務範圍推導的方向,不是已經定案的規則。

三個驗收訊號,一個月內回頭檢驗

名單再亮眼,制度要能運作才算數。判斷 AGMAI 是真的治理還是漂亮的顧問名單,接下來盯三個訊號:

  1. AGMAI 是否真的公開第一批對 OpenAI 的建議。建議不公開,整個問責設計就少了著力點。
  2. OpenAI 是否公開 100 多項成果的清單與驗證材料。清單不出來,「百題」就永遠停在公司主張的層級。
  3. OpenAI 是否建立回應建議的固定機制,說明採納與不採納的理由。

目前無法確認的還有三件事:100 多項成果的實際內容與品質、AGMAI 建議的具體形態、OpenAI 的採納程度,都還沒有可檢驗的材料。這則消息的時效以週計:如果一個月內三個訊號一個都沒有出現,這套機制比較像公關安排;如果有,它會是 AI 公司把研究發布流程開放給外部學界檢驗的罕見案例,而且過程公開可追蹤。屆時就有答案可對。

Sliven 褚崇名
Sliven 褚崇名

每日分享科技新知、免費資源以及 WordPress、虛擬主機相關主題,任何問題歡迎在科技月球下方留言,或是發送 Email 至 [email protected] 與我聯繫。

文章: 1473

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *


Share to...