OpenAI 稱在第二個百萬美元千禧年大獎難題上取得進展
重點速覽
- •OpenAI 向《紐約時報》表示,已在第二個千禧年大獎難題上取得實質性進展,但未指明是哪個難題,也未提供揭露時間表。
- •OpenAI 的 Navier–Stokes 公告描述了一項經 Lean 驗證的證明,動用約 10,000 個協同運作的 AI 代理耗時約 88 小時。
- •克雷數學研究所尚未完成對 Navier–Stokes 證明的審查,涉及紐約大學數學家 Tristan Buckmaster 與 OpenAI 的 Sébastien Bubeck 的功勞爭議也仍未解決。
- •OpenAI 表示並不追求 100 萬美元獎金,而是將千禧年大獎難題定位為衡量模型進的公開基準。
- •Anthropic 同一週表示,其 Claude 模型在 11 天內將一個有 358 年歷史的費馬最後定理證明形式化;Terence Tao 則警告,AI 競爭可能使困難數學問題被消耗的速度快於新問題出現的速度。

OpenAI 向《紐約時報》表示,在宣稱解決 Navier–Stokes 問題數天後,已在第二個千禧年大獎難題上取得「實質性進展」。該公司並未指明是哪個難題,也未提供揭露其工作的時間表。
網路上的猜測(OpenAI 未予證實)聚焦於 Hodge 猜想,這是一個有 76 年歷史的數學問題,涉及如何計算複雜幾何形狀中的「洞」。該猜想由數學家 William Hodge 於 1950 年提出,主張代數可為分析幾何結構提供捷徑。至今無人證明該捷徑在所有情況下皆成立。
七個千禧年大獎難題由克雷數學研究所於 2000 年設立,每個難題附帶 100 萬美元獎金。七題中至今僅龐加萊猜想被解決,且研究所的規定要求候選解必須先獲得數學界認可才能頒獎。OpenAI 表示其並不追求獎金,而是將這些難題視為衡量其模型進步速度的公開基準。
OpenAI 也未證實相關猜測,即參與這項工作的未發布模型是據報為長時程任務與代理式工作流程設計、名為「Aeon」的版本。Hodge 猜想的理論與 Aeon 的傳聞皆未經驗證,也非公司聲明。
猜測所引用的一則社群媒體貼文寫道:
gpt-6-astra gpt-6-astra-aeon
^ new slugs added to a statsig feature flag that appeared ~30 mins ago in Codex Desktop
"aeon" means "an immeasurably or indefinitely long period of time, an age, or eternity"
— leo 🐾 (@synthwavedd) September 3, 2026https://x.com/synthwd/status/2095536656023470365?ref_src=twsrc%5Etfw
OpenAI 先前的 Navier–Stokes 公告指出,一款未發布的內部模型產出了經 Lean 驗證的證明——Lean 是逐步邏輯檢驗數學證明的軟體。由於此類軟體以機械方式逐步檢查,完成的 Lean 證明可由他人重新檢驗,而非僅憑信任。該證明涉及描述空氣與水等流體運動的 Navier–Stokes 方程式是否可能「爆破」至物理上不可能的無限速度。OpenAI 表示,此項工作動用約 10,000 個協同運作的 AI 代理,耗時約 88 小時。這些方程式對飛機設計、天氣預報及血液流動建模至關重要,近 90 年來始終無法獲得完整的數學解釋。OpenAI 的公告發布於 OpenAI。
克雷數學研究所尚未完成對 OpenAI Navier–Stokes 證明的審查。另一項功勞爭議也仍未解決。紐約大學數學家 Tristan Buckmaster 在一份四頁聲明中表示,他與 Anthropic 研究員 Levent Alpöge 近一年來一直在研究一個相關證明,並於 8 月 22 日前完成,之後 OpenAI 的 Sébastien Bubeck 得知他們的工作並搶先發表。
Buckmaster 表示,Bubeck 告訴他,要嘛讓 OpenAI 在他的團隊隔天發表,要嘛他獨自撰寫論文、不包括 Alpöge,因為 Alpöge 任職於競爭對手實驗室。Buckmaster 稱,Bubeck 據稱在他拒絕時問道:「你為什麼要毀掉自己的職業生涯?」
這些進展出現之際,AI 公司正挑戰越來越困難的數學任務。Anthropic 同一週表示,其 Claude 模型在 11 天內將一個有 358 年歷史的費馬最後定理證明形式化。數學家 Terence Tao 則警告,AI 實驗室之間的競爭可能使困難且有用的數學問題被消耗的速度,快於新問題被發現的速度。
OpenAI 主張的下一個考驗將是克雷數學研究所或外部數學家的獨立驗證。過往千禧年大獎申請案的審查歷時數年而非數週,一旦 OpenAI 指明第二個難題並揭露其工作,同樣的關卡也將等待著它。