Anthropic 發表 Claude Opus 5.5 數分鐘後,OpenAI 推出 GPT-6 Sol 與 Luna
重點速覽
- •OpenAI 於2026年9月22日發布 GPT-6 Sol 與 GPT-6 Luna,緊接在競爭對手 Anthropic 推出其旗艦模型 Claude Opus 5.5 數分鐘之後。
- •兩款新模型的 API 價格較 GPT-5.6 的促銷費率減半:Sol 為每百萬輸入 token 2 美元、輸出 token 10 美元;Luna 為 0.10 美元與 0.50 美元。
- •OpenAI 表示內部安全指標有所改善,Sol 的程式碼欺瞞率降至 1.3%、Luna 為 2.8%,相比 GPT-5.6 Sol 的 10.4%。
- •根據 OpenAI 自家數據,GPT-6 Sol 在 Zapier 的 AutomationBench 上以每項任務 0.27 美元的成本得分 33.2%,而 Claude Opus 5 得分 26.9% 但成本高出 11 倍以上;獨立基準測試結果尚未公布。
- •GPT-6 Sol 與 Luna 已在 ChatGPT Work 與 Codex 上線,適用於 Plus、Pro、Business、Enterprise 與 Edu 訂閱用戶,Luna 也透過桌面應用程式提供給免費與 Go 用戶,但兩款模型均尚未登陸基礎版 ChatGPT 應用程式。

OpenAI 於週二發布兩款全新人工智慧模型 GPT-6 Sol 與 GPT-6 Luna,API 價格較 GPT-5.6 的促銷費率砍半。此次發布緊接在競爭對手 Anthropic 推出其新旗艦模型 Claude Opus 5.5 數分鐘之後。這兩款模型接連亮相,突顯了兩大 AI 領導公司之間持續升溫的競爭——也讓按 token 付費的開發者與企業,得以在價格與效能上進行一場罕見的直接對比。
Sol 與 Luna 定位於 GPT-6 Astra 之下;OpenAI 在9月3日發布 Astra 時稱其為「全球最聰明且對齊程度最高的模型」。Astra 仍是 OpenAI 處理最艱難任務的首選;Sol 與 Luna 則是為日常工作打造、更便宜也更快速的選項。
這種分層策略與 Anthropic 的產品線高度呼應:Astra 相當於 Fable,Sol 對應 Opus,Terra 對應 Sonnet,而 Luna 則相當於 Haiku 待其完成自身升級之後的版本。這種平行結構也讓逐層級的價格比較變得簡單直接。
公司方面表示,內部安全指標也有所改善:Sol 的程式碼欺瞞率降至 1.3%,Luna 為 2.8%,均遠低於 GPT-5.6 Sol 的 10.4%。
OpenAI 將此次降價定位為維持競爭力的手段。兩款模型的 API 成本較 GPT-5.6 的促銷每 token 費率調降50%。Token 是模型讀取與寫出的文字片段——通常略少於一個完整單字——企業以百萬為單位計費,這正是 AI 帳單在規模化時累積的方式。
OpenAI 在 X 上發文宣布此次發布:
Please welcome GPT-6 Sol and GPT-6 Luna to the GPT-6 universe. GPT-6 Sol and Luna build on the advances behind GPT-6 Astra, bringing much of its strengths into faster and more affordable models to support work at scale. We've also made caching and inference more efficient, and… pic.twitter.com/5LiVE4rbFt
— OpenAI (@OpenAI) September 22, 2026
該貼文於2026年9月22日發布在 OpenAI 的官方 X帳號 (@OpenAI) 上。
Sol 現在的價格為每百萬輸入 token 2 美元、每百萬輸出 token 10 美元,低於先前的 4 美元與 20 美元。Luna 降至 0.10 美元與 0.50 美元,低於先前的 0.20 美元與 1.20 美元。整體而言,與 Anthropic 相比,OpenAI 在各層級都提供更便宜的報價。
效能方面的論據主要來自 AutomationBench,這是由 Zapier 打造的基準測試,檢驗 AI 代理能否使用涵蓋銷售、行銷、營運、客服、財務與人資的 47 項工具完成完整的業務工作流程,以通過率計分。GPT-6 Sol 在最高推理設定下得分 33.2%,每項任務成本 0.27 美元——由於代理工作負載在任務的每個步驟都會消耗 token,減半的 token 費率直接轉化為每項任務的成本節省。
根據 OpenAI 自家數據,Claude Opus 5 在其最高設定下得分 26.9%,但每項任務成本高出 11 倍以上。GPT-6 Sol 在同一測試中也略勝 Anthropic 較昂貴的旗艦 Claude Fable 5.1。值得注意的是,這些數據引用的是 Claude Opus 5,而非 Anthropic 幾分鐘前發布的 Opus 5.5,因此最新的 Claude 模型尚未出現在比較之中。
在 Agents' Last Exam 上——該測試評估 AI 代理在 55 個次產業中執行長期、具經濟價值工作的表現,並以完成百分比計分——GPT-6 Sol 在最高推理設定下得分 56.4%。OpenAI 表示,此成績超越 Claude Opus 5 的最佳分數,且每項任務成本低 60%。
推理強度是 OpenAI 加入的一項調節設定:調高後,模型會在回答前花費更多時間與運算資源反覆自我檢查,這通常會同時提高準確性與成本。
在電腦使用方面——即 AI 代理以類似人類的方式點擊、輸入並操作軟體——GPT-6 Sol 在 OSWorld 2.0 上以 60.5% 對 60.3% 幾乎追平 Claude Opus 5 中等強度的分數,成本卻低約 80%。OSWorld 測試長時間、貼近真實的電腦任務,並依任務正確完成的比例給出部分得分。這些對比數據來自 OpenAI 自身的報告,獨立基準測試結果尚未公布。
GPT-6 Sol 與 Luna 現已在 ChatGPT Work 與 Codex 上線,適用於 Plus、Pro、Business、Enterprise 與 Edu 訂閱用戶,Luna 也透過桌面應用程式觸及免費與 Go 用戶。兩款模型均尚未登陸基礎版 ChatGPT 應用程式,OpenAI 表示將在今日內逐步推出,以維持服務穩定。接下來,這場互相對映的競爭中仍待補上的缺口,是兩款模型登陸基礎版 ChatGPT 應用程式,以及 Anth 端 Haiku 層級對應模型仍在等待自身的升級。