OpenAI 在企業對 AI 支出感到擔憂之際下調模型價格
重點速覽
- •OpenAI 將 GPT-5.6 Luna 模型價格調降 80%,GPT-5.6 Terra 模型價格調降 20%,旗艦款 GPT-5.6 Sol 價格則維持不變。
- •重新定價後的 Luna 模型每百萬輸入 token 成本為 0.20 美元,相比之下,Anthropic 同級的 Claude Sonnet 4.6 每百萬輸入 token 為 3 美元。
- •OpenAI 為 Sol 模型在 API 中推出新的 Fast 模式,聲稱處理速度比標準處理快超過 2.5 倍。
- •該公司將降價歸功於 GPT-5.6 開發過程中的效率改善,這與降低推論成本的更廣泛產業趨勢一致。
- •降價措施在企業日益質疑 AI 投資報酬率之際推出,Uber 近期實施每位員工 AI 支出上限的決定即為明證。

OpenAI 大幅調降了旗下兩款 ChatGPT-5.6 模型的價格,此舉標誌著 AI 模型市場的價格戰日益激烈,同時企業也越來越嚴格地審視其 AI 支出。
OpenAI 網站上 7 月 30 日的公告證實,GPT-5.6 Luna——該公司最快且最實惠的模型——成本將降低 80%,而專為日常工作負載設計的中階 GPT-5.6 Terra 則將降價 20%。旗艦款 Sol 模型的價格維持不變,不過 OpenAI 表示其在 API 中的速度已有提升。三款模型均於三週前推出。
OpenAI 表示:「這些更新協助客戶從投資 AI 的每一塊錢中獲得更多價值,並在時間至關重要時加快運作速度。」
新的 API 定價現已生效。Terra 定價為每百萬輸入 token 2 美元、每百萬輸出 token 12 美元;Luna 則為每百萬輸入 token 0.20 美元、每百萬輸出 token 1.20 美元。作為比較,Anthropic 的中階 Claude Sonnet 4.6 定價為每百萬輸入 token 3 美元、每百萬輸出 token 15 美元。由於 API 客戶——主要為開發者與構建應用程式的企業——係依據處理的文字量付費,因此每 token 的價格變動將直接影響 AI 驅動產品與服務的單位經濟效益。
此外,GPT‑5.6 Sol 的新 Fast 模式取代了 API 中的 Priority Processing。OpenAI 宣稱 Fast 模式的運作速度比標準處理快超過 2.5 倍。
效率提升促成降價
OpenAI 將此次降價歸功於在開發 GPT-5.6 基礎模型期間所達成的效率改善。
「我們的策略持續聚焦於同時推進能力與效率,使每一代智慧都能以更低的成本完成更多工作,」該公司在聲明中表示。就整個產業而言,供應商一直透過模型架構改良、量化技術以及優化的服務基礎設施等組合方式來降低推論成本。
企業質疑 AI 投資報酬率
此次降價正值各組織對 AI 採用成本日益擔憂之際。一項近期的供應商調查發現,企業 AI 支出快速成長卻缺乏問責機制,許多公司仍不確定其投資是否帶來回報。
6 月,Uber 在對每位員工實施 AI 支出上限時引發關注,凸顯了控制成本方面日益增加的壓力。
競爭激烈的市場
此次定價調整也反映了競爭極為激烈的市場格局。來自阿里巴巴和月之暗面等供應商的低成本中國模型,正與 Google 和 Microsoft 等美國科技巨頭的產品直接競爭。隨著領先的前沿模型在基準測試表現上日趨接近,供應商在價格、速度和總擁有成本方面的差異化競爭愈發激烈。此次降價進一步凸顯了 OpenAI 與 Anthropic 之間的競爭關係,兩家公司均在推進公開發行計畫——這一時程增加了展示營收成長與企業客戶 traction 以吸引潛在投資者的壓力。
OpenAI 的決策是這場正在形成的持久價格戰中的最新一波攻勢,各模型供應商正競相爭奪企業客戶,而這些客戶同時也在要求更明確的 AI 投資回報證據。