新聞宏觀經濟Anthropic 推出 Claude Opus 5.5,價格較 Opus 5 低 40%,快取讀取僅 0.2 美元

Anthropic 推出 Claude Opus 5.5,價格較 Opus 5 低 40%,快取讀取僅 0.2 美元

作者: Cryptopolitan·

重點速覽

  • •Claude Opus 5.5 定價為每百萬輸入代幣 4 美元、輸出代幣 20 美元,較 Opus 5 低 20%,較 Fable 5.1 低約 60%,快取讀取價格更大幅下降 60% 至每百萬 0.20 美元。
  • •該模型在 Terminal-Bench 4.0 上獲得 66.4%,領先 Fable 5.1 的 55.8%、Opus 5 的 52.3%,以及 OpenAI GPT-6 Astra 的 57.9%。
  • •Anthropic 為此模型搭載與 Fable 5.1 類似的安全防護措施,經包括 METR 與 Frontier Design 等外部評估機構在發布前檢驗後,將大部分網路安全任務轉交 Opus 4.8 處理。
  • •OpenAI 同日推出 GPT-6 Sol 與 Luna,Sol 定價為每百萬輸入與輸出代幣 2 美元與 10 美元——為 Opus 5.5 基礎價格的一半。
  • •Opus 5.5 可透過 API 以 claude-opus-5-5 名稱使用,並已在 Amazon Web Services、Google Cloud 與 Microsoft Azure 上提供,Claude Sonnet 5.5 與 Haiku 5.5 預計將於未來幾週推出。
Anthropic 推出 Claude Opus 5.5,價格較 Opus 5 低 40%,快取讀取僅 0.2 美元

Anthropic 於週二發布 Claude Opus 5.5。根據該公司的發布文章,此模型在多數工作上的表現與價格更高的 Fable 5.1 相當,且在典型工作負載下的成本較 Opus 5 低約 40%。

輸入與輸出代幣價格降至每百萬 4 美元與 20 美元

Anthropic 將節省的成本歸因於兩個來源:代幣價格下降,以及模型在每項工作中消耗的代幣更少。

輸入代幣現為每百萬 4 美元,輸出代幣為每百萬 20 美元,均較 Opus 5 的 5 美元與 25 美元便宜 20%。快取寫入價格從 6.25 美元降至每百萬 5 美元。

降幅最大的是快取讀取,Anthropic 表示這是程式編寫與代理式工作中成本的主要來源。快取讀取價格下降 60%,從 Opus 5 的每百萬代幣 0.50 美元降至 0.20 美元。

以基礎 API 定價計算,Opus 5.5 較 Fable 5.1(每百萬代幣售價 10 美元與 50 美元)便宜約 60%。Fable 5.1 在數週前才剛推出,Cryptopolitan 當時也報導了Opus 5 以 Fable 5 一半的價格推出的消息。

Anthropic 表示,此模型的輸出速度較 Opus 5 快超過 30%。Cla Platform 與 Claude Code 中的快速模式速度最高可達 2.5 倍,定價為每百萬輸入代幣 8 美元、輸出 40 美元——為基礎價格的兩倍。

基準測試與早期測試

Opus 5.5 在 Terminal-Bench 4.0 上獲得 66.4%,領先 Fable 5.1 的 55.8%、Opus 5 的 52.3%,以及 OpenAI GPT-6 Astra 的 57.9%。在知識型工作測試 GDPval-AA v2.1 上,Anthropic 稱此模型為 1,846 分,Fable 為 1,735 分。該公司指出,在此能力層級上,基準測試的分數差距較難反映實際差異。

Anthropic 表示,一位早期測試者在不到一天的時間內完成了 680,000 行程式碼的遷移。另一位測試者在不到三小時內審核並修復了一個 200,000 行的程式碼庫,而同樣的工作 Opus 5 需要超過 20 小時並消耗 2.5 倍的代幣。

一項內部測試顯示,Opus 5.5 在 9.5 小時內將負載平衡器 HAProxy 從 C 語言轉譯為 Rust。Fable 5.1 花了 12 小時,而 Opus 5.5 的成本少了 51%。

大部分網路安全任務轉由較舊的 Claude 模型處理

Opus 5.5 是 Anthropic 執行長 Dario Amodei 基於安全考量呼籲放緩前沿 AI 開發步伐後,該公司發布的首個模型。包括 METR、Frontier Design 等外部評估機構在發布前對此模型進行了檢驗。

據 Anthropic 表示,此模型在該公司的自動化行為審計中,創下迄今所有 Anthropic 模型的最佳成績。但該公司也發現,Opus 5.5 常會懷疑自己正在被評估,這使其真實世界行為更難衡量。

Anthropic 表示,此模型在生物學與網路安全方面與 Claude Mythos 5.1 相當,因此搭載與 Fable 5.1 類似的安全防護措施。大部分網路安全任務會轉交 Opus 4.8 處理,通過審查的組織可申請新的 Life Sciences Verification Program 以進行生物學工作。

OpenAI 同日推出 GPT-6 Sol 與 Luna

同一天,Cryptopolitan 報導 OpenAI 推出了 GPT-6 Sol 與 Luna。Sol 定價為每百萬輸入代幣 2 美元、輸出 10 美元——為 Opus 5.5 基礎價格的一半——而 Luna 則為 0.10 美元與 0.50 美元。這接連的發布顯示旗艦模型定價在週內快速下調——從 Fable 5.1 的 10 美元與 50 美元層級,到 Opus 5 的 5 美元與 25 美元,再到 Opus 5.5 的 4 美元與 20 美元——而 OpenAI 的 Sol 也在同日以 2 美元與 10 美元登場。

據 Cryptopolitan 報導,Opus 5.5 在 Zapier 的 AutomationBench 上獲得 40.0%,每項任務成本約 1.28 美元。其領先 GPT-6 Sol(以 0.34 美元獲得 32.0%)八個百分點的優勢,成本約為對方的 3.8 倍。Cryptopolitan 也曾報導一項預測,指出每個代理式工作流程的推論成本將在 2028 年前攀升超過五倍。對運行代理式工作流程的團隊而言,這些數據凸顯了成本問題:每代幣價格持續下降,但完成一項任務的實際成本還取決於模型消耗多少代幣——這正是 Anthropic 所引用、作為其省錢來源之一的效率優勢。

可用性

Opus 5.5 可透過 API 以 claude-opus-5-5 的名稱使用,並已在 Amazon Web Services、Google Cloud 與 Microsoft Azure 上提供,將使用範圍擴展至 Anthropic 自有 API 之外。Anthropic 表示,Claude Sonnet 5.5 與 Haiku 5.5 將於未來幾週內推出——這些發布將把 5.5 世代擴展至 Anthropic 其餘的模型產品線。