新聞宏觀經濟Sakana AI 發布 Fugu Ultra v1.1,稱其在未納入 Fable 5 的模型池中仍勝過 Fable 5

Sakana AI 發布 Fugu Ultra v1.1,稱其在未納入 Fable 5 的模型池中仍勝過 Fable 5

作者: The Decoder·

重點速覽

  • Sakana AI 聲稱 Fugu Ultra v1.1 相較前一版本帶來最高 7.9 分的效能提升,其中最大改進出現在 ProgramBench 和 TerminalBench 2.1 基準測試。
  • Fugu v1.1 的所有效能數據均來自 Sakana 自身的內部測試,目前尚未公開任何獨立驗證。
  • Fugu 的定價維持不變,輸入 token 為每百萬個 $5,輸出 token 為每百萬個 $30。
  • v1.1 更新引入了與 Claude Code 相容的端點,讓開發者可在不改變現有終端機工作流程的情況下,將 Fugu 用作後端替代方案。
  • Sakana AI 仍持續排除歐盟與歐洲經濟區使用者,理由是 GDPR 合規與歐盟特定監管疑慮。
Sakana AI 發布 Fugu Ultra v1.1,稱其在未納入 Fable 5 的模型池中仍勝過 Fable 5

Sakana AI 發布了 Fugu Ultra v1.1,這是其 AI 模型路由器的更新版本,可將每個使用者查詢分配到由公開可用的頂級大型語言模型組成的模型池。模型路由——也就是針對每個單獨查詢動態選擇表現最佳的模型,而非依賴單一模型——已成為開發者在競爭性前沿模型數量增加之際,平衡成本、延遲與輸出品質的一項實用策略。這家總部位於東京的公司聲稱,該更新相較先前的 v1.0 版本帶來最高 7.9 分的效能提升,其中最顯著的改善出現在 ProgramBench 和 TerminalBench 2.1 基準測試。

根據 Sakana 的說法,Fugu v1.1 目前據稱在部分基準測試中優於 Fable 5——即使 Fable 5 並未包含在該路由器的模型選擇池中。所有引用的效能數據均來自 Sakana 自身的內部測試,目前尚未發布任何獨立驗證結果。

該服務的定價維持不變,輸入 token 為每百萬個 $5,輸出 token 為每百萬個 $30。Sakana 表示,一個新發布的頂級模型在加入路由器可用模型池之前,大約需要兩週的訓練與評估。其底層架構詳見技術報告。

v1.1 更新也引入了與 Claude Code 相容的端點,讓開發者可以直接從終端機呼叫 Fugu。Claude Code 是 Anthropic 的命令列程式設計助理,與其 API 格式相容意味著已在使用該工具的開發者,可以在不修改工作流程的情況下,將 Fugu 替換為後端。自首次推出以來,Fugu 已可透過包括 OpenRouter 和 Vercel 在內的平台存取。

Fugu 的第一個版本曾受到部分使用者和評論者的冷淡反應,他們指出其存在 token 消耗量高、回應速度較慢以及輸出品質不如預期等問題。

Sakana AI 仍持續排除歐盟與歐洲經濟區使用者,理由是 GDPR 合規疑慮,以及該公司所稱的「EU-specific regulations」。

更多細節可見 Fugu 官方頁面。