新闻宏观经济Sakana AI 发布 Fugu Ultra v1.1,称其在未纳入 Fable 5 的情况下表现优于 Fable 5

Sakana AI 发布 Fugu Ultra v1.1,称其在未纳入 Fable 5 的情况下表现优于 Fable 5

作者: The Decoder·

要点速览

  • Sakana AI 称,Fugu Ultra v1.1 相比上一版本最高带来 7.9 分的性能提升,其中在 ProgramBench 和 TerminalBench 2.1 基准测试中的改进最大。
  • Fugu v1.1 的所有性能数据均来自 Sakana 自身的内部测试,目前尚未公开任何独立验证。
  • Fugu 的定价仍为输入 token 每百万五美元、输出 token 每百万三十美元,与上一版本保持不变。
  • v1.1 更新引入了兼容 Claude Code 的端点,允许开发者在不改变现有终端工作流程的情况下,将 Fugu 用作后端替代方案。
  • Sakana AI 仍继续排除欧盟和欧洲经济区用户,理由是 GDPR 合规以及欧盟特定监管方面的顾虑。
Sakana AI 发布 Fugu Ultra v1.1,称其在未纳入 Fable 5 的情况下表现优于 Fable 5

Sakana AI 发布了 Fugu Ultra v1.1,这是其 AI 模型路由器的更新版本,可将每个用户查询分配到由公开可用的顶级大语言模型组成的模型池中。模型路由——即针对每个单独查询动态选择表现最佳的模型,而不是依赖单一模型——已成为开发者在竞争性前沿模型数量不断增加的背景下,平衡成本、延迟和输出质量的一种实用策略。这家总部位于东京的公司称,该更新相比此前的 v1.0 版本最高带来 7.9 分的性能提升,其中在 ProgramBench 和 TerminalBench 2.1 基准测试中的改进最为显著。

据 Sakana 称,Fugu v1.1 目前据称在某些基准测试中优于 Fable 5——尽管 Fable 5 并未包含在该路由器的模型选择池中。所引用的所有性能数据均来自 Sakana 自身的内部测试,目前尚未发布任何独立验证结果。

该服务的定价保持不变,输入 token 为每百万 $5,输出 token 为每百万 $30。Sakana 表示,一个新发布的顶级模型在加入路由器可用模型池之前,大约需要两周的训练和评估。其底层架构在技术报告中有详细说明。

v1.1 更新还引入了一个兼容 Claude Code 的端点,允许开发者直接从终端调用 Fugu。Claude Code 是 Anthropic 的命令行编码助手;与其 API 格式兼容意味着,已经使用该工具的开发者可以在不修改工作流程的情况下,将 Fugu 替换为后端。自首次发布以来,Fugu 已可通过包括 OpenRouter 和 Vercel 在内的平台访问。

Fugu 的首个版本曾受到一些用户和批评者的冷淡反响,他们提到了 token 消耗高、响应速度较慢以及输出质量不理想等问题。

Sakana AI 仍继续排除欧盟和欧洲经济区用户,理由是 GDPR 合规顾虑以及该公司所称的“EU-specific regulations”。

更多详情可见官方 Fugu 页面。