НовостиМакроSakana AI выпустила Fugu Ultra v1.1 и заявляет о превосходстве над Fable 5 без его включения в пул моделей

Sakana AI выпустила Fugu Ultra v1.1 и заявляет о превосходстве над Fable 5 без его включения в пул моделей

Автор: The Decoder·

Ключевые выводы

  • Sakana AI заявляет, что Fugu Ultra v1.1 обеспечивает прирост производительности до 7,9 балла по сравнению с предыдущим релизом, с наибольшими улучшениями на бенчмарках ProgramBench и TerminalBench 2.1.
  • Все показатели производительности Fugu v1.1 получены из собственных внутренних тестов Sakana, независимая проверка не публиковалась.
  • Цены на Fugu остаются на уровне пяти долларов за миллион входных токенов и тридцати долларов за миллион выходных токенов, без изменений по сравнению с предыдущей версией.
  • Обновление v1.1 добавляет эндпоинт, совместимый с Claude Code, позволяя разработчикам использовать Fugu в качестве замены бэкенда без изменения существующих рабочих процессов в терминале.
  • Sakana AI по-прежнему исключает пользователей из Европейского союза и Европейской экономической зоны, ссылаясь на соответствие GDPR и специфические регуляторные требования ЕС.
Sakana AI выпустила Fugu Ultra v1.1 и заявляет о превосходстве над Fable 5 без его включения в пул моделей

Sakana AI выпустила Fugu Ultra v1.1 — обновлённую версию ИИ-маршрутизатора моделей, который распределяет каждый пользовательский запрос по пулу общедоступных передовых больших языковых моделей. Маршрутизация моделей — динамический выбор наиболее производительной модели для каждого отдельного запроса вместо использования единой модели — стала практической стратегией для разработчиков, стремящихся сбалансировать стоимость, задержку и качество вывода по мере роста числа конкурирующих фронтальных моделей. Токийская компания заявляет, что обновление обеспечивает прирост производительности до 7,9 балла по сравнению с предыдущим релизом v1.0, причём наиболее значительные улучшения наблюдаются на бенчмарках ProgramBench и TerminalBench 2.1.

По данным Sakana, Fugu v1.1 теперь предположительно превосходит Fable 5 по ряду бенчмарков — хотя Fable 5 не входит в пул выбора моделей маршрутизатора. Все приведённые показатели производительности получены из собственных внутренних тестов Sakana, и на данный момент независимая проверка не публиковалась.

Ценообразование сервиса осталось неизменным: 5 долларов за миллион входных токенов и 30 долларов за миллион выходных токенов. Sakana сообщает, что требуется примерно две недели обучения и оценки, прежде чем новая передовая модель добавляется в доступный пул маршрутизатора. Базовая архитектура описана в техническом отчёте.

Обновление v1.1 также добавляет эндпоинт, совместимый с Claude Code, позволяя разработчикам вызывать Fugu напрямую из терминала. Claude Code — это консольный помощник для программирования от Anthropic, а совместимость с форматом его API означает, что разработчики, уже использующие этот инструмент, могут заменить бэкенд на Fugu без изменения своих рабочих процессов. С момента первоначального запуска Fugu доступен на платформах, включая OpenRouter и Vercel.

Первая версия Fugu получила сдержанный приём со стороны некоторых пользователей и критиков, которые отмечали высокий расход токенов, медленную скорость ответа и неудовлетворительное качество вывода.

Sakana AI по-прежнему не обслуживает пользователей в Европейском союзе и Европейской экономической зоне, ссылаясь на вопросы соответствия GDPR и то, что компания описывает как «специфические нормы ЕС».

Дополнительная информация доступна на официальной странице Fugu.