Sakana AI lance Fugu Ultra v1.1 et affirme qu’il surpasse Fable 5 sans l’inclure dans son pool de modèles
Points clés
- •Sakana AI affirme que Fugu Ultra v1.1 apporte des gains de performance allant jusqu’à 7.9 points par rapport à la version précédente, avec les plus fortes améliorations sur les benchmarks ProgramBench et TerminalBench 2.1.
- •Tous les chiffres de performance de Fugu v1.1 proviennent des tests internes de Sakana, et aucune vérification indépendante n’a été rendue publique.
- •Le tarif de Fugu reste fixé à cinq dollars par million de tokens d’entrée et trente dollars par million de tokens de sortie, sans changement par rapport à la version précédente.
- •La mise à jour v1.1 introduit un endpoint compatible avec Claude Code, permettant aux développeurs d’utiliser Fugu comme backend de remplacement sans modifier leurs flux de travail existants dans le terminal.
- •Sakana AI continue d’exclure les utilisateurs de l’Union européenne et de l’Espace économique européen, invoquant la conformité au RGPD et des préoccupations réglementaires propres à l’UE.

Sakana AI a publié Fugu Ultra v1.1, une version mise à jour de son routeur de modèles d’IA qui répartit chaque requête utilisateur entre un pool de grands modèles de langage de premier plan accessibles publiquement. Le routage de modèles — qui consiste à sélectionner dynamiquement le modèle le plus performant pour chaque requête individuelle plutôt que de s’appuyer sur un seul modèle — s’est imposé comme une stratégie pratique pour les développeurs cherchant à équilibrer coûts, latence et qualité des résultats à mesure que le nombre de modèles de pointe compétitifs augmente. L’entreprise basée à Tokyo affirme que cette mise à jour apporte des gains de performance allant jusqu’à 7.9 points par rapport à la version précédente v1.0, les améliorations les plus importantes ayant été observées sur les benchmarks ProgramBench et TerminalBench 2.1.
Selon Sakana, Fugu v1.1 surpasserait désormais Fable 5 sur certains benchmarks — alors même que Fable 5 n’est pas inclus dans le pool de sélection de modèles du routeur. Tous les chiffres de performance cités proviennent des propres tests internes de Sakana, et aucune vérification indépendante n’a été publiée à ce stade.
Le prix du service reste inchangé à $5 par million de tokens d’entrée et $30 par million de tokens de sortie. Sakana indique qu’il faut environ deux semaines d’entraînement et d’évaluation avant qu’un nouveau modèle de premier plan soit ajouté au pool disponible du routeur. L’architecture sous-jacente est détaillée dans le rapport technique.
La mise à jour v1.1 introduit également un endpoint compatible avec Claude Code, permettant aux développeurs d’appeler Fugu directement depuis le terminal. Claude Code est l’assistant de codage en ligne de commande d’Anthropic, et la compatibilité avec son format d’API signifie que les développeurs utilisant déjà l’outil peuvent remplacer le backend par Fugu sans modifier leurs flux de travail. Depuis son lancement initial, Fugu est accessible via des plateformes telles que OpenRouter et Vercel.
La première version de Fugu avait reçu un accueil mitigé de la part de certains utilisateurs et critiques, qui avaient évoqué une consommation élevée de tokens, des temps de réponse plus lents et une qualité de sortie jugée décevante.
Sakana AI continue d’exclure les utilisateurs de l’Union européenne et de l’Espace économique européen, invoquant des préoccupations liées à la conformité au RGPD et ce que l’entreprise décrit comme des « réglementations propres à l’UE ».
De plus amples détails sont disponibles sur la page officielle de Fugu.