Anthropic lance Claude Sonnet 5.5, qui surpasse Opus 5.5 en codage pour la moitié du prix
Points clés
- •Claude Sonnet 5.5 fait ses débuts avec une tarification inchangée de 2 $ par million de jetons d'entrée et 10 $ par million de jetons de sortie, soit la moitié des tarifs qu'Anthropic facture pour Opus 5.5.
- •Le nouveau modèle a battu Opus 5.5 sur les tests de codage Terminal-Bench 4.0, avec 70,6 % contre 66,4 % selon les résultats d'Anthropic et 63,6 % contre 59,6 % selon la course indépendante d'Artificial Analysis.
- •À effort maximal, Sonnet 5.5 a généré environ 193 000 jetons par tâche, le record mesuré par Artificial Analysis, pour un coût de 7,60 $ par tâche—environ 50 % de plus que Sonnet 5.
- •Anthropic affirme que le modèle est plus de 30 % plus rapide que Sonnet 5 et utilise près d'un de jetons en moins par tâche, le rendant moins coûteux à exécuter malgré des prix de liste identiques.
- •Claude Haiku 5.5, conçu pour les applications à fort volume et sensibles aux coûts, est attendu dans les prochaines semaines pour compléter la gamme de la génération 5.5 d'Anthropic.

Anthropic a publié Claude Sonnet 5.5 lundi, la dernière version de son modèle d'IA de milieu de gamme et une mise à niveau de Sonnet 5, lancé en juin. La tarification reste inchangée : 2 $ par million de jetons d'entrée et 10 $ par million de jetons de sortie—la moitié de ce que l'entreprise facture pour Opus 5.5.
Malgré ce prix plus bas, le modèle surclasse déjà son grand frère en codage. Sur Terminal-Bench 4.0, Sonnet 5.5 a obtenu 70,6 % contre 66,4 % pour Opus 5.5, selon Anthropic. Artificial Analysis, une société de tests indépendante, a exécuté sa propre version du benchmark et a également placé Sonnet 5.5 en tête, avec 63,6 % contre 59,6 %. La société le classe néanmoins deuxième au général derrière Opus 5.5 dans son classement et souligne qu'il a utilisé plus de jetons par tâche que tout modèle testé.
Anthropic affirme que le nouveau modèle est plus de 30 % plus rapide que son prédécesseur. « Sonnet 5.5 est le plus performant sur les tâches quotidiennes bien délimitées, la correction de bugs et la création de documents, présentations et feuilles de calcul soignés. Il a aussi un œil affûté pour le design », a écrit l'entreprise.
Les jetons sont les segments de texte qu'un modèle d'IA lit et écrit—légèrement plus courts qu'un mot—et les entreprises d'IA facturent au million. Si le prix affiché est identique à celui de Sonnet 5, le nouveau modèle utilise près d'un tiers de jetons en moins par tâche, ce qui le rend finalement moins coûteux à exécuter que son prédécesseur malgré des tarifs identiques.
Là où le modèle brille vraiment, c'est le codage. Terminal-Bench 4.0 mesure si un agent d'IA peut accomplir des tâches professionnelles complexes en tapant des commandes de manière autonome, avec un score correspondant à la part des tâches accomplies. Sonnet 5.5 a atteint 70,6 %. Opus 5.5 a obtenu 66,4 %, et Sonnet 5 n'a atteint que 10,3 %. En clair, le modèle le moins cher a accompli plus de tâches.
La course indépendante d'Artificial Analysis confirme : 63,6 % pour Sonnet 5.5, 59,6 % pour Opus 5.5 et 59,1 % pour GPT-6 Astra d'OpenAI. La société a souligné les progrès du modèle dans une publication sur X :
Claude Sonnet 5.5 (max) makes large strides on Terminal-Bench, sitting among the top models for both Terminal-Bench 4.0 and Terminal-Bench-Science. In Terminal-Bench 4.0 it scores 64%, a 50 point increase over Claude Sonnet 5 (max), and slightly above 60% for Opus 5.5 and GPT-6… pic.twitter.com/7CPrhgmfxe
— Artificial Analysis (@ArtificialAnlys) September 28, 2026
Les scores dépendent également du réglage d'effort, un curseur qui pousse le modèle à réfléchir plus longtemps pour une meilleure réponse—et une facture plus salée. Anthropic indique que Sonnet 5.5 à effort élevé égale GPT6 Sol sur FrontierCode pour environ un cinquième du coût par tâche.
Sur GDPval-AA, qui évalue le travail professionnel réel dans 44 professions à l'aide du classement Elo—le système de notation façon échecs qui mesure le niveau relatif—Sonnet 5.5 a obtenu 1844 contre 1846 pour Opus 5.5, soit un match nul effectif. GPT-6 Sol a obtenu 1487.
Les concurrents alignent leurs prix. OpenAI a réduit GPT-6 Sol à 2 $ et 10 $ la semaine dernière, tandis que GPT-5.6 Terra, son modèle de milieu de gamme, est affiché à 2 $ et 12 $. Sonnet 5.5 et GPT-6 Sol affichent désormais des prix de liste identiques—même si, comme le montrent les réglages d'effort ci-dessus, des tarifs affichés équivalents ne garantissent pas des coûts par tâche équivalents. Anthropic n'a publié aucun chiffre de benchmark pour Terra.
Le revers de la médaille
Le compromis, c'est la verbosité. Sonnet 5.5 est bavard : à effort maximal, il a généré environ 193 000 jetons par tâche de test, le record mesuré par Artificial Analysis et environ 60 % de plus qu'Opus 5.5. Cela représente 7,60 $ par tâche, soit environ 50 % de plus que Sonnet 5—un résultat qui contredit l'affirmation d'Anthropic d'économies allant jusqu'à 30 %.
Les promesses d'économies d'Anthropic reposent sur des réglages plus bas. À effort moyen, le réglage par défaut dans ses applications, l'entreprise affirme que Sonnet 5.5 surpasse le meilleur score de codage de Sonnet 5 pour moins d'un dixième du coût. Artificial Analysis estime que l'effort élevé offre le meilleur rapport qualité-prix. Pour les utilisateurs au quotidien, cela signifie un codage quasi au niveau des modèles phares pour une fraction du prix, tant que le curseur reste bas.
Des réserves subsistent. Le tableau de benchmarks d'Anthropic est auto-déclaré, et Artificial Analysis a testé une version de pré-lancement comportant un bug qui, selon Anthropic, a peu changé ou légèrement sous-estimé ses scores—l'une des raisons pour lesquelles les résultats indépendants sur la version finale méritent d'être suivis. L'entreprise précise également qu'Opus 5.5 reste nettement plus performant pour les travaux complexes exigeant un jugement soutenu.
Claude Haiku 5.5, conçu pour les applications à fort volume et sensibles aux coûts, est attendu dans les prochaines semaines et complétera la gamme de la génération 5.5 d'Anthropic aux côtés d'Opus 5.5 et de Sonnet 5.5.