ActualitésActionsClaude Sonnet 5.5 d'Anthropic frôle les performances d'Opus tout en réduisant les coûts par tâche jusqu'à 30 %

Claude Sonnet 5.5 d'Anthropic frôle les performances d'Opus tout en réduisant les coûts par tâche jusqu'à 30 %

Auteur: CryptoBriefing·

Points clés

  • •Anthropic a lancé Claude Sonnet 5.5, le second modèle de sa famille Claude 5.5, ciblant le codage, la productivité quotidienne et la création de documents à un niveau de coût inférieur.
  • •Le modèle produit des résultats plus de 30 % plus rapidement que Sonnet 5 et réduit les coûts par tâche jusqu'à 30 % grâce à l'efficacité en tokens, le prix par token restant à 2 $ par million de tokens d'entrée et 10 $ par million de tokens de sortie.
  • •Sonnet 5.5 a devancé Opus 5.5 sur Terminal-Bench 4.0, avec 70,6 % contre 66,4 %, et s'est approché à deux points sur GDPval-AA, obtenant 1 844 contre 1 846 pour Opus.
  • •Dans les évaluations de codage, Sonnet 5.5 a progressé d'environ 10 points par rapport à Sonnet 5 sur FrontierCode en effort élevé, tout en coûtant environ quinze fois moins par tâche.
  • •Il s'agit du premier modèle Sonnet à intégrer des dispositifs de cybersécurité comparables à ceux des gammes supérieures d'Anthropic, un changement qui peut rediriger certaines demandes de cybersécurité à risque élevé vers Sonnet 5.
Claude Sonnet 5.5 d'Anthropic frôle les performances d'Opus tout en réduisant les coûts par tâche jusqu'à 30 %

Anthropic a lancé Claude Sonnet 5.5, le second modèle de sa famille Claude 5.5, le positionnant comme une option plus rapide et plus économique pour le codage, le travail quotidien et la création de documents.

Le modèle génère des résultats plus de 30 % plus rapidement que son prédécesseur, Sonnet 5, et coûte jusqu'à 30 % moins cher par tâche lors des tests de l'entreprise, selon l'annonce d'Anthropic. Ces économies proviennent en grande partie de l'efficacité : Sonnet 5.5 nécessite moins de tokens pour accomplir le même travail. Le prix par token reste lui-même inchangé, à 2 $ par million de tokens d'entrée et 10 $ par million de tokens de sortie. Cette distinction compte pour les équipes qui utilisent le modèle à grande échelle : les prix de liste restant inchangés, les économies se réalisent au niveau des tâches, où les coûts s'accumulent avec l'usage.

Anthropic présente Sonnet 5.5 comme un complément à moindre coût de Claude Opus 5.5. Opus reste orienté vers des travaux complexes et ouverts exigeant un jugement soutenu, tandis que Sonnet est conçu pour des tâches plus clairement définies, telles que la correction de bugs et la création de documents, de présentations et de tableurs.

Sur certaines évaluations, toutefois, l'écart entre les deux modèles s'est considérablement réduit. Sonnet 5.5 a obtenu un meilleur score qu'Opus 5.5 sur Terminal-Bench 4.0, avec 70,6 % contre 66,4 %. Sur GDPval-AA, un benchmark mesurant le travail de connaissances en conditions réelles, les deux modèles ont été presque à égalité, Sonnet 5.5 obtenant 1 844 contre 1 846 pour Opus 5.5. Anthropic a indiqué qu'à certains niveaux d'effort, Sonnet 5.5 affiche des performances comparables à celles d'Opus 5.5, même si l'entreprise continue de considérer Opus comme le modèle le plus performant pour les tâches complexes nécessitant un jugement soutenu. Pour les acheteurs hésitant entre les deux gammes, ces résultats offrent un point de repère sur la capacité mesurée conservée au coût par tâche inférieur de Sonnet.

Le codage est l'un des domaines d'amélioration les plus importants. Anthropic a indiqué que Sonnet 5.5 a gagné environ 10 points par rapport à Sonnet 5 sur FrontierCode en effort élevé, tout en coûtant environ quinze fois moins par tâche. Le meilleur score du modèle sur CursorBench s'est également situé à environ deux points d'Opus 5.5.
Le travail de connaissances au sens large a également enregistré des gains significatifs. Anthropic a déclaré que Sonnet 5.5 s'est approché d'Opus 5.5 en matière d'utilisation d'ordinateur et de reconnaissance de graphiques, tout en surpassant Sonnet 5 sur l'ensemble de ses évaluations internes et externes.

Sonnet 5.5 est également le premier modèle Sonnet à être lancé avec des dispositifs de cybersécurité comparables à ceux des modèles haut de gamme d'Anthropic, à la suite d'une amélioration substantielle de ses capacités en matière de cybersécurité par rapport à la génération précédente. Par conséquent, les demandes de cybersécurité à risque élevé peuvent être redirigées vers Sonnet 5, tandis que les tâches de développement courantes restent disponibles — un arbitrage entre des dispositifs de sécurité renforcés et la disponibilité des tâches que les équipes utilisant le modèle pour des travaux liés à la sécurité devront prendre en compte.

Le modèle est disponible sur les plateformes d'Anthropic ainsi que via Amazon Web Services, Google Cloud et Microsoft Azure. Les développeurs peuvent y accéder via la plateforme Claude en utilisant l'identifiant claude-sonnet-5-5.

Anthropic a ajouté que Claude Haiku 5.5, un modèle destiné aux applications à fort volume et sensibles aux coûts, rejoindra la famille Claude 5.5 dans les prochaines semaines. Une fois lancé, la famille couvrira l'ensemble de la gamme d'Anthropic, depuis les travaux complexes prolongés jusqu'au déploiement à fort volume.