Le Claude Opus 5 d'Anthropic surpasse Fable 5 sur la plupart des benchmarks à moitié prix
Points clés
- •Claude Opus 5 a été lancé le 24 juillet à 5 $ par million de tokens d'entrée, soit exactement la moitié du prix de Fable 5, tout en le surpassant sur presque tous les benchmarks majeurs.
- •Opus 5 est désormais le modèle par défaut sur Claude Max et l'option la plus puissante sur Claude Pro, remplaçant effectivement Fable 5 en tant que modèle phare d'Anthropic pour les abonnés après que ce dernier a fait face à des problèmes de contrôle des exportations et des restrictions en crédits uniquement.
- •Sur Frontier-Bench v0.1, Opus 5 a atteint 43,3 %, surpassant Fable 5 à 33,7 % et le GPT-5.6 Sol d'OpenAI à 34,4 % sur les tâches d'ingénierie logicielle de bout en bout.
- •Lovable a signalé une amélioration de 22 % par rapport à Opus 4.7 sur les tâches de codage agentique, tandis que Zapier a enregistré un score parfait sur AutomationBench pour Opus 5 sur un flux de travail complet de prévention du désabonnement.
- •Cette sortie intervient une semaine après que Moonshot AI, basée à Pékin, a présenté Kimi K3, un modèle open-weight de 2,8 billions de paramètres que les benchmarks indépendants classent au troisième rang mondial derrière Fable 5 et GPT-5.6 Sol.

Anthropic a publié Claude Opus 5 le 24 juillet, au prix de 5 $ par million de tokens d'entrée — identique à son prédécesseur Opus 4.8 et exactement la moitié du coût de Fable 5 — tout en surpassant Fable 5 sur la plupart des benchmarks majeurs. Le nouveau modèle est désormais par défaut sur Claude Max et l'option la plus puissante sur Claude Pro, remplaçant effectivement Fable 5 comme choix privilégié pour la plupart des abonnés.
Opus 5 est moins coûteux à exploiter pour les entreprises que le modèle phare d'Anthropic, Claude Fable 5, que l'entreprise avait positionné comme son produit frontière quotidien pour les utilisateurs payants. Il surpasse également Fable 5 sur plusieurs benchmarks significatifs. Pour les entreprises qui construisent des produits sur des API d'IA, où les coûts de tokens augmentent directement avec le volume d'utilisateurs, un modèle qui égale ou dépasse les performances frontières à moitié prix peut modifier significativement l'économie unitaire.
Structure des paliers de modèles d'Anthropic
La gamme d'Anthropic s'étend sur quatre paliers. Haiku est rapide et économique. Sonnet est intermédiaire. Opus sert de cheval de bataille. Au-dessus se situe la classe Mythos, un palier qu'Anthropic a introduit ce printemps, qui comprend Claude Fable 5 pour le public et Claude Mythos 5, une version avec moins de restrictions disponible via Project Glasswing pour les chercheurs en cybersécurité agréés et les opérateurs d'infrastructures critiques.
Fable 5 a connu un parcours mouvementé en tant que modèle phare pour les abonnés. Il a été lancé le 9 juin, puis retiré mondialement trois jours plus tard après que le gouvernement américain a émis une ordonnance d'urgence de contrôle des exportations citant une vulnérabilité de jailbreak. Il est revenu le 30 juin mais est immédiatement passé à un modèle à crédits uniquement, n'étant plus inclus dans les forfaits standard. Opus 5 occupe désormais la place que Fable 5 n'a pas pu tenir.
Lovable, une plateforme de développement avec des millions d'utilisateurs, a testé Opus 5 sur ses évaluations internes et a noté que les gains vont au-delà des scores bruts. « Ce n'est pas seulement meilleur sur nos tâches de codage agentique les plus difficiles, en hausse de 22 % par rapport à Opus 4.7, c'est plus stable, avec beaucoup moins de variance d'une exécution à l'autre », a déclaré Fabian Hedin dans une déclaration partagée par Anthropic.
Résultats des benchmarks
Opus 5 surpasse Fable 5 sur presque toutes les métriques pertinentes pour les utilisateurs quotidiens, bien qu'il ne porte pas la désignation de classe Mythos.
Sur Frontier-Bench v0.1 — un benchmark testant si les agents de codage IA peuvent accomplir des tâches réelles d'ingénierie logicielle de bout en bout, noté en pourcentage de tâches réussies — Opus 5 a atteint 43,3 %. Fable 5 a obtenu 33,7 %, tandis que le GPT-5.6 Sol d'OpenAI, le principal rival commercial d'Anthropic, a obtenu 34,4 %.
L'écart le plus important est apparu sur ARC-AGI-3, un test de résolution de problèmes authentique basé sur des énigmes inédites qu'un modèle n'aurait pas pu mémoriser à partir des données d'entraînement, noté en pourcentage d'énigmes résolues. Opus 5 a atteint 30,2 % ; GPT-5.6 Sol a obtenu 7,8 % ; et Fable 5 n'a pas été testé du tout.
Sur GDPval-AA v2 — un benchmark de travail cognitif noté via le système Elo, le système de classement de type échecs utilisé pour mesurer la performance relative sur des tâches professionnelles réelles — Opus 5 a atteint 1 861, contre 1 747 pour Fable 5 et 1 736 pour GPT-5.6 Sol.
Zapier a testé Opus 5 sur AutomationBench, une évaluation notant si un modèle peut mener à bien un flux de travail commercial complet de bout en bout sans intervention humaine. Leur verdict : le modèle « a pris un classeur brut sur la santé des comptes et a exécuté une séquence complète de prévention du désabonnement de bout en bout : identification des comptes à risque, alerte au propriétaire approprié, et synthèse pour les opérations de rétention. Les modèles précédents n'ont pas réussi ; Opus 5 a atteint 100 %. »
Anthropic positionne également Opus 5 comme une mise à niveau pour la recherche. Ultima Genomics, une entreprise de séquençage ADN, a déclaré que le modèle « se comporte plus comme un scientifique minutieux que n'importe quel modèle que nous avons testé. Il recourt aux bons tests statistiques pour écarter les facteurs confondants, vérifie ses propres résultats par des méthodes indépendantes et reste sur la bonne voie tout au long des analyses longues à étapes multiples. »
Ceci dit, le juridique et la santé sont les deux seuls domaines où Fable 5 excelle avec une légère marge.
Panorama concurrentiel élargi
Cette sortie intervient une semaine après que Moonshot AI, une startup basée à Pékin soutenue par Alibaba, a dévoilé Kimi K3 — un modèle open-weight de 2,8 billions de paramètres, ce qui signifie que n'importe qui peut télécharger le code sous-jacent pour l'exécuter de manière indépendante. Moonshot le décrit comme le plus grand système d'IA ouvert au monde. Les benchmarks indépendants classent systématiquement Kimi K3 au troisième rang mondial, derrière Fable 5 et GPT-5.6 Sol, bien qu'il surpasse ces deux derniers dans des domaines spécifiques. Cette approche open-weight, qui contraste avec le modèle d'accès exclusivement via API utilisé par Anthropic et OpenAI, permet aux organisations d'exécuter les modèles sur leur propre matériel — bien qu'un système de 2,8 billions de paramètres exige des ressources de calcul considérables pour fonctionner.
Tarification et disponibilité
Opus 5 est disponible dès maintenant via API à 5 $ par million de tokens d'entrée et 25 $ par million de tokens de sortie. (Les tokens sont l'unité de base d'information qu'un modèle d'IA traite en entrée et en sortie.) Un mode Fast fonctionnant à environ 2,5 fois la vitesse par défaut est également disponible au double du prix de base — 10 $ par million de tokens d'entrée et 50 $ par million de tokens de sortie.
Cette sortie pourrait atténuer les préoccupations persistantes concernant la disponibilité publique limitée de Fable 5. Opus 5 est également accessible par abonnement pour tous les utilisateurs.