Anthropic's Claude Opus 5.5 evenaart vlaggenschip Fable 5.1 voor 60% van de prijs
Belangrijkste punten
- •De tokenprijzen van Opus 5.5—$4 per miljoen inputtokens en $20 per miljoen outputtokens—liggen 20% onder de voorganger en 60% onder het vlaggenschip Fable 5.1, met cache-readkosten die met 60% dalen naar $0,20 per miljoen tokens.
- •Anthropic's benchmarks plaatsen Opus 5.5 boven zowel Fable 5.1 als Opus 5 op coding- en kenniswerk-tests, waaronder een slagingspercentage van 66,4% op Terminal-Bench 4.0 en een Elo-score van 1846 op GDPval-AA v2.1.
- •GPT-6 Astra scoort nog steeds hoger dan Opus 5.5 op AutomationBench (41,4% tegenover 40,0%) en op Terminal-Bench-Science 0.1 (64,6% tegenover 58,7%).
- •Het model wordt geleverd met dezelfde cybersecurity- en biologie-beveiligingsmaatregelen als Fable 5.1, en de meeste cybersecurity-taken worden nog steeds automatisch doorgestuurd naar het oudere Opus 4.8.
- •Opus 5.5 is het derde vlaggenschip-model dat Anthropic sinds de zomer uitbracht, na een essay van CEO Dario Amodei waarin hij de sector opriep het tempo van AI-capaciteitsverbeteringen te vertragen.

Anthropic bracht dinsdag Claude Opus 5.5 uit, het eerste model in wat het bedrijf de Claude 5.5-familie noemt. Het model is geprijsd op $4 en $20 per miljoen input- en outputtokens—40% goedkoper dan Opus 5 bij standaardinstellingen—and Anthropic zegt dat het op de meeste taken gelijk is aan Claude Fable 5.1, het duurste vlaggenschip van het bedrijf.
Volgens Anthropic's eigen cijfers gaat Opus 5.5 zowel Fable 5.1 als voorganger Opus 5 voorbij op coding- en kenniswerk-tests, al verslaat GPT-6 Astra het nog steeds op AutomationBench en Terminal-Bench-Science 0.1. Het nieuwe model wordt uitgerold met dezelfde cybersecurity- en biologie-beveiligingsmaatregelen als Fable 5.1.
De release onderbiedt zowel het model dat het vervangt als het vlaggenschip dat het achtervolgt: Opus 5.5 is 20% goedkoper in gebruik dan Opus 5 en 60% goedkoper dan Fable 5.1, het meest geavanceerde aanbod van het bedrijf.
Het model is Anthropic's meest geavanceerde, zowel qua versie (5.5 tegenover Fable's 5.1) als qua familieniveau—Opus is het grootste publiek beschikbare model, gevolgd door Sonnet, met Haiku als kleinste. Anthropic erkent dat het werkelijke verschil tussen Fable en Opus kleiner is dan de benchmarkscores doen vermoeden, maar de publieke beschikbaarheid van Opus via betaalde abonnementen en de lagere kosten per token maken het tot de voor de hand liggende keuze voor de meeste Claude-gebruikers.
De twee productlijnen hebben dit jaar afgewisseld wie aan de leiding stond. Opus 5 lanceerde in juli en was goedkoper en scoorde op de meeste benchmarks beter dan Fable 5. Fable 5.1 kwam begin september uit en draaide dat om, en versloeg Opus 5 op elke benchmark die Anthropic publiceerde. Opus 5.5 sluit de kloof opnieuw—ditmaal op prijs in plaats van op ruwe scores.
Lovable, een ontwikkelaarsplatform dat in juli Opus 5 door zijn eigen coding liet lopen, verklaarde in een door Anthropic gedeelde verklaring dat het eerdere model "stabieler was, met veel minder variatie tussen runs" dan wat er aan voorafging—precies het efficiëntie-verhaal dat Anthropic nu opnieuw verkoopt.
Opus 5.5 is ook het eerste model dat Anthropic uitbracht sinds CEO Dario Amodei een essay publiceerde waarin hij de sector opriep tot vertraging, met het argument dat de groei van AI-capaciteiten sneller verloopt dan de veiligheidstesten die die groei in toom moeten houden. "We moeten het tempo waarmee we de capaciteiten van AI-modellen verbeteren vertragen", schreef Amodei eerder deze maand. Anthropic heeft sinds de zomer drie vlaggenschip-modellen uitgebracht—Opus 5 in juli, Fable 5.1 begin september en Opus 5.5 op dinsdag—precies het tempo dat volgens het essay vertraagd moet worden.
Anthropic meet veel van deze vooruitgang via agentisch coderen—werk dat door een AI-agent wordt uitgevoerd, een model dat zelfst meerstaps-acties onderneemt in plaats van slechts een enkele prompt te beantwoorden.
Op Terminal-Bench 4.0, dat test of een agent complexe professionele taken binnen een command-line-interface kan voltooien en resultaten uitdrukt als percentage voltooide taken, behaalde Opus 5.5 66,4%, vóór Fable 5.1's 55,8% en GPT-6 Astra's 57,9%. FrontierCode, dat nagaat of de codeveranderingen van een agent daadwerkelijk zouden worden gemerged in een echte engineeringpijplijn en daarbij dezelfde slagingspercentage-methodiek gebruikt, zette Opus 5.5 op 54,4% tegenover Fable 5.1's 50,3%.
Op GDPval-AA v2.1, dat professioneel werk in de echte wereld beoordeelt over 44 beroepen heen met behulp van Elo—het schaakachtige ranglijstsysteem dat relatieve vaardigheid meet in plaats van een vast percentage—scoorde Opus 5.5 een 1846, tegenover Fable 5.1's 1735 en Opus 5's 1708.
Opus 5.5 leidt echter niet overal. Op AutomationBench, een door Zapier gebouwde benchmark die meet of een agent een volledige bedrijfsworkflow van begin tot eind zonder menselijke hulp kan uitvoeren, steekt GPT-6 Astra's 41,4% er met 40,0% van Opus 5.5 net bovenuit. Op Terminal-Bench-Science 0.1, dat agentisch wetenschappelijk onderzoek binnen een command-line-omgeving test met dezelfde slagingspercentage-methodiek, verslaat Astra's 64,6% Opus 5.5's 58,7% met een grotere marge.
De grootste verkoopargument de kostprijs. Inputtokens—de tekstbrokken die een model leest en schrijft, geprijsd per miljoen—kosten nu $4 voor Opus 5.5 tegenover $5 voor Opus 5, en outputtokens dalen van $25 naar $20. Cache-reads—het hergebruiken van context die een model al heeft verwerkt in plaats van die opnieuw te verwerken, en de grootste kostenpost bij lange agentische coding-sessies—dalen met 60% naar $0,20 per miljoen tokens. De structuur zorgt ervoor dat de korting zich there where it counts stapelt: lange agentische coding-sessies worden vooral afgerekend op cache-reads, dus de stevigste verlaging raakt de grootste kostenpost.
Omdat Opus 5.5 op die twee capaciteiten gelijk is aan Anthropic's Mythos-klasse modellen—het meest beperkte niveau van het bedrijf, gereserveerd voor gescreende cybersecurity- en biologie-onderzoekers—wordt het uitgerold met dezelfde beveiligingsmaatregelen als Fable 5.1. De meeste cybersecurity-taken worden nog steeds automatisch doorgestuurd naar het oudere Opus 4.8, een praktijk waar veel ontwikkelaars en gebruikers eerder over klaagden. Het valt nog af te wachten of de komst van Opus 5.5 daar verandering in brengt.
Opus 5.5 is nu beschikbaar op Anthropic's platforms, waaronder Amazon Web Services, Google Cloud en Microsoft Azure. Sonnet 5.5 en Haiku 5.5 volgen in de komende weken, aldus Anthropic, met dezelfde prijsverlagingen voor de rest van de lijn.