Anthropic brengt Claude Fable 5.1 uit en verdubbelt predecessor op belangrijke benchmark ruimschoots
Belangrijkste punten
- •Fable 5.1 scoorde 52,6% op Terminal-Bench-Science 0.1, ruim het dubbele van Fable 5's 24,7%, en 55,8% op Terminal-Bench 4.0, vooruit op Opus 5's 52,3%.
- •De kosten voor cache-leesbewerkingen daalden 75%, wat typische workloadkosten met circa 25% verlaagt en sterk agentische workloads met tot 45%, terwijl de basisprijzing $10 input en $50 output per miljoen tokens blijft.
- •Fable 5.1 is uitgesloten van Pro-abonnementen en standaard Team-stoelen, die op betalen-naar-gebruik tegoeden leunen; Max- en premium Team- of Enterprise-stoelen bevatten het tot 50% van de wekelijkse gebruikslimieten.
- •Mythos 5.1 deelt hetzelfde onderliggende model als Fable 5.1, maar met andere veiligheidsfilters, en de toegang is beperkt tot gecontroleerde cybersecurity- en life-sciences-professionals via Anthropic's verificatieprogramma's.
- •Fable 5.1 verslaat Opus 5 op elke gepubliceerde benchmark, maar kost per token het dubbele: $10/$50 tegenover Opus 5's $5/$25 per miljoen tokens.

Anthropic bracht op 1 september Claude Fable 5.1 en Claude Mythos 5.1 uit, de eerste update van de Mythos-klasse modellenreeks sinds Fable 5 op 9 juni verscheen. Het nieuwe model scoorde 52,6% op Terminal-Bench-Science 0.1, tegenover 24,7% voor Fable 5, en 55,8% op Terminal-Bench 4.0, een stijging ten opzichte van 42,0%. De release past in een bredere trend op de markt van grensverleggende modellen, waar OpenAI, Google en Anthropic dit jaar elk opeenvolgende vlaggenschip-updates hebben uitgebracht, met opvallende benchmarkverschillen als belangrijkste concurrentiemaatstaf.
Cache-leesbewerkingen zijn nu 75% goedkoper, wat de kosten van typische workloads met ongeveer 25% verlaagt en van sterk agentische workloads met maar liefst 45%. De basisprijzing blijft ongewijzigd: $10 input en $50 output per miljoen tokens. Prompt-caching—het hergebruiken van eerder verwerkte invoer in plaats van deze bij elke aanroep opnieuw te verwerken—is bij grote modellaanbieders een standaardmiddel voor kostenbeheersing geworden, nu agentische workloads, die lange context over veel stappen herhalen, de rekeningen opdrijven.
Fable 5.1 is niet inbegrepen in Pro-abonnementen of standaard Team-stoelen, die op gebruikstegoeden draaien. Max-abonnementen en premium Team- of Enterprise-stoelen bevatten het model tot 50% van de wekelijkse limieten. Die indeling is relevant voor ontwikkelaars die bepalen waar workloads naartoe gaan: wat een model in de praktijk kost, hangt net zo goed af van het abonnement als van de gepubliceerde prijs per token.
Anthropic stelt dat de nieuwe modellen 's werelds meest geavanceerde zijn voor programmeren en kenniswerk. De release valt drie maanden in een lanceercyclus die al een exportcontrole-uitval van 18 dagen, een prijzenstrijd midden in de zomer over abonnements toegang en een julirelease van Claude Opus 5 kende die Fable 5 op prijs onderbood.
Volgens Anthropic zijn Fable 5.1 en Mythos 5.1 hetzelfde onderliggende model met verschillende veiligheidsfilters. Fable 5.1 is algemeen beschikbaar voor iedereen met een Claude-account. Mythos 5.1 blijft beperkt tot gecontroleerde professionals in cybersecurity en life sciences, via Anthropic's Cyber Verification Program en Life Sciences Verification Program, de opvolger van het Project Glasswing-toegangsspoor dat Mythos 5 afschermde.
Wat de benchmarks daadwerkelijk meten
Anthropic's opvallendste cijfer komt van Terminal-Bench-Science 0.1, een benchmark die test of een AI-agent wetenschappelijke onderzoektaken kan uitvoeren binnen een command-line-omgeving, gescoord als slagingspercentage. Fable 5.1 haalde 52,6%, tegenover 24,7% voor Fable 5 en 29,0% voor Opus 5—ruimschoots het dubbele van zijn voorganger.
Terminal-Bench 4.0 test agentisch programmeren via een terminal—het schrijven, uitvoeren en debuggen van code in meerstaps command-line-sessies—gescoord als percentage correct voltooide taken. Fable 5.1 scoorde 55,8%, tegenover 42,0% voor Fable 5 en vooruit op Opus 5's 52,3%. De nadruk op terminalgebaseerde, meerstaps taken weerspiegelt de verschuiving in de sector van antwoorden in één beurt naar agents die lange autonome workflows kunnen volhouden—een verschuiving die agentische benchmarks tot een gangbare maatstaf heeft gemaakt bij recente releases.
Mythos 5.1, draaiend met lichtere cybersecurity-filters, scoorde 60,9% op dezelfde test. Anthropic zegt dat het verschil taken omvat die de beveiligingsmaatregelen onderschepten en naar Opus 4.8 omleidde.
Op Humanity's Last Exam—een multidisciplinaire redeneertest opgebouwd uit vragen op expertniveau uit tientallen academische vakgebieden, gescoord als slagingspercentage—bereikte Fable 5.1 60,9% zonder externe tools en 65,0% mét, beide vooruit op Opus 5, waarmee dit Anthropic's meest geavanceerde model voor academische doeleinden is.
Waar het Opus 5 verslaat, en waar de rekening vertroebelt
Opus 5 verscheen in juli tegen de halve prijs per token van Fable 5 en scoorde op de meeste grote benchmarks hoger dan Fable 5, wat het vlaggenschip voor de meeste betalende gebruikers feitelijk overbodig maakte. Fable 5.1 keert dat om: het verslaat Opus 5 nu op elke benchmark die Anthropic publiceerde, ook die waarop Opus 5 eerder Fable 5 versloeg.
Maar Fable 5.1 kost per token nog steeds het dubbele van Opus 5—$10 input en $50 output tegenover $5 en $25 voor Opus 5. Tokens zijn de basale hoeveelheid informatie die een model kan verwerken, doorgaans ongeveer twee derde van een gemiddeld Engels woord, en bedrijven betalen naar gebruik omdat zware workloads abonnementsquota doorgaans snel uitputten. De vraag prijs versus prestatie—of een kleiner, goedkoper model goed genoeg is—stellen kopers inmiddels routinematig bij het aanbod van elke grote aanbieder, niet alleen dat van Anthropic.
Anthropic's pleidooi voor het model leunt op inspanningsniveaus in plaats van ruwe scores: het bedrijf zegt dat Fable 5.1 op laag of gemiddeld redeneerinzicht de oude resultaten van Fable 5 evenaart of overtreft tegen veel lagere kosten, terwijl de hoogste inspanningsniveaus gereserveerd blijven voor problemen waar alle andere modellen op vastlopen. Voor routineklussen wordt het argument om Opus 5 volledig over te slaan zwakker naarmate de inspanningsregelaar lager staat.
De toegang volgt dezelfde verdeling als bij Fable 5, nadat Anthropic maandenlang de voorwaarden aanpaste. Op Pro-abonnementen en standaard Team- of Enterprise-stoelen valt Fable 5.1 volledig onder betalen-naar-gebruik tegoeden tegen het API-tarief, omdat het geen deel uitmaakt van de wekelijkse limieten van die abonnementen. Op Max-abonnementen en premium Team- of Enterprise-stoelen is het standaard inbegrepen tot 50% van het weekverbruik.
Claude Fable 5.1 is nu beschikbaar op de Claude API, Amazon Bedrock, Google Cloud en Microsoft Foundry, onder het model-ID "claude-fable-5-1" (Anthropic). Beschikbaarheid op meerdere clouddplatformen sluit aan bij hoe Anthropic zijn modellen historisch distribueerde, zodat zakelijke klanten ze binnen hun bestaande cloudcontracten kunnen draaien in plaats van uitsluitend via Anthropic's eigen API.