Anthropic lanceert Claude Sonnet 5.5 nu de evaluatie van AI verschuift naar kosten per taak
Belangrijkste punten
- •Anthropic stelt dat Claude Sonnet 5.5 meer dan 30% sneller werkt dan zijn voorganger en de meeste taken tot 30% goedkoper voltooit door minder tokens te gebruiken, terwijl de prijzen per token gelijk blijven.
- •Sonnet 5.5 behoudt de bestaande prijzen van $2 per miljoen inputtokens, $10 per miljoen outputtokens en $0,20 per miljoen cache-read tokens.
- •Het model scoort 70,6% op Terminal-Bench 4.0 tegenover 10,3% voor Sonnet 5, maar onafhankelijke data toont dat concurrenten zoals GPT-6 Sol en Xiaomi's MiMo-V2.6-Pro vergelijkbare intelligentieniveaus bereiken tegen aanzienlijk lagere kosten per taak.
- •Onderzoek in het artikel toont dat de kosten van een bepaald AI-prestatieniveau sinds 2023 met circa 47% per kwartaal zijn gedaald, maar Gartner voorspelt dat de totale inferentie-uitgaven per agentische workflow tot 2028 met meer dan vijf keer zullen stijgen.
- •Anthropic, dat circa 80% van zijn omzet uit zakelijke klanten haalt, bereidt zich naar verluidt voor op een beursintroductie, met Haiku 5.5 die binnen enkele weken wordt verwacht.

Anthropic bracht Claude Sonnet 5.5 uit op 28 september, het tweede model in de Claude 5.5-serie, en kondigde de lancering aan via een officiële post op X. De lancering valt samen met de aanloop van het bedrijf naar een beursintroductie, aldus Reuters. Het onderstreept tevens een verandering in de criteria waarmee AI-technologie wordt beoordeeld: ruime benchmarkprestaties blijven een belangrijke overweging, maar bedrijven wegen steeds zwaarder hoe duur het is om resultaten te behalen met een specifiek model.
Anthropic stelt dat Sonnet 5.5 meer dan 30% sneller werkt dan Sonnet 5 en de meeste taken tot 30% goedkoper kan voltooien, ook al blijven de tokenprijzen ongewijzigd. Volgens de lanceerpagina van het model komt de kostenbesparing voort uit het gebruik van minder tokens voor hetzelfde werk.
Dezelfde prijs, minder tokens
Sonnet 5.5 is geprijsd op $2 per miljoen inputtokens, $10 voor outputtokens en $0,20 voor cache-read tokens — het gereduceerde tarief voor het hergebruik van context die het model al heeft verwerkt. Opus 5.5, dat gespecialiseerd is in complexe redeneer- en beoordelingstaken, kost respectievelijk $4 en $20 voor input- en outputtokens. Sonnet is gepositioneerd voor alledaagse werkbelastingen zoals programmeren, documentgeneratie en spreadsheets.
De prijsstelling zet efficiëntie centraal in de discussie. Voor veel taken hebben bedrijven het krachtigste beschikbare model niet nodig; een goedkoop model dat een taak consequent voltooit, kan zwaarder wegen dan enkele punten hoger scoren op een benchmark. Dieiek is bijzonder belangrijk voor Anthropic, dat volgens Reuters circa 80% van zijn omzet uit zakelijke klanten haalt.
Benchmarks vertellen niet langer het hele verhaal
Anthropic stelt dat Sonnet 5.5 70,6% scoort op Terminal-Bench 4.0, een agentische benchmark die modellen test op echte terminaltaken, tegenover 10,3% voor Sonnet 5. Maar de Artificial Analysis leaderboard van onafhankelijke beoordelaar Artificial Analysis laat zien waarom benchmarkresultaten slechts een deel van het verhaal zijn. Bij maximale inspanning behaalt Sonnet 5.5 een score van 56 op de intelligentieschaal, tegen een geschatte kosten van $7,60 per taak. GPT-6 Sol haalt 48 punten tegen $1,06 per taak, terwijl Xiaomi's MiMo-V2.6-Pro 46 scoort voor slechts $0,13. Met andere woorden: een model dat leidt op intelligentie leidt niet noodzakelijk op kostenefficiëntie — en bij werkbelastingen met een hoog volume stapelen dergelijke verschillen per taak zich snel op.
Die kostenverschillen duwen bedrijven richting multi-modelstrategieën: moeilijkere taken worden toegewezen aan premiumsystemen, terwijl routinebouw werk wordt doorgestuurd naar goedkopere alternatieven. Deze aanpak laat organisaties alleen betalen voor topcapaciteit waar dat echt nodig is.
De prijs van het denken blijft dalen
De verschuiving past in een veel grotere trend. Volgens een Epoch AI-rapport gepubliceerd op 22 september is de kosten van het behalen van een bepaald niveau van AI-prestaties sinds 2023 met ongeveer 47% per kwartaal gedaald — een jaarlijkse reductie van circa dertien keer. Een apart Cryptopolitan-rapport van 29 september stelt dat zakelijke kopers steeds vaker het meest betaalbare model verkiezen dat het vereiste werk kan voltooien, terwijl lage prijzen het voor bedrijven ook gemakkelijker maken om het gelijktijdig draaien van meerdere modellen te rechtvaardigen.
Goedkopere tokens, hogere rekeningen
Lagere eenheidskosten garanderen echter geen lagere totale AI-uitgaven. Een Gartner-rapport gepubliceerd op 17 augustus, getiteld "Gartner Predicts AI Inference Costs Per Agentic Workflow Will Increase More Than Fivefold Through 2028", beschrijft een "inferentieparadox": dalende tokenprijzen stimuleren complexere workflows, wat het totale tokenverbruik opdrijft. Eenheidsprijzen en totale uitgaven zijn verschillende hendels — de eerste stelt de kosten per token vast, terwijl de tweede afhangt van hoeveel tokens een workflow verbruikt.
"Product leaders cannot rely on more efficient token economics to rationalize AI costs," aldus Will Sommer, Senior Director Analyst bij Gartner, in rapport van 17 augustus 2026.
Wie krijgt eigenlijk de goedkopere AI
Volgens Microsofts Global AI Diffusion Report hebben goedkope en open-weight modellen het potentieel om de toegang tot AI aanzienlijk te verbeteren, met name in het mondiale zuiden. Toch zullen lagere modelkosten alleen de adoptie niet bepalen — infrastructuur, connectiviteit en vaardigheden blijven de doorslaggevende factoren of goedkopere AI daadwerkelijk wordt gebruikt.
Voor zakelijke kopers wijst Sonnet 5.5 de richting van de markt: het beste model is niet noodzakelijk het krachtigste, maar het model dat het werk goed kan doen tegen een redelijke prijs. Haiku 5.5, het volgende model in de serie, dat in de komende weken wordt verwacht, zou die verschuiving verder kunnen versterken door AI-werk met een hoog volume goedkoper te maken — en door het voor bedrijven moeilijker te maken om premiumprijzen voor routinetaken te rechtvaardigen.