NieuwsAandelenAnthropic lanceert Claude Sonnet 5.5, die beter programmeert dan Opus 5.5 voor de helft van de prijs

Anthropic lanceert Claude Sonnet 5.5, die beter programmeert dan Opus 5.5 voor de helft van de prijs

Auteur: Decrypt·

Belangrijkste punten

  • •Claude Sonnet 5.5 verschijnt met ongewijzigde prijzen van $2 per miljoen invoertokens en $10 per miljoen uitvoertokens, de helft van de tarieven die Anthropic voor Opus 5.5 rekent.
  • •Het nieuwe model versloeg Opus 5.5 bij de Terminal-Bench 4.0 programmeertests, met 70,6% tegenover 66,4% in de resultaten van Anthropic en 63,6% tegenover 59,6% in de onafhankelijke test van Artificial Analysis.
  • •Bij maximale inspanning genereerde Sonnet 5.5 ongeveer 193.000 tokens per taak, het meeste dat Artificial Analysis ooit heeft gemeten, tegen $7,60 per taak—zo'n 50% meer dan Sonnet 5.
  • •Anthropic zegt dat het model meer dan 30% sneller is dan Sonnet 5 en bijna een derde minder tokens per taak gebruikt, waardoor het goedkoper in gebruik is ondanks identieke listprijzen.
  • •Claude Haiku 5.5, ontworpen voor toepassingen met hoog volume en kostenbewuste gebruik, wordt in de komende weken verwacht en maakt de 5.5-generatie van Anthropic compleet.
Anthropic lanceert Claude Sonnet 5.5, die beter programmeert dan Opus 5.5 voor de helft van de prijs

Anthropic bracht maandag Claude Sonnet 5.5 uit, de nieuwste versie van het AI-model uit het middensegment en een upgrade van Sonnet 5, dat in juni verscheen. De prijzen zijn ongewijzigd: $2 per miljoen invoertokens en $10 per miljoen uitvoertokens—de helft van wat het bedrijf voor Opus 5.5 rekent.

Ondanks de lagere prijs scoort het model al hoger dan zijn grotere broer bij programmeren. Op Terminal-Bench 4.0 behaalde Sonnet 5.5 70,6% tegenover 66,4% voor Opus 5.5, volgens Anthropic. Artificial Analysis, een onafhankelijk testbureau, voerde een eigen versie van de benchmark uit en plaatste Sonnet 5.5 ook bovenaan: 63,6% tegenover 59,6%. Desondanks rangschikt het bedrijf het model als tweede op zijn ranglijst, achter Opus 5.5, en merkt op dat het meer tokens per taak gebruikte dan elk getest model.

Anthropic zegt dat het nieuwe model meer dan 30% sneller is dan zijn voorganger. "Sonnet 5.5 is het sterkst in goed afgebakende alledaagse taken, het oplossen van bugs en het maken van verzorgde documenten, presentaties en spreadsheets. Het heeft ook een scherp oog voor design," schreef het bedrijf.

Tokens zijn de tekstbrokjes die een AI-model leest en schrijft—iets korter dan een woord—en AI-bedrijven factureren per miljoen. Hoewel de stickerprijs gelijk is aan die van Sonnet 5, gebruikt het nieuwe model bijna een derde minder tokens per taak, waardoor het ondanks identieke tarieven goedkoper in gebruik is dan zijn voorganger.

Waar het model echt uitblinkt, is programmeren. Terminal-Bench 4.0 meet of een AI-agent complexe professionele taken kan voltooien door zelfstandig commando's te typen, gescoord als het aandeel voltooide taken. Sonnet 5.5 behaalde 70,6%. Opus 5.5 scoorde 66,4%, en Sonnet 5 kwam niet verder dan 10,3%. In gewone woorden: het goedkopere model voltooide meer taken.

De onafhankelijke test van Artificial Analysis bevestigt dit: 63,6% voor Sonnet 5.5, 59,6% voor Opus 5.5 en 59,1% voorAI's GPT-6 Astra. Het bedrijf benadrukte de vooruitgang van het model in een bericht op X:

Claude Sonnet 5.5 (max) makes large strides on Terminal-Bench, sitting among the top models for both Terminal-Bench 4.0 and Terminal-Bench-Science. In Terminal-Bench 4.0 it scores 64%, a 50 point increase over Claude Sonnet 5 (max), and slightly above 60% for Opus 5.5 and GPT-6… pic.twitter.com/7CPrhgmfxe

— Artificial Analysis (@ArtificialAnlys) September 28, 2026

De scores hangen ook af van de inspanningsinstelling, een knop die een model langer laat nadenken voor een beter antwoord—and een hogere rekening. Anthropic zegt dat Sonnet 5.5 bij hoge inspanning op FrontierCode gelijkwaardig is aan GPT-6 Sol voor ongeveer een vijfde van de kosten per taak.

Op GDPval-AA, dat echt professioneel werk in 44 beroepen beoordeelt met Elo—het schaakachtige ratingsysteem dat relatieve vaardigheid rangschikt—scoorde Sonnet 5.5 1844 tegenover 1846 voor Opus 5.5, feitelijk een gelijkspel. GPT-6 Sol scoorde 1487.

Concurrenten evenaren de prijs. OpenAI verlaagde GPT-6 Sol vorige week naar $2 en $10, terwijl GPT-5.6 Terra, het middensegmentmodel, wordt aangeboden voor $2 en $12. Sonnet 5.5 en GPT-6 Sol hebben nu identieke listprijzen—al laten de inspanningsinstellingen hierboven zien dat gelijke stickerprijzen niet garanderen dat de kosten per taak gelijk zijn. Anthropic publiceerde geen benchmarkcijfers voor Terra.

Het addertje onder het gras

De keerzijde is de praatgraagheid. Sonnet 5.5 is een grote prater: bij maximale inspanning schreef het ongeveer 193.000 tokens per testtaak, het meeste dat Artificial Analysis ooit heeft gemeten en circa 60% meer dan Opus 5.5. Dat kwam neer op $7,60 per taak, zo'n 50% boven Sonnet 5—een resultaat dat afbreuk doet aan Anthropic's bewering van tot 30% besparing.

Anthropic's besparingsclaims rusten op lagere instellingen. Bij gemiddelde inspanning, de standaard in zijn apps, zegt het bedrijf dat Sonnet 5.5 de beste programmeerscore van Sonnet 5 verslaat voor minder dan een tiende van de kosten. Artificial Analysis zegt dat hoge inspanning de beste waarde biedt. Voor gewone gebruikers betekent dat bijna vlaggenschip-programmeren voor een fractie van de prijs, zolang de knop maar laag blijft.

Er kanttekeningen blijven. Anthropic's benchmarktabel is zelf gerapporteerd, en Artificial Analysis testte een pre-releaseversie met een bug waarvan Anthropic verwacht dat deze weinig veranderde of de scores licht onderschatte—een reden om onafhankelijke resultaten op de definitieve versie in de gaten te houden. Het bedrijf zegt ook dat Opus 5.5 duidelijk sterker blijft in complex werk dat doorlopend oordeelsvermogen vereist.

Claude Haiku 5.5, gebouwd voor toepassingen met hoog volume en gevoelige kosten, verschijnt in de komendeken en maakt de 5.5-generatie van Anthropic compleet, naast Opus 5.5 en Sonnet 5.5.