NieuwsAandelenAnthropic's Claude Sonnet 5.5 nadert Opus-prestaties en verlaagt taakkosten tot 30%

Anthropic's Claude Sonnet 5.5 nadert Opus-prestaties en verlaagt taakkosten tot 30%

Auteur: CryptoBriefing·

Belangrijkste punten

  • •Anthropic lanceerde Claude Sonnet 5.5 als het tweede model in de Claude 5.5-familie, gericht op coderen, dagelijkse productiviteit en documentwerk tegen een lagere kostenklasse.
  • •Het model genereert output meer dan 30% sneller dan Sonnet 5 en verlaagt de kosten per taak tot 30% via token-efficiëntie, terwijl de tokenprijs ongewijzigd blijft op $2 per miljoen inputtokens en $10 per miljoen outputtokens.
  • •Sonnet 5.5 scoorde hoger dan Opus 5.5 op Terminal-Bench 4.0, met 70,6% tegenover 66,4%, en bleef op GDPval-AA binnen twee punten, met 1.844 tegenover 1.846 van Opus.
  • •Bij codeerevaluaties verbeterde Sonnet 5.5 op FrontierCode bij High effort ongeveer 10 punten ten opzichte van Sonnet 5, terwijl het per taak ongeveer één vijftiende kost.
  • •Het is het eerste Sonnet-model met cybersecuritymaatregelen die vergelijkbaar zijn met die van Anthropic's duurdere niveaus, een verandering die risicovollere cybersecurityverzoeken mogelijk terugstuurt naar Sonnet 5.
Anthropic's Claude Sonnet 5.5 nadert Opus-prestaties en verlaagt taakkosten tot 30%

Anthropic heeft Claude Sonnet 5.5 gelanceerd, het tweede model in de Claude 5.5-familie, gepositioneerd als een snellere, voordeligere optie voor codering, dagelijks werk en documentcreatie.

Het model genereert output meer dan 30% sneller dan zijn voorganger Sonnet 5 en is tot 30% goedkoper per taak in de tests van het bedrijf, volgens de aankondiging van Anthropic. De besparing komt vooral door efficiëntie: Sonnet 5.5 heeft minder tokens nodig om hetzelfde werk te verrichten. De prijs per token zelf blijft ongewijzigd op $2 per miljoen inputtokens en $10 per miljoen outputtokens. Dit onderscheid is belangrijk voor teams die het model op grote schaal gebruiken: omdat de lijstprijzen ongewijzigd zijn, komen de besparingen tot stand op taakniveau, waar de kosten met het gebruik oplopen.

Anthropic presenteert Sonnet 5.5 als een goedkopere aanvulling op Claude Opus 5.5. Opus blijft gericht op complex, open werk dat aanhoudend oordeelsvermogen vereist, terwijl Sonnet is ontworpen voor duidelijker afgebakende taken zoals het oplossen van bugs en het maken van documenten, dia's en spreadsheets.

Op sommige evaluaties is de kloof tussen de twee modellen echter aanzienlijk smaller geworden. Sonnet 5.5 scoorde hoger dan Opus 5.5 op Terminal-Bench 4.0, met 70,6% tegenover 66,4%. Op GDPval-AA, een benchmark voor kenniswerk in de praktijk, eindigden de twee vrijwel gelijk, met 1.844 voor Sonnet 5.5 tegenover 1.846 voor Opus 5.5. Anthropic zei dat Sonnet 5.5 bij bepaalde effort-instellingen vergelijkbaar presteert met Opus 5.5, al blijft het bedrijf Opus beschouwen als het sterkere model voor complexe taken die aanhoud oordeel vereisen. Voor kopers die de twee niveaus afwegen bieden die resultaten een referentiepunt voor hoeveel gemeten capaciteit behouden blijft tegen Sonnets lagere kosten per taak.

Coderen is een van de grootste verbeterpunten. Anthropic meldde dat Sonnet 5.5 op FrontierCode bij High effort ongeveer 10 punten won op Sonnet 5, terwijl het per taak ongeveer één vijftiende kost. De beste CursorBench-score van het model kwam ook binnen ongeveer twee punten van Opus 5.5 uit.

Breder kenniswerk kende ook aanzienlijke vooruitgang. Anthropic zei dat Sonnet 5.5 dicht bij Opus 5.5 kwam in computergebruik en grafiekherkenning, en beter presteerde dan Sonnet 5 in de interne en externe evaluaties van het bedrijf.

Sonnet 5.5 is tevens het eerste Sonnet-model dat wordt uitgerold met cybersecuritymaatregelen die vergelijkbaar zijn met die van Anthropic's duurdere modellen, nadat de cybercapaciteiten aanzienlijk waren verbeterd ten opzichte van de vorige generatie. Als gevolg daarvan kunnen risicovollere cybersecurityverzoeken terugvallen op Sonnet 5, terwijl routinematige ontwikkeltaken beschikbaar blijven — een afweging tussen striktere beveiliging en taakbeschikbaarheid waarmee teams die het model voor beveiligingsgerelateerd werk gebruiken rekening moeten houden.

Het model is beschikbaar op Anthropic's platforms en via Amazon Web Services, Google Cloud en Microsoft Azure. Ontwikkelaars kunnen het via het Claude Platform gebruiken met de identifier claude-sonnet-5-5.

Anthropic voegde eraan toe dat Claude Haiku 5.5, een model gericht op toepassingen met grote volumes en lage kosten, in de komende weken zal toetreden tot de Claude 5.5-familie. Zodra het beschikbaar komt, zal de familie Anthropic's volledige niveau-/reeks bestrijken, van aanhoudend complex werk tot grootschalige inzet.