Anthropic veröffentlicht Claude Sonnet 5.5, der Opus 5.5 beim Programmieren für den halben Preis übertrifft
Wichtige Erkenntnisse
- •Claude Sonnet 5.5 erscheint zu unveränderten Preisen von 2 US-Dollar pro Million Input-Tokens und 10 US-Dollar pro Million Output-Tokens – halb so viel, wie Anthropic für Opus 5.5 verlangt.
- •Das neue Modell schlug Opus 5.5 beim Terminal-Bench-4.0-Coding-Test: 70,6 % zu 66,4 % laut Anthropics Ergebnissen und 63,6 % zu 59, % im unabhängigen Test von Artificial Analysis.
- •Bei maximaler Anstrengung erzeugte Sonnet 5.5 rund 193.000 Tokens pro Aufgabe, mehr als jedes von Artificial Analysis gemessene Modell, mit Kosten von 7,60 US-Dollar pro Aufgabe – rund 50 % mehr als bei Sonnet 5.
- •Anthropic zufolge läuft das Modell über 30 % schneller als Sonnet 5 und verbraucht fast ein Drittel weniger Tokens pro Aufgabe, was es trotz identischer Listenpreise günstiger im Betrieb macht.
- •Claude Haiku 5.5, konzipiert für hochvolumige, kostensensible Anwendungen, wird in den kommenden Wochen erwartet und soll Anthropics 5.5-Generation vervollständigen.

Anthropic hat am Montag Claude Sonnet 5.5 veröffentlicht, die neueste Version seines KI-Modells der mittleren Klasse und ein Upgrade zu Sonnet 5, das im Juni erschien. Die Preise bleiben unverändert: 2 US-Dollar pro Million Input-Tokens und 10 US-Dollar pro Million Output-Tokens – halb so viel, wie das Unternehmen für Opus 5.5 verlangt.
Trotz des niedrigeren Preises übertrifft das Modell sein größeres Geschwistermodell bereits beim Programmieren. Im Terminal-Bench 4.0 erreichte Sonnet 5.5 laut Anthropic 70,6 % gegenüber 66,4 % für Opus 5.5. Artificial Analysis, ein unabhängiges Testunternehmen, führte eine eigene Version des Benchmarks durch und platzierte Sonnet 5.5 ebenfalls vorn: 63,6 % zu 59,6 %. Auf seinem Leaderboard stuft die Firma das Modell dennoch insgesamt hinter Opus 5.5 ein und weist darauf hin, dass es mehr Tokens pro Aufgabe verbrauchte als jedes andere getestete Modell.
Laut Anthropic läuft das neue Modell mehr als 30 % schneller als sein Vorgänger. „Sonnet 5.5 ist am stärksten bei klar umrissenen Alltagsaufgaben, beim Beheben von Fehlern und beim Erstellen von ausgefeilten Dokumenten, Präsentationen und Tabellen. Es hat außerdem ein feines Gespür für Design“, schrieb das Unternehmen.
Tokens sind die Textabschnitte, die ein KI-Modell liest und schreibt – etwas kürzer als ein Wort – und KI-Unternehmen rechnen pro Million ab. Während der Listenpreis dem von Sonnet 5 entspricht, verbraucht das neue Modell fast ein Drittel weniger Tokens pro Aufgabe, womit es trotz identischer Tarife am Ende günstiger im Betrieb ist als sein Vorgänger.
Wo das Modell wirklich glänzt, ist das Programmieren. Terminal-Bench 4.0 misst, ob ein KI-Agent komplexe berufliche Aufgaben selbstständig durch Eingabe von Befehlen abschließen kann; gewertet wird der Anteil der abgeschlossenen Aufgaben. Sonnet 5.5 erreichte 70,6 %. Opus 5.5 kam auf 66,4 %, und Sonnet 5 schaffte nur 10,3 %. Einfach gesagt: Das günstigere Modell erledigte mehr Aufgaben.
Der unabhängige Testlauf von Artificial Analysis kommt zum gleichen Ergebnis: 63,6 % für Sonnet 5.5, 59,6 % für Opus 5.5 und 59,1 % für OpenAIs GPT-6 Astra. Das Unternehmen hob die Fortschritte des Modells in einem Beitrag auf X hervor:
Claude Sonnet 5.5 (max) makes large strides on Terminal-Bench, sitting among the top models for both Terminal-Bench 4.0 and Terminal-Bench-Science. In Terminal-Bench 4.0 it scores 64%, a 50 point increase over Claude Sonnet 5 (max), and slightly above 60% for Opus 5.5 and GPT-6… pic.twitter.com/7CPrhgmfxe
— Artificial Analysis (@ArtificialAnlys) September 28, 2026
Die Ergebnisse hängen auch von der Anstrengungseinstellung ab, einem Regler, der ein Modell länger nachdenken lässt – für bessere Antworten und eine höhere Rechnung. Laut Anthropic entspricht Sonnet 5.5 bei hoher Anstrengung bei FrontierCode GPT-6 Sol – bei etwa einem Fünftel der Kosten pro Aufgabe.
Beim GDPval-AA, das reale berufliche Arbeiten in 44 Berufen anhand des Elo-Systems bewertet – des schachartigen Wertungssystems, das relative Fähigkeiten einordnet –, erreichte Sonnet 5.5 1844 Punkte gegenüber 1846 für Opus 5.5, im Effekt ein Unentschieden. GPT-6 Sol erzielte 1487.
Die Konkurrenz hält mit den Preisen mit. OpenAI senkte GPT-6 Sol vergangene Woche auf 2 und 10 US-Dollar, während das Mittelklassemodell GPT-5.6 Terra mit 2 und 12 US-Dollar gelistet ist. Sonnet 5.5 und GPT-6 Sol haben nun identische Listenpreise – wobei, wie die oben genannten Anstrengungseinstellungen zeigen, gleiche Tarife nicht unbedingt gleiche Kosten pro Aufgabe bedeuten. Für Terra veröffentlichte Anthropic keine Benchmark-Zahlen.
Der Haken
Der Nachteil ist die Redseligkeit. Sonnet 5.5 spricht viel: Bei maximaler Anstrengung schrieb es rund 193.000 Tokens pro Testaufgabe, mehr als jedes Modell, das Artificial Analysis je gemessen hat, und etwa 60 % mehr als Opus 5.5. Das ergab 7,60 US-Dollar pro Aufgabe, rund 50 % mehr als bei Sonnet 5 – ein Ergebnis, das gegen Anthropics Behauptung von bis zu 30 % Ersparnis spricht.
Anthropics Sparangaben beruhen auf niedrigeren Einstellungen. Bei mittlerer Anstrengung, dem Standard in seinen Apps, übertrifft Sonnet 5.5 nach Unternehmensangaben das beste Coding-Ergebnis von Sonnet 5 zu weniger als einem Zehntel der Kosten. Laut Artificial Analysis bietet hohe Anstrengung das beste Preis-Leistungs-Verhältnis. Für Alltagsnutzer bedeutet das Programmierleistungen auf fast Flaggschiff-Niveau zu einem Bruchteil des Preises – solange der Regler niedrig bleibt.
Vorbehalte bleiben. Anthropics Benchmark-Tabelle ist selbst angegeben, und Artificial Analysis testete eine Vorabversion mit einem Fehler, der nach Anthropics Einschätzung wenig änderte oder die Ergebnisse leicht unterschätzte – einer der Gründe, warum unabhängige Ergebnisse zur finalen Version lohnenswert sind. Das Unternehmen sagt auch, dass Opus 5.5 bei komplexen Arbeiten, die dauerhaftes Urteilsvermögen erfordern, deutlich stärker bleibt.
Claude Haiku 5.5, das für hochvolumige, kostensensible Anwendungen entwickelt wurde, soll in den kommenden Wochen erscheinen und Anthropics 5.5-Generation neben Opus 5.5 und Sonnet 5.5 vervollständigen.