NachrichtenAktienAnthropic bringt Claude Sonnet 5.5 auf den Markt, während sich die KI-Bewertung auf Kosten pro Aufgabe verlagert

Anthropic bringt Claude Sonnet 5.5 auf den Markt, während sich die KI-Bewertung auf Kosten pro Aufgabe verlagert

Autor: Cryptopolitan·

Wichtige Erkenntnisse

  • •Laut Anthropic läuft Claude Sonnet5.5 über 30 % schneller als sein Vorgänger und erledigt die meisten Aufgaben bis zu 30 % günstiger, da weniger Token verbraucht werden, während die Tokenpreise gleich bleiben.
  • •Sonnet 5.5 behält die bestehende Preisgestaltung bei: 2 Dollar pro Million Eingabe-Token, 10 Dollar pro Million Ausgabe-Token und 0,20 Dollar pro Million Cache-Read-Token.
  • •Das Modell erreicht 70,6 % bei Terminal-Bench 4.0 gegenüber 10,3 % bei Sonnet 5, doch unabhängige Daten zeigen, dass Konkurrenzmodelle wie GPT-6 Sol und Xiaomis MiMo-V2.6-Pro vergleichbare Intelligenzniveaus zu deutlich niedrigeren Kosten pro Aufgabe erreichen.
  • •Die im Artikel zitierte Forschung zeigt, dass die Kosten für ein bestimmtes KI-Leistungsniveau seit 2023 um rund 47 % pro Quartal gesunken sind, während Gartner prognostiziert, dass die gesamten Inferenzausgaben pro agilistischen Workflow bis 2028 um mehr als das Fünffache steigen werden.
  • •Anthropic, das rund 80 % seines Umsatzes mit Unternehmenskunden erzielt, bereitet sich Berichten zufolge auf einen Börsengang vor; Haiku 5.5 wird innerhalb von Wochen erwartet.
Anthropic bringt Claude Sonnet 5.5 auf den Markt, während sich die KI-Bewertung auf Kosten pro Aufgabe verlagert

Anthropic hat Claude Sonnet 5.5 am 28. September veröffentlicht, das zweite Modell der Claude-5.5-Serie, und den Launch über einen offiziellen Beitrag auf X angekündigt. Der Launch erfolgt, während sich das Unternehmen laut Reuters auf einen Börsengang vorbereitet. Er unterstreicht zudem einen Wandel bei den Kriterien zur Bewertung von KI-Technologie: Die reine Benchmark-Leistung bleibt ein wichtiger Faktor, doch Unternehmen gewichten zunehmend, wie teuer es ist, mit einem bestimmten Modell Ergebnisse zu erzielen.

Laut Anthropic läuft Sonnet 5.5 mehr als 30 % schneller als Sonnet 5 und kann die meisten Aufgaben bis zu 30 % günstiger erledigen, obwohl die Tokenpreise unverändert bleiben. Laut der Launch-Seite des Modells resultiert die Kostenreduktion daraus, dass für dieselbe Arbeit weniger Token verbraucht werden.

Gleicher Listenpreis, weniger Token

Sonnet 5.5 kostet 2 Dollar pro Million Eingabe-Token, 10 Dollar für Ausgabe-Token und 0,20 Dollar für Cache-Read-Token — der vergünstigte Tarif für die Wiederverwendung von Kontext, den das Modell bereits verarbeitet hat. Opus 5.5, das auf komplexe Reasoning- und Urteilsaufgaben spezialisiert ist, kostet jeweils 4 Dollar und 20 Dollar für Eingabe- und Ausgabe-Token. Sonnet ist für alltägliche Workloads wie Programmieren, Dokumentenerstellung und Tabellenkalkulationen positioniert.

Die Preisgestaltung rückt Effizienz in den Mittelpunkt der Diskussion. Für viele Aufgaben benötigen Unternehmen nicht das leistungsstärkste verfügbare Modell; ein kostengünstiges Modell, das eine Aufgabe zuverlässig erledigt, kann wichtiger sein als ein paar Punkte mehr in einer Benchmark. Diese Dynamik ist für Anthropic besonders wichtig, das laut Reuters rund 80 % seines Umsatzes mit Unternehmenskunden erzielt.

Benchmarks sind nicht mehr die ganze Geschichte

Anthropic zufolge erreicht Sonnet 5.5 70,6 % bei Terminal-Bench 4.0, einem agilistischen Benchmark, der Modelle an echten Terminal-Aufgaben testet, gegenüber 10,3 % bei Sonnet 5. Doch die Artificial Analysis-Rangliste des unabhängigen Evaluators Artificial Analysis zeigt, warum Benchmark-Ergebnisse nur ein Teil des Bildes sind. Bei maximaler Anstrengung erreicht Sonnet 5.5 einen Wert von 56 auf der Intelligenzskala, bei geschätzten Kosten von 7,60 pro Aufgabe. GPT-6 Sol erzielt 48 Punkte bei 1,06 Dollar pro Aufgabe, während Xiaomis MiMo-V2.6-Pro 46 Punkte für nur 0,13 Dollar erreicht. Mit anderen Worten: Ein Modell, das bei der Intelligenz führt, führt nicht zwangsläufig bei der Kosteneffizienz — und bei umfangreichen Workloads summieren sich derartige Unterschiede pro Aufgabe schnell.

Diese Kostenunterschiede treiben Unternehmen in Richtung Multi-Modell-Strategien: Schwierigere Aufgaben werden an Premium-Systeme zugewiesen, während Routinearbeit an günstigere Alternativen weitergeleitet wird. Dieser Ansatz ermöglicht es Organisationen, für Top-Leistung nur dort zu zahlen, wo sie wirklich benötigt wird.

Der Preis des Denkens fällt weiter

Der Wandel passt in einen deutlich größeren Trend. Laut einem Epoch-AI-Bericht vom 22. September sind die Kosten für ein bestimmtes Niveau an KI-Leistung seit 2023 um rund 47 % pro Quartal gesunken — eine Reduktion von etwa dem 13-Fachen pro Jahr. Ein separater Cryptopolitan-Bericht vom 29. September besagt, dass Unternehmenskäufer zunehmend das günstigste Modell bevorzugen, das die erforderliche Arbeit erledigen kann, während niedrige Preise es Unternehmen zudem erleichtern, den Betrieb mehrerer Modelle gleichzeitig zu rechtfertigen.

Günstigere Token, höhere Rechnungen

Niedrigere Stückkosten gewährleisten jedoch keine niedrigeren KI-Gesamtausgaben. Ein Gartner-Bericht vom 17. August mit dem Titel „Gartner Predicts AI Inference Costs Per Agentic Workflow Will Increase More Than Fivefold Through 2028“ beschreibt ein „Inference-Paradox“: Fallende Tokenpreise regen komplexere Workflows an, was die Gesamt-Tokennutzung in die Höhe treibt. Stückpreise und Gesamtausgaben sind unterschiedliche Hebel — der erste legt die Kosten pro Token fest, der zweite hängt davon ab, wie viele Token ein Workflow verbraucht.

„Produktverantwortliche können sich nicht auf effizientere Token-Ökonomie verlassen, um KI-Kosten zu rechtfertigen“, sagte Will Sommer, Senior Director Analyst bei Gartner, im Bericht vom 17. August 2026.

Wer tatsächlich die günstigere KI bekommt

Laut Microsofts Global AI Diffusion Report haben kostengünstige und Open-Weight-Modelle das Potenzial, den Zugang zu KI erheblich zu verbessern, insbesondere im Globalen Süden. Dennoch werden niedrigere Modellkosten allein die Adoption nicht bestimmen — Infrastruktur, Konnektivität und Fähigkeiten bleiben die entscheidenden Faktoren dafür, ob günstigere KI tatsächlich genutzt wird.

Für Unternehmenskäufer zeigt Sonnet 5.5, wohin sich der Markt entwickelt: Das beste Modell ist nicht zwangsläufig das leistungsstärkste, sondern das, das die Aufgabe zu vernünftigen Kosten gut erledigt. Haiku 5.5, das nächste Modell der Serie, das in den kommenden Wochen erwartet wird, könnte diesen Wandel weiter vorantreiben, indem es umfangreiche KI-Arbeiten günstiger macht — und es Unternehmen schwerer macht, Premium-Preise für Routineaufgaben zu rechtfertigen.