Anthropic bringt Claude Opus 5.5 auf den Markt und senkt die Kosten um 40 %
Wichtige Erkenntnisse
- •Claude Opus 5.5 wurde am 22. September 2026 veröffentlicht, nur zwei Monate nach dem Modell Claude Opus 5, das es ersetzt.
- •Anthropic hat die Gesamtbetriebskosten um 40 % gesenkt, die Preise für Input- und Output-Token jeweils um 20 % reduziert und die Cache-Lese-Preise um 60 % auf 0,20 US-Dollar pro Million Token gesenkt.
- •Das Modell generiert Output mehr als 30 % schneller als sein Vorgänger und bietet ein Kontextfenster von 1 Million Token, das für langandauernde agentische Coding-Workloads ausgelegt ist.
- •Unabhängige Evaluatoren Frontier und METR maßen einen Rückgang der Umgehungsversuche um 85 % im Vergleich zu Opus 5 und Mythos 5.1.
- •Das Modell ist zum Launch über die Claude API, Claude Platform, Amazon Bedrock, Google Cloud und Microsoft verfügbar, zusammen mit erweiterten Fünf-Stunden-Nutzungslimits für kostenpflichtige Abonnentenstufen.

Anthropic hat Claude Opus 5.5 am 22. September 2026 veröffentlicht und damit eine Kombination eingeführt, die bei KI-Modelllaunches unüblich ist: Das neue System ist im Betrieb günstiger, generiert Output schneller und ist widerstandsfähiger gegen Manipulation als das Claude-Opus-5-Modell, das es ersetzt und das erst zwei Monate zuvor erschienen ist. Das Unternehmen beziffert die zentrale Kennzahl mit einer Reduzierung der Gesamtbetriebskosten um 40 %.
Was sich geändert hat und was es jetzt kostet
Die Preissenkungen zeigen sich am deutlichsten in der aktualisierten Preisliste von Anthropic. Input-Token kosten jetzt 4 US-Dollar pro Million, Output-Token 20 US-Dollar pro Million – jeweils eine Reduzierung um 20 % gegenüber den Raten von 5 und 25 US-Dollar bei Opus 5. Cache-Lesevorgänge fielen noch stärker, nämlich um 60 % auf 0,20 US-Dollar pro Million Token. Bei mehrstufigen agentischen Workloads, bei denen derselbe Kontext über verkettete Aufrufe hinweg wiederholt gelesen wird, ist dieser Cache-Rabatt der Punkt, an dem sich die Einsparungen pro Aufgabe summiert.
Die Output-Generierung ist mehr als 30 % schneller als beim Vorgängermodell. Dieser Unterschied wiegt bei einfachen Anfragen wenig, wird aber in agentischen Workflows erheblich, die Dutzende Modellaufrufe miteinander verketten. Anthropic hat Opus 5.5 speziell für langandauernde agentische Coding- und professionelle Workloads entwickelt und ihm ein Kontextfenster von 1 Million Token sowie eine maximalechrone Output-Größe von 128K Token mitgegeben.
In Benchmarks erreicht oder übertrifft das Modell Claude Fable 5.1, das höherstufige Angebot von Anthropic, über eine Reihe von Coding- und Wissensarbeit-Bewertungen hinweg. Beim GDPval-AA v2.1 erreicht es 1.846 Elo – effectively Ergebnisse auf Flaggschiff-Niveau zu einem niedrigeren Preis als beim Modell, das es ersetzt.
Sicherheitsverbesserungen, die tatsächlich messbar sind
Unabhängige Evaluatoren, darunter Frontier Design und METR, stellten fest, dass Versuche zur Umgehung von Grenzen im Vergleich zu Opus 5 und Mythos 5.1 um 85 % zurückgingen. Dabei handelt es sich um externe Bewertungen und nicht um selbst berichtete Zahlen – ein Unterschied, der bei Käufern und Forschern in der Regel mehr Gewicht hat. Anthropic bewirbt Opus 5.5 als sein leistungsstärkstes Modell in umfassenden Alignment-Tests bis heute.
CEO Dario Amodei hat sich angesichts anhaltender Sicherheitsbedenken in der Branche öffentlich für ein maßvolleres Tempo bei der Veröffentlichung neuer Fähigkeiten ausgesprochen, und die Betonung von Alignment bei diesem Launch spiegelt diese Haltung wider. Der Veröffentlichungsabstand von zwei Monaten macht diese Spannung konkret: schnelle Veröffentlichung auf der einen Seite, externe Sicherheitsvalidierung auf der anderen. Anthropic gibt außerdem an, dass das Modell nun wesentliche Informationen priorisiert und Fachjargon reduziert.
Wer Zugriff erhält und über welche Kanäle
Opus 5.5 ist sofort über die Claude API, die Claude Platform, Amazon Bedrock und Google Cloud verfügbar. Microsoft wird ebenfalls als Distributionspartner aufgeführt, wodurch das Modell zum Launch gleichzeitig in den drei dominierenden Enterprise-Cloud-Umgebungen abgedeckt ist – das bedeutet, dass Organisationen, die auf einen einzigen Anbieter standardisiert sind, es einführen können, ohne eine zweite Anbieterbeziehung aufbauen zu müssen.
Anthropic hat die Nutzungslimits im Zuge der Veröffentlichung erweitert. Pro-, Max-, Team- und Enterprise-Abonnenten erhalten erhöhte Fünf-Stunden-Nutzungslimits, mit optional verfügbaren Rate-Limit-Resets – Spielraum, der zur Positionierung des Modells für langandauernde Workloads passt.
Frühe Nutzerberichte heben Code-Migrationsaufgaben als herausragenden Anwendungsfall hervor, wobei groß angelegte Refactorings und Framework-Migrationen mit weniger Unterbrechungen abgeschlossen werden – im Einklang mit dem Designziel des Modells als professionelles Entwickler-Tooling. Mit den nun dokumentierten Preisen, Benchmark- und Sicherheitszahlen wird der breitere Produktiveinsatz über die erweiterte Abonnentenbasis die umfassenderen Daten liefern, anhand derer diese Launch-Zahlen beurteilt werden.