NachrichtenAktienAnthropics Claude Sonnet 5.5 erreicht nahezu Opus-Leistung und senkt die Kosten pro Aufgabe um bis zu 30 %

Anthropics Claude Sonnet 5.5 erreicht nahezu Opus-Leistung und senkt die Kosten pro Aufgabe um bis zu 30 %

Autor: CryptoBriefing·

Wichtige Erkenntnisse

  • •Anthropic hat Claude Sonnet 5.5 als zweites Modell der Claude-5.5-Familie eingeführt, ausgerichtet auf Programmierung, tägliche Produktivität und Dokumentenarbeit in einer günstigeren Kostenstufe.
  • •Das Modell erzeugt die Ausgabe mehr als 30 % schneller als Sonnet 5 und senkt die Kosten pro Aufgabe durch Token-Effizienz um bis zu 30 %, während der Token-Preis bei 2 $ pro Million Eingabe-Tokens und 10 $ pro Million Ausgabe-Tokens bleibt.
  • •Sonnet 5.5 erzielte bei Terminal-Bench 4.0 mehr Punkte als Opus 5.5, mit 70,6 % zu 66,4 %, und lag bei GDPval-AA nur zwei Punkte zurück, mit 1.844 gegenüber 1.846 von Opus.
  • •In Coding-Bewertungen verbesserte sich Sonnet 5.5 bei FrontierCode mit hoher Aufwandsstufe um rund 10 Punkte gegenüber Sonnet 5 und kostete dabei etwa ein Fünfzehntel pro Aufgabe.
  • •Es ist das erste Sonnet-Modell mit Cybersicherheitsmaßnahmen vergleichbar mit Anthropics höherwertigen Stufen – eine Änderung, durch die Anfragen mit höherem Cybersicherheitsrisiko an Sonnet 5 umgeleitet werden können.
Anthropics Claude Sonnet 5.5 erreicht nahezu Opus-Leistung und senkt die Kosten pro Aufgabe um bis zu 30 %

Anthropic hat Claude Sonnet 5.5 veröffentlicht, das zweite Modell der Claude-5.5-Familie, positioniert als schnellere und wirtschaftlichere Option für Programmierung, alltägliche Arbeit und Dokumentenerstellung.

Das Modell erzeugt die Ausgabe mehr als 30 % schneller als sein Vorgänger Sonnet 5 und kostet in den Tests des Unternehmens bis zu 30 % weniger pro Aufgabe, wie aus Anthropics Ankündigung hervorgeht. Die Einsparungen beruhen vor allem auf Effizienz: Sonnet 5.5 benötigt für dieselbe Arbeit weniger Tokens. Der Preis pro Token selbst bleibt unverändert bei 2 $ pro Million Eingabe-Tokens und 10 $ pro Million Ausgabe-Tokens. Dieser Unterschied ist für Teams relevant, die das Modell in großem Umfang einsetzen: Da die Listenpreise unverändert bleiben, kommen die Einsparungen auf Aufgabenebene zum Tragen, wo die Kosten mit der Nutzung anwachsen.

Anthropic präsentiert Sonnet 5.5 als kostengünstigeres Pendant zu Claude Opus 5.5. Opus bleibt auf komplexe, offene Aufgaben ausgerichtet, die ein durchhaltendes Urteilsvermögen erfordern, während Sonnet für klarer definierte Aufgaben wie Fehlerbehebung sowie die Erstellung von Dokumenten, Präsentationen und Tabellen konzipiert ist.

Bei einigen Bewertungen hat sich der Abstand zwischen den beiden Modellen jedoch erheblich verringert. Sonnet 5.5 erzielte bei Terminal-Bench 4.0 mehr Punkte als Opus 5.5, mit 70,6 % gegenüber 66,4 %. Bei GDPval-AA, einem Benchmark für reale Wissensarbeit, lagen die beiden Modelle nahezu gleichauf, mit 1.844 Punkten für Sonnet 5.5 gegenüber 1.846 für Opus 5.5. Anthropic erklärte, dass Sonnet 5.5 bei bestimmten Aufwandsstufen mit Opus 5.5 vergleichbar abschneidet, betrachtet Opus jedoch weiterhin als das stärkere Modell für komplexe Aufgaben, die durchhaltendes Urteilsvermögen erfordern. Für Kunden, die zwischen den beiden Stufen abwägen, bieten diese Ergebnisse einen Referenzpunkt dafür, wie viel gemessene Leistung bei Sonnets niedrigeren Kosten pro Aufgabe erhalten bleibt.

Programmierung zählt zu den größten Verbesserungsbereichen. Anthropic berichtete, dass Sonnet 5.5 bei FrontierCode mit hoher Aufwandsst rund 10 Punkte gegenüber Sonnet 5 gewann und dabei nur etwa ein Fünfzehntel der Kosten pro Aufgabe verursachte. Die beste CursorBench-Punktzahl des Modells lag zudem nur etwa zwei Punkte hinter Opus 5.5.

Auch bei breiter gefasster Wissensarbeit gab es erhebliche Fortschritte. Anthropic erklärte, Sonnet 5.5 liege bei Computernutzung und Diagrammerkennung nahe an Opus 5.5 und übertreffe Sonnet 5 in den internen und externen Bewertungen des Unternehmens.

Sonnet 5.5 ist zudem das erste Sonnet-Modell, das mit Cybersicherheitsmaßnahmen vergleichbar mit denen von Anthropics höherwertigen Modellen ausgeliefert wird, nachdem sich seine Cyber-Fähigkeiten gegenüber der vorherigen Generation deutlich verbessert haben. Dadurch können Anfragen mit höherem Cybersicherheitsrisiko an Sonnet 5 zurückfallen, während routinemäßige Entwicklungsaufgaben weiterhin verfügbar bleiben – ein Kompromiss zwischen strengeren Schutzmaßnahmen und Aufgabenverfügbarkeit, den Teams, die das Modell für sicherheitsnahe Arbeiten einsetzen, einplanen müssen.

Das Modell ist auf Anthropics Plattformen sowie über Amazon Web Services, Google Cloud und Microsoft Azure verfügbar. Entwickler können darüber über die Claude Platform mit dem Bezeichner claude-sonnet-5-5 zugreifen.

Anthropic fügte hinzu, dass Claude Haiku 5.5, ein Modell für hochvolumige und kostensensible Anwendungen, in den kommenden Wochen die Claude-5.5-Familie ergänzen wird. Nach dem Release wird die Familie Anthropics Stufenspektrum vollständig abdecken – von anhaltender komplexer Arbeit bis hin zum hochvolumigen Einsatz.