OpenAI startet GPT-6 Sol und Luna wenige Minuten nach Anthropics Claude Opus 5.5
Wichtige Erkenntnisse
- •OpenAI hat GPT-6 Sol und GPT-6 Luna am 22. September 2026 veröffentlicht, nur wenige Minuten nachdem der Konkurrent Anthropic sein Flaggschiff Claude Opus 5.5 vorgestellt hatte.
- •Die API-Preise beider neuen Modelle wurden im Vergleich zu den Werbetraten von GPT-5.6 halbiert; Sol kostet 2 $ pro Million Eingabe- und 10 $ pro Million Ausgabe-Token, Luna 0,10 $ und 0,50 $.
- •OpenAI meldete verbesserte interne Sicherheitsmetriken: Die Coding-Deception-Rate sank auf 1,3 % bei Sol und 2,8 % bei Luna, verglichen mit 10,4 % bei GPT-5.6 Sol.
- •Laut OpenAIs eigenen Zahlen erreichte GPT-6 Sol 33,2 % auf Zapiers AutomationBench bei 0,27 $ pro Aufgabe, während Claude Opus 5 26,9 % bei mehr als dem 11-fachen Kosten erziel; unabhängige Benchmark-Ergebnisse liegen noch nicht vor.
- •GPT-6 Sol und Luna sind in ChatGPT Work und Codex für Plus-, Pro-, Business-, Enterprise- und Edu-Abonnenten live; Luna ist auch für kostenlose und Go-Nutzer über die Desktop-App verfügbar, aber keines der Modelle hat bislang die normale ChatGPT-App erreicht.

OpenAI hat am Dienstag zwei neue KI-Modelle veröffentlicht, GPT-6 Sol und GPT-6 Luna, und die API-Preise im Vergleich zu den Werbetraten von GPT-5.6 halbiert. Der Start erfolgte nur wenige Minuten nachdem der Konkurrent Anthropic Claude Opus 5.5, sein eigenes neues Flaggschiff, vorgestellt hatte. Die Veröffentlichungen in unmittelbarem Abstand unterstreichen den eskalierenden Wettbewerb zwischen den beiden führenden KI-Unternehmen – und verschaffen Entwicklern und Unternehmen, die pro Token zahlen, einen ungewöhnlich direkten Preis- und Leistungsvergleich.
Sol und Luna sind unterhalb von GPT-6 Astra angesiedelt, dem Modell, das OpenAI bei dessen Start am 3. September als „das intelligenteste und am besten ausgerichtete Modell der Welt“ bezeichnete. Astra bleibt OpenAIs erste Wahl für die schwierigsten Aufgaben; Sol und Luna sind die günstigeren, schnelleren Optionen für die alltägliche Arbeit.
Die Stufenstrategie spiegelt weitgehend das Line-up wider, das Anthropic angewendet hat:stra entspricht Fable, Sol entspricht Opus, Terra entspricht Sonnet und Luna entspricht Haiku, sobald es sein eigenes Upgrade erhält. Die parallele Struktur erleichtert zudem den direkten Preisvergleich Stufe für Stufe.
Auch die internen Sicherheitsmetriken haben sich laut dem Unternehmen verbessert: Die Coding-Deception-Rate sank auf 1,3 % bei Sol und 2,8 % bei Luna, beide weit unter den 10,4 % von GPT-5.6 Sol.
OpenAI rahmte die Preissenkungen als Maßnahme ein, um wettbewerbsfähig zu bleiben. Die API-Kosten für beide Modelle wurden im Vergleich zu den Werbepreisen pro Token von GPT-5.6 um 50 % gesenkt. Token sind die Textabschnitte, die ein Modell liest und schreibt – meist etwas weniger als ein ganzes Wort – und Unternehmen zahlen pro Million, so summieren sich KI-Rechnungen im großen Maßstab.
OpenAI kündigte den Start in einem Beitrag auf X an:
Please welcome GPT-6 Sol and GPT-6 Luna to the GPT-6 universe. GPT-6 Sol and Luna build on the advances behind GPT-6 Astra, bringing much of its strengths into faster and more affordable models to support work at scale. We've also made caching and inference more efficient, and… pic.twitter.com/5LiVE4rbFt
— OpenAI (@OpenAI) September 22, 2026
Der Beitrag wurde am 22. September 2026 auf OpenAIs offiziellem X-Konto (@OpenAI) veröffentlicht.
Sol kostet nun 2 $ pro Million Eingabe-Token und 10 $ pro Million Ausgabe-Token, zuvor waren es 4 $ und 20 $. Luna sinkt auf 0,10 $ und 0,50 $, zuvor 0,20 $ und 1,20 $. Insgesamt ist OpenAI pro Stufe das günstigere Angebot im Vergleich zu Anthropic.
Der Leistungsvergleich stützt sich auf AutomationBench, einen von Zapier entwickelten Benchmark, der prüft, ob ein KI-Agent einen vollständigen Geschäftsworkflow mit 47 Tools aus den Bereichen Vertrieb, Marketing, Betrieb, Support, Finanzen und Personalwesen durchführen kann, bewertet als Erfolgsquote. GPT-6 Sol erreichte in seiner höchsten Reasoning-Stufe 33,2 % bei 0,27 $ pro Aufgabe – wobei die halbierten Token-Preise direkt zu Einsparungen pro Aufgabe führen, da Agent-Workloads bei jedem Schritt einer Aufgabe Token verbrauchen.
Claude Opus 5 erzielte in seiner eigenen höchsten Stufe 26,9 %, kostete laut OpenAIs eigenen Zahlen aber mehr als das 11-Fache pro Aufgabe. GPT-6 Sol setzte sich im selben Test auch gegen Claude Fable 5.1, Anthropics teureres Flaggschiff, durch. Zu beachten ist, dass sich die Zahlen auf Claude Opus 5 und nicht auf den wenige Minuten zuvor veröffentlichten Op 5.5 beziehen, sodass das neueste Claude-Modell in den Vergleichen noch nicht auftaucht.
Bei Agents' Last Exam, das KI-Agenten anhand langer, wirtschaftlich wertvoller Arbeiten über 55 Teilbranchen hinweg bewertet und die Ergebnisse als Prozentsatz der Vollendung benotet, erreichte GPT-6 Sol in seiner höchsten Stufe 56,4 %. OpenAI zufolge übertrifft dies Claude Opus 5s beste Punktzahl bei 60 % niedrigeren Kosten pro Aufgabe.
Reasoning Effort ist ein Regler, den OpenAI hinzugefügt hat: Dreht man ihn auf, verbringt das Modell vor der Antwort mehr Zeit und Rechenleistung damit, sich selbst zu überprüfen, was in der Regel Genauigkeit und Kosten gleichermaßen erhöht.
Beim Computer-Einsatz – ein KI-Agent, der wie ein Mensch klickt, tippt und sich durch Software navigiert – lag GPT-6 Sol auf OSWorld 2.0 mit 60,5 % zu 60,3 % nahezu gleichauf mit Claude Opus 5s Punktzahl in der mittleren Stufe, bei etwa 80 % geringeren Kosten. OSWorld testet lange, realistische Computer-Aufgaben und vergibt eine Teilpunktzahl basierend darauf, wie viel der Aufgabe korrekt erledigt wurde. Diese Direktvergleichszahlen stammen aus OpenAIs eigener Berichterstattung; unabhängige Benchmark-Ergebnisse wurden bislang nicht veröffentlicht.
GPT-6 Sol und Luna sind ab sofort in ChatGPT Work und Codex für Plus-, Pro-, Business-, Enterprise- und Edu-Abonnenten verfügbar; Luna erreicht kostenlose und Go-Nutzer zusätzlich über die Desktop-App. Keines der beiden Modelle ist bislang in der normalen ChatGPT-App zu finden, und OpenAI erklärt, beide werden im Laufe des Tages schrittweise ausgerollt, um den Dienst stabil zu halten. Die sichtbaren offenen Punkte in dieser ansonsten gespiegelten Rivalität sind die Ankunft der Modelle in der normalen ChatGPT-App und das Haiku-Stufen-Pendant, das auf Anthropics Seite noch auf sein eigenes Upgrade wartet.