NachrichtenMakroOpenAI und Anthropic senken Preise im aggressiven Vorgehen gegen Open-Source-KI-Modelle

OpenAI und Anthropic senken Preise im aggressiven Vorgehen gegen Open-Source-KI-Modelle

Autor: CryptoBriefing·

Wichtige Erkenntnisse

  • •OpenAI senkte am 30. Juli die Preise für GPT-5.6 Luna um 80 % auf 0,20 $ pro Million Input-Tokens und 1,20 $ pro Million Output-Tokens, während GPT-5.6 Terra um 20 % auf 2 $/12 $ reduziert wurde.
  • •Anthropic machte am 10. August die Einführungspreise für Claude Sonnet 5 dauerhaft fest: 2 $ pro Million Input-Tokens und 10 $ pro Million Output-Tokens.
  • •Am 22. September brachte OpenAI GPT-6 Sol und GPT-6 Luna zu rund 50 % unter den Preisen der vorherigen Generation auf den Markt; Anthropic antwortete mit Claude Opus 5.5 zu Listenpreisen von 4 $/20 $ plus Effizienzverbesserungen im Wert von rund 40 % effektiver Ersparnis.
  • •DeepSeek V4 Flash aus China bietet Preise ab rund 0,14 $/0,28 $ pro Million Tokens, wobei einige chinesische Modelle die Fähigkeiten der US-Mittelklasse bei fünf- bis neunfach niedrigeren Kosten nahezu erreichen.
  • •Steile Preissenkungen proprietärer Anbieter verkleinern die Kostendifferenz, die das Self-Hosting von Open-Source-Modellen rechtfertigt, und die erwarteten IPO-Unterlagen der Unternehmen würden zeigen, ob vergünstigte Tokens sich in Umsatz im großen Maßstab umwandeln.
OpenAI und Anthropic senken Preise im aggressiven Vorgehen gegen Open-Source-KI-Modelle

Der KI-Preiskampf ist in eine neue Phase eingetreten. Im Laufe des Jahres 2026 haben OpenAI und Anthropic die Preise ihrer Modelle der mittleren Preisklasse systematisch gesenkt – mit Reduktionen, die steil genug sind, damit Entwickler erneut prüfen, ob Open-Source-Alternativen den Aufwand des Self-Hostings noch wert sind. Da nutzungsbasierte Token-Gebühren der dominierende wiederkehrende Kostenfaktor für Teams sind, die KI-Funktionen im Produktivbetrieb laufen lassen, wirken sich Kürzungen dieser Größenordnung direkt auf die Build-vs-Buy-Entscheidungen in der gesamten Branche aus.

Die Zahlen hinter dem Preiskampf

Am 30. Juli senkte OpenAI die Preise für GPT-5.6 Luna um 80 % und brachte die Kosten damit auf 0,20 $ pro Million Input-Tokens und 1,20 $ pro Million Output-Tokens. Auch das höherwertige GPT-5.6 Terra des Unternehmens wurde günstiger: eine Reduktion um 20 % auf 2 $ für Input und 12 $ für Output pro Million Tokens.

Anthropic folgte am 10. August und machte die Einführungspreise für Claude Sonnet 5 von 2 $/10 $ pro Million Tokens dauerhaft.

Eine zweite Welle folgte am 22. September. OpenAI brachte GPT-6 Sol und GPT-6 Luna zu 2 $/10 $ bzw. 0,10 $/0,50 $ auf den Markt, rund 50 % unter den Preisen der vorherigen Generation. Anthropic konterte mit Claude Opus 5.5 zu Listenpreisen von 4 $/20 $, wobei eingebaute Effizienzverbesserungen für Nutzer rund 40 % effektive Ersparnisse bringen.

Für Leser, die mit diesen Tabellen noch nicht vertraut sind: Die API-Preise werden pro Million Tokens abgerechnet – Tokens sind die Wort- und Zeicheneinheiten, die Modelle verarbeiten – wobei der Input, also der Text, den ein Modell erhält, in der Regel günstiger ist als der Output, also der generierte Text.

Warum Open Source unter Druck gerät

Das Self-Hosting von Open-Weight-Modellen verursacht keine Token-Gebühren, verlagert die Kosten jedoch auf GPU-Hardware, Engineering-Zeit und den Rund-um-die-Uhr-Betrieb. Jede Senkung der Listenpreise proprietärer Anbieter verkleinert die Lücke, die das Self-Hosting braucht, um diesen Mehraufwand zu rechtfertigen.

Unternehmen staffeln ihre Workloads zunehmend nach Preisstufen. Günstige proprietäre Modelle übernehmen Routineaufgaben wie Zusammenfassungen, Klassifizierung und einfache Kundeninteraktionen, während Premium-Modelle für spezialisierte Workloads reserviert bleiben, bei denen Leistungsunterschiede wirklich ins Gewicht fallen.

Open Source hält weiterhin einen bedeutenden Volumenanteil, insbesondere auf Plattformen wie OpenRouter, über die Entwickler Modelle mit einer einzigen Integration kombinieren können.

Der China-Faktor

Chinesische KI-Unternehmen setzen aggressive niedrige Preismaßstäbe, durch die selbst die gesenkten US-Preise teuer wirken. DeepSeek V4 Flash bietet Preise ab rund 0,14 $/0,28 $ pro Million Tokens und unterbietet die amerikanische Konkurrenz deutlich. Bei hohen Volumina summieren sich solche Lücken schnell zu deutlich unterschiedlichen Monatsrechnungen für große Workloads.

Auch der Leistungsabstand schrumpft. Einige chinesische Modelle erreichen mittlerweile nahezu die Fähigkeiten US-amerikanischer Modelle der mittleren Preisklasse – bei fünf- bis neunfach niedrigeren Kosten.

Börsengang-Rechnung und Margendruck

Von beiden Unternehmen, OpenAI und Anthropic, wird weithin erwartet, dass sie an die Börse gehen. Aggressive Preissenkungen steigern Adoption und Nutzungskennzahlen, drücken aber auch die Margen. Die Wette lautet: Niedrigere Preise treiben das Volumen, und ein höheres Volumen gleicht die dünnen Margen pro API-Aufruf schließlich aus.

Dieser Zielkonflikt wiegt im Vorfeld eines Börsengangs besonders schwer, da Anleger Wachstum und Rentabilität üblicherweise nebeneinander prüfen. Als private Unternehmen veröffentlichen beide Firmen heute keine geprüften Finanzzahlen, sodass ihre späteren IPO-Unterlagen der Branche erstmals einen harten Blick darauf geben würden, ob vergünstigte Tokens sich tatsächlich in Umsatz im großen Maßstab umsetzen lassen.