Elon Musk räumt ein, dass Grok hinter Anthropics KI-Modellen zurückliegt, und sagt, xAI brauche Zeit zum Aufholen
Wichtige Erkenntnisse
- •Elon Musk hat auf X öffentlich eingeräumt, dass xAIs Grok weniger leistungsfähig ist als Anthropics Top-Modelle, und Anthropic als aktuellen KI-Marktführer bezeichnet.
- •Grok 4.5, veröffentlicht am 8. Juli 2026 und bepreist mit 2 Dollar pro Million Eingabe-Tokens und 6 Dollar pro Million Ausgabe-Tokens liegt in mehreren Benchmark-Kategorien sowohl hinter Claude Fable 5 als auch hinter Opus 4.8 zurück, darunter 53 % im Coding-Benchmark DeepSWE 1.1.
- •Musk führte den Leistungsabstand darauf zurück, dass xAI seit rund drei Jahren besteht, während Anthropic sechs Jahre für Teamaufbau und Forschungsiteration hatte.
- •SpaceX hat eine große Rechenvereinbarung mit Anthropic über Hunderte Megawatt Leistung aus xAIs Colossus-Rechenzentren abgeschlossen, und Musk sicherte einen gleichberechtigten Zugang zu KI-Infrastruktur zu.
- •Musk fördert die Grok-Einführung bei Tesla und SpaceX, lässt Teams aber bessere Alternativen wählen, und erwartet, dass xAI bis 2027 Leistung auf Frontier-Niveau erreicht.

Elon Musk hat auf X eingeräumt, dass xAIs Grok weniger leistungsfähig ist als Anthropics neueste KI-Angebote und dass sein Unternehmen Zeit zum Aufholen braucht — ein seltener Moment öffentlicher Demut bei einer Person, die für maximales Selbstbewusstsein bekannt ist.
Das Zugeständnis hat echtes Gewicht. Musk sagte nicht lediglich, dass Grok Verbesserungen benötigt. Er erklärte, dass er hinsichtlich Anthropics Stellung in der KI-Landschaft falsch gelegen habe, und bezeichnete das Unternehmen als aktuellen Marktführer, dessen Top-Modelle keine Konkurrenz erreiche. Für Entwickler und Unternehmen, die entscheiden, auf welche Modelle sie setzen, ist eine öffentliche Neubewertung durch einen der prominentesten Gründer der Branche ein ungewöhnlich direkter Datenpunkt darüber, wo die Frontier derzeit liegt.
Benchmarks zeigen den Abstand
Grok 4.5, das xAI am 8. Juli 2026 veröffentlichte, sollte ein wettbewerbsfähiger Sprung nach vorn sein. Das Modell ist aggressiv mit 2 Dollar pro Million Eingabe-Tokens und 6 Dollar pro Million Ausgabe-Tokens bepreist und positioniert sich damit als kostengünstige Alternative zu den Schwergewichten des Feldes. Preise pro Million Tokens sind die Standardeinheit, in der API-Kunden die Modellnutzung bezahlen, wodurch die Preisgestaltung einer der klarsten Vergleichspunkte zwischen konkurrierenden Angeboten ist.
Benchmark-Ergebnisse zeichnen ein klares Bild: Grok 4.5 liegt in mehreren Kategorien sowohl Anthropics Claude Fable 5 als auch hinter Opus 4.8 zurück. Der Abstand ist besonders bei Coding-Aufgaben ausgeprägt, wo Grok 4.5 im Benchmark DeepSWE 1.1 lediglich 53 % erreichte — eine Kategorie, die viele Kunden bei der Wahl eines Modells für Engineering-Arbeit stark gewichten.
Musk verwies auf eine einfache Erklärung für die Diskrepanz: xAI besteht seit rund drei Jahren, während Anthropic sechs Jahre hatte, um sein Team aufzubauen, seine Forschungspipeline zu verfeinern und Modellarchitekturen zu iterieren. Seine Darstellung versteht den Wettbewerb als eine Frage angesammelter Forschungszeit und nicht einzelner Veröffentlichungen.
Eine Partnerschaft mit dem Rivalen
Musk konkurriert nicht nur mit Anthropic — er arbeitet auch mit dem Unternehmen zusammen. SpaceX hat eine große Rechenvereinbarung mit Anthropic über Hunderte Megawatt Leistung aus den Colossus-Anlagen, xAIs gewaltiger Rechenzentrums-Infrastruktur, abgeschlossen. Diese Vereinbarung macht die beiden Unternehmen zu kommerziellen Partnern, während ihre Modelle bei Benchmarks direkt gegeneinander antreten.
Musk hat zugesagt, ein gleichberechtigtes Umfeld für den Zugang zu KI-Infrastruktur aufrechtzuerhalten, und signalisiert damit, dass er seinen Hardware-Vorteil nicht nutzen wird, um Wettbewerber zurückzuhalten. Dieses Versprechen hat Gewicht in einem Markt, in dem der Zugang zu großangelegter Rechenleistung zu einem entscheidenden Faktor für das Training und den Betrieb von Frontier-Modellen geworden ist.
Groks Weg nach vorn
Musks Strategie zum Schließen der Lücke sieht eine tiefe Integration über sein Unternehmensimperium hinweg vor. Er fördert die Grok-Einführung intern sowohl bei Tesla als auch bei SpaceX und setzt die Modelle in operativen Workflows ein, während die Teams beider Unternehmen die Flexibilität behalten, bei Bedarf effektivere Modelle zu wählen. Diese Flexibilität ist für sich genommen bemerkenswert: Interne Nutzer können auf die Tools eines Rivalen zurückgreifen, wenn diese besser abschneiden, und üben damit ständigen Druck auf xAI zur Verbesserung aus.
Musk hat sich optimistisch geäußert, dass xAI bis 2027 Leistung auf Frontier-Niveau erreichen wird. Die Herausforderung: Anthropic steht nicht still. Dessen Modell Opus 5.5, das Musk ausdrücklich als Grok überlegen bezeichnete, stellt ein bewegliches Ziel dar. Wie schnell die Benchmark-Zahlen gegenüber einem Rivalen konvergieren, der in rascher Folge neue Modellgenerationen ausliefert, ist der Aspekt, den es zu verfolgen gilt, während sich das Ziel 2027 nähert.