Elon Musk admet que Grok est en retard sur les modèles d'IA d'Anthropic et estime que xAI a besoin de temps pour rattraper son retard
Points clés
- •Elon Musk a publiquement admis sur X que le modèle Grok d'xAI est moins avancé que les meilleurs modèles d'Anthropic et a qualifié Anthropic de leader actuel de l'IA.
- •Grok 4.5, lancé le 8 juillet 2026 et proposé à 2 $ par million de tokens d'entrée et 6 $ par million de tokens de sortie, est en retard sur le Claude Fable 5 et l'Opus 4.8 dans plusieurs catégories de benchmarks, avec un score de 53 % au benchmark de code DeepSWE 1.1.
- •Musk a attribué cet écart de performance aux trois années d'existence environ d'xAI, contre six années de constitution d'équipe et d'itération en recherche pour Anthropic.
- •SpaceX a obtenu un important accord de calcul avec Anthropic portant sur des centaines de mégawatts issus des installations Colossus d'xAI, et Musk s'est engagé à garantir un accès équitable aux infrastructures d'IA.
- •Musk promeut l'adoption de Grok chez Tesla et SpaceX tout en permettant aux équipes de choisir des alternatives plus performantes, et il table sur un niveau de performance de pointe pour xAI d'ici 2027.

Elon Musk a reconnu sur X que le modèle Grok d'xAI est moins avancé que les dernières offres d'IA d'Anthropic et que son entreprise a besoin de temps pour rattraper son retard — un rare moment d'humilité publique de la part d'une figure connue pour sa confiance sans limite.
Cet aveu a un réel poids. Musk n'a pas simplement dit que Grok devait s'améliorer. Il a déclaré qu'il s'était complètement trompé sur la position d'Anthropic dans le paysage de l'IA, qualifiant l'entreprise de leader actuel du secteur, sans qu'aucun rival n'égale ses meilleurs modèles. Pour les développeurs et les entreprises qui décident sur quels modèles construire, une réévaluation publique de la part de l'un des fondateurs les plus en vue du domaine constitue un point de données exceptionnellement direct sur la situation actuelle de la frontière technologique.
Les benchmarks montrent l'écart
Grok 4.5, lancé par xAI le 8 juillet 2026, devait représenter un bond concurrentiel en avant. Le modèle est proposé à un tarif agressif de 2 $ par million de tokens d'entrée et 6 $ par million de tokens de sortie, se positionnant comme une alternative économique face aux poids lourds du secteur. Les tarifs au million de tokens constituent l'unité standard selon laquelle les clients des API paient l'utilisation des modèles, ce qui fait du prix l'un des points de comparaison les plus clairs entre offres concurrentes.
Les résultats des benchmarks dressent un tableau clair : Grok 4.5 est en retard sur le Claude Fable 5 et l'Opus 4.8 d'Anthropic dans plusieurs catégories. L'écart est particulièrement marqué dans les tâches de programmation, où Grok 4.5 n'a obtenu que 53 % au benchmark DeepSWE 1.1 — une catégorie que de nombreux clients prennent sérieusement en compte lorsqu'ils choisissent un modèle pour des travaux d'ingénierie.
Musk a avancé une explication simple à cet écart : xAI opère depuis environ trois ans, tandis qu'ropic a disposé de six ans pour constituer son équipe, affiner son pipeline de recherche et itérer sur ses architectures de modèles. Selon son analyse, la compétition relève du temps de recherche accumulé plutôt que d'une seule version.
Un partenariat avec le rival
Musk ne se contente pas d'être en concurrence avec Anthropic — il est également partenaire de l'entreprise. SpaceX a obtenu un important accord de calcul avec Anthropic portant sur des centaines de mégawatts d'énergie issus des installations Colossus, la vaste infrastructure de centres de données d'xAI. Cet accord fait des deux entreprises des partenaires commerciaux alors même que leurs modèles s'affrontent directement dans les benchmarks.
Musk s'est engagé à maintenir des règles du jeu équitables pour l'accès aux infrastructures d'IA, signifiant qu'il n'utilisera pas son avantage matériel pour freiner ses concurrents. Cet engagement compte dans un marché où l'accès à une puissance de calcul à grande échelle est devenu un facteur déterminant pour l'entraînement et le déploiement des modèles de pointe.
La voie à suivre pour Grok
La stratégie de Musk pour combler l'écart passe par une intégration profonde dans tout son empire industriel. Il encourage l'adoption de Grok en interne chez Tesla et SpaceX, en utilisant les modèles dans les flux de travail opérationnels, tout en laissant les équipes des deux entreprises la flexibilité de choisir des modèles plus performants si nécessaire. Cette flexibilité est notable en soi : les utilisateurs internes peuvent se tourner vers les outils d'un rival s'ils sont plus performants, maintenant une pression constante sur xAI pour s'améliorer.
Musk s'est dit optimiste quant à la capacité de xAI à atteindre un niveau de performance de pointe d'ici 2027. Le défi, c'est qu'Anthropic ne reste pas immobile. Son modèle Opus 5.5, que Musk a spécifiquement cité comme supérieur à Grok, représente une cible mouvante. La rapidité avec laquelle les chiffres des benchmarks convergeront face à un rival livrant des générations successives de modèles constitue le fil à suivre à l'approche de cette échéance de 2027.