OpenAI et Anthropic baissent drastiquement leurs prix face aux modèles IA open source
Points clés
- •Le 30 juillet, OpenAI a réduit de 80 % les prix de GPT-5.6 Luna à 0,20 $ par million de tokens d'entrée et 1,20 $ par million de tokens de sortie, et a baissé GPT-5.6 Terra de 20 % à 2 $/12 $.
- •Le 10 août, Anthropic a rendu permanent le tarif de lancement de Claude Sonnet 5 à 2 $ par million de tokens d'entrée et 10 $ par million de tokens de sortie.
- •Le 22 septembre, OpenAI a lancé GPT-6 Sol et GPT-6 Luna à environ 50 % sous les tarifs de la génération précédente, et Anthropic a répondu avec Claude Opus 5.5 à 4 $/20 $, plus des améliorations d'efficacité représentant environ 40 % d'économies réelles.
- •DeepSeek V4 Flash, en Chine, propose des prix aussi bas qu'environ 0,14 $/0,28 $ par million de tokens, certains modèles chinois approchant les capacités de milieu de gamme américaines à des coûts cinq à neuf fois inférieurs.
- •Ces fortes baisses de prix propriétaires réduisent l'écart de coût qui justifie l'auto-hébergement de modèles open source, et les futures documentations d'IPO des deux sociétés révéleront si les tokens bradés se convertissent en revenus à grande échelle.

La guerre des prix de l'IA est entrée dans une nouvelle phase. Tout au long de 2026, OpenAI et Anthropic ont systématiquement réduit les prix de leurs modèles de milieu de gamme, avec des baisses suffisamment marquées pour amener les développeurs à se demander si les alternatives open source restent dignes de la complexité de l'auto-hébergement. Comme les frais par token constituent le principal coût récurrent pour les équipes qui exploitent des fonctionnalités d'IA en production, des baisses de cette ampleur se répercutent directement sur les arbitrages entre développement interne et achat dans tout le secteur.
Les chiffres de la guerre des prix
Le 30 juillet, OpenAI a réduit de 80 % les prix de GPT-5.6 Luna, faisant passer les coûts à 0,20 $ par million de tokens d'entrée et 1,20 $ par million de tokens de sortie. Le modèle haut de gamme GPT-5.6 Terra a également subi une baisse de 20 %, à 2 $ en entrée et 12 $ en sortie par million de tokens.
Anthropic a emboîté le pas le 10 août, en rendant permanent le tarif de lancement de Claude Sonnet 5 à 2 $/10 $ par million de tokens.
Une deuxième vague est arrivée le 22 septembre. AI a lancé GPT-6 Sol et GPT-6 Luna à 2 $/10 $ et 0,10 $/0,50 $ respectivement, soit environ 50 % de moins que les tarifs de la génération précédente. Anthropic a répliqué avec Claude Opus 5.5 à un tarif officiel de 4 $/20 $, les améliorations intégrées d'efficacité apportant environ 40 % d'économies réelles pour les utilisateurs.
Pour les lecteurs qui découvrent ces grilles : la tarification des API est facturée par million de tokens — les bloc de mots et de caractères que les modèles traitent — l'entrée, le texte qu'un modèle reçoit, étant généralement facturée moins cher que la sortie, le texte qu'il génère.
Pourquoi l'open source se sent sous pression
L'auto-hébergement de modèles à poids ouverts n'entraîne aucun frais par token, mais déplace les coûts vers le matériel GPU, le temps d'ingénierie et une exploitation 24 heures sur 24. Chaque baisse de prix officielle des modèles propriétaires réduit l'écart que l'auto-hébergement doit encore justifier face à ces frais généraux.
Les entreprises scindent de plus en plus leurs charges de travail en plusieurs niveaux. Les modèles propriétaires bon marché traitent les tâches courantes comme la synthèse, la classification et les interactions clients de base, tandis que les modèles premium sont réservés aux charges de travail spécialisées où les écarts de performance comptent réellement.
L'open source conserve une part de volume significative, en particulier sur des plateformes comme OpenRouter, où les développeurs mélangent les modèles via une intégration unique.
Le facteur chinois
Les entreprises chinoises d'IA fixent des références de prix agressivement basses qui rendent même les tarifs américains réduits coûteux en comparaison. DeepSeek V4 Flash propose des prix aussi bas qu'environ 0,14 $/0,28 $ par million de tokens, creusant un large écart avec ses concurrents américains. À fort volume, de tels écarts se transforment rapidement en factures mensuelles très différentes pour les grandes charges de travail.
L'écart de performance se resserre également. Certains modèles chinois approchent désormais les capacités de milieu de gamme américaines à des coûts cinq à neuf fois inférieurs.
Arithmétique d'IPO et pression sur les marges
OpenAI comme Anthropic sont largement attendues sur le chemin d'introductions en Bourse. Baisser les prix agressivement stimule l'adoption et les métriques d'usage, mais comprime aussi les marges. Le pari est que des prix plus bas entraînent des volumes plus élevés, et que ces volumes finissent par compenser les marges plus faibles sur chaque appel API individuel.
Cet arbitrage pèse d'autant plus à l'approche d'une cotation en Bourse, où les investisseurs examinent généralement croissance et rentabilité côte à côte. En tant que sociétés privées, aucune des deux entreprises ne publie aujourd'hui de comptes audités ; leurs futurs documents d'IPO offriront donc au secteur son premier regard concret sur la question de savoir si les tokens bradés se traduisent en revenus à grande échelle.