ActualitésActionsOpenAI réduit les prix de ses modèles alors que les entreprises s'inquiètent de leurs dépenses en IA

OpenAI réduit les prix de ses modèles alors que les entreprises s'inquiètent de leurs dépenses en IA

Auteur: AI Business·

Points clés

  • OpenAI a réduit le prix du modèle GPT-5.6 Luna de 80 % et celui du modèle GPT-5.6 Terra de 20 %, tout en laissant inchangé le prix du modèle phare GPT-5.6 Sol.
  • Le modèle Luna, dont le prix a été revu à la baisse, coûte 0,20 $ par million de tokens d'entrée, contre 3 $ par million de tokens d'entrée pour le Claude Sonnet 4.6 d'Anthropic, un modèle comparable.
  • OpenAI a lancé un nouveau mode Fast pour le modèle Sol dans l'API, revendiquant des vitesses de traitement supérieures de plus de 2,5 fois par rapport au traitement standard.
  • L'entreprise a attribué les réductions de prix aux améliorations d'efficacité réalisées lors du développement de GPT-5.6, s'inscrivant dans une tendance industrielle plus large de réduction des coûts d'inférence.
  • Les baisses de prix interviennent alors que les entreprises remettent de plus en plus en question le retour sur investissement de l'IA, illustré par la décision récente d'Uber d'imposer des plafonds de dépenses en IA par employé.
OpenAI réduit les prix de ses modèles alors que les entreprises s'inquiètent de leurs dépenses en IA

OpenAI a sensiblement réduit les prix de deux de ses modèles ChatGPT-5.6, une décision qui signale une intensification de la guerre des prix sur le marché des modèles d'IA et qui intervient alors que les entreprises examinent de plus près leurs dépenses en IA.

Une annonce publiée le 30 juillet sur le site d'OpenAI a confirmé que le coût du modèle GPT-5.6 Luna — le plus rapide et le plus abordable de l'entreprise — baissera de 80 %, tandis que le modèle intermédiaire GPT-5.6 Terra, conçu pour les tâches quotidiennes, connaîtra une réduction de 20 %. Le prix du modèle phare Sol reste inchangé, bien qu'OpenAI indique qu'il est désormais plus rapide via l'API. Les trois modèles ont été introduits il y a trois semaines.

« Ces mises à jour aident les clients à tirer davantage de chaque dollar investi dans l'IA et à aller plus vite lorsque le temps compte », a déclaré OpenAI.

Les nouveaux tarifs API sont déjà en vigueur. Terra est fixé à 2 $ par million de tokens d'entrée et à 12 $ par million de tokens de sortie, tandis que Luna coûte 0,20 $ par million de tokens d'entrée et 1,20 $ par million de tokens de sortie. À titre de comparaison, le modèle intermédiaire Claude Sonnet 4.6 d'Anthropic est tarifé à 3 $ par million de tokens d'entrée et à 15 $ par million de tokens de sortie. Étant donné que les clients API — principalement des développeurs et des entreprises qui créent des applications — paient en fonction du volume de texte traité, les variations de prix par token se répercutent directement sur l'économie unitaire des produits et services basés sur l'IA.

De plus, un nouveau mode Fast pour GPT‑5.6 Sol remplace le Priority Processing dans l'API. OpenAI affirme que le mode Fast fonctionne à des vitesses supérieures de plus de deux fois et demie par rapport au traitement standard.

Des gains d'efficacité rendent les réductions possibles

OpenAI a attribué les baisses de prix aux améliorations d'efficacité obtenues lors du développement de son modèle fondational GPT-5.6.

« Notre stratégie reste axée sur le progrès simultané des capacités et de l'efficacité, afin que chaque génération d'intelligence puisse accomplir davantage de travail à un coût moindre », a déclaré l'entreprise dans un communiqué. À l'échelle de l'industrie, les fournisseurs réduisent les coûts d'inférence grâce à une combinaison d'améliorations de l'architecture des modèles, de techniques de quantification et d'infrastructures de service optimisées.

Les entreprises remettent en question le retour sur investissement de l'IA

Ces réductions surviennent alors que les organisations sont de plus en plus préoccupées par le coût de l'adoption de l'IA. Une récente enquête de fournisseur a révélé que les dépenses en IA des entreprises ont augmenté rapidement avec peu de contrôle, et que de nombreuses sociétés ne savent toujours pas si leurs investissements génèrent un retour.

En juin, Uber a attiré l'attention lorsqu'elle a imposé un plafond de dépenses en IA par employé, illustrant la pression croissante pour maîtriser les coûts.

Un marché saturé et hautement concurrentiel

Les ajustements tarifaires reflètent également un paysage hautement concurrentiel. Les modèles chinois à bas coût de fournisseurs tels qu'Alibaba et Moonshot rivalisent directement avec les offres des leaders technologiques américains, notamment Google et Microsoft. À mesure que les modèles de pointe convergent de plus en plus dans leurs performances de référence, les fournisseurs se différencient plus agressivement sur le prix, la vitesse et le coût total de possession. Ces réductions soulignent en outre la rivalité entre OpenAI et Anthropic, toutes deux en voie d'introduction en bourse — un calendrier qui ajoute une pression pour démontrer une croissance des revenus et une adoption entreprise auprès des futurs investisseurs.

La décision d'OpenAI marque la dernière offensive dans ce qui s'annonce comme une guerre des prix durable, alors que les fournisseurs de modèles se disputent des clients entreprise qui exigent simultanément des preuves plus solides du retour sur leurs investissements en IA.