DeepSeek augmente ses prix d'API jusqu'à 1 100 % à partir du 16 août
Points clés
- •DeepSeek augmentera les prix d'API pour ses modèles V4-Flash et V4-Pro à partir du 16 août à 16:00 UTC.
- •L'entreprise ajoute une tarification en heures de pointe et en heures creuses, l'utilisation en heures de pointe étant facturée au double du tarif en heures creuses.
- •Pour le V4-Flash, les jetons d'entrée en cache-hit en heures creuses passeront à 0,007 $ par million, et les jetons de sortie augmenteront à 0,66 $ par million.
- •DeepSeek a indiqué avoir annoncé le changement environ dix jours à l'avance et l'a attribué à une demande accrue.
- •Les tarifs de l'entreprise restent inférieurs à ceux des principaux fournisseurs de LLM commerciaux, bien que l'écart de prix se soit réduit.

DeepSeek, l'entreprise d'intelligence artificielle basée à Hangzhou qui a bouleversé l'industrie de l'IA avec des modèles de langage remarquablement peu coûteux, met en œuvre des hausses de prix substantielles sur l'ensemble de ses offres d'API. À partir du 16 août à 16:00 UTC, l'entreprise augmentera les prix de ses modèles V4-Flash et V4-Pro de 50 % à plus de 1 100 %, selon le type de jeton et l'heure de la journée.
Cette restructuration introduit un nouveau système de tarification à paliers avec des périodes de pointe et des périodes creuses. L'utilisation de l'API pendant les heures de fort trafic coûtera deux fois plus cher que pendant les périodes creuses. Cette approche par paliers reflète les stratégies de gestion de la demande utilisées par les fournisseurs d'infrastructure cloud, où la tarification dynamique aide à allouer les ressources de calcul pendant les périodes de trafic API concentré — une considération particulièrement pertinente pour l'inférence des grands modèles de langage, qui reste gourmande en calculs même si les coûts d'entraînement ont diminué.
Détail de la tarification
Pour le modèle V4-Flash, les jetons d'entrée en cache-hit en heures creuses coûteront 0,007 $ par million, contre 0,0028 $ auparavant — une augmentation de 150 %. Les jetons d'entrée en cache-miss passeront de 0,14 $ à 0,22 $ par million, soit une augmentation d'environ 57 %. Les jetons de sortie augmenteront de 0,28 $ à 0,66 $ par million pendant les heures creuses.
Les tarifs en heures de pointe doubleront tous les chiffres des heures creuses. Les jetons de sortie pendant les périodes de fort trafic atteindront 1,32 $ par million, soit près de cinq fois le tarif unique précédent de 0,28 $ par million. Les modèles V4-Pro suivront une structure à paliers similaire, avec des tarifs en heures de pointe fixés au double du niveau des heures creuses.
Même après ces augmentations, les tarifs de DeepSeek restent positionnés à l'extrémité inférieure du marché commercial des API LLM, où les principaux fournisseurs tels qu'OpenAI et Anthropic facturent des tarifs par million de jetons nettement plus élevés pour leurs modèles de pointe. Cet ajustement réduit — sans toutefois l'éliminer — l'écart de prix qui a fait de DeepSeek un point de mire pour les développeurs et les entreprises cherchant une inférence à moindre coût.
Calendrier et contexte
DeepSeek a signalé l'ajustement à venir environ dix jours à l'avance. Vers le 6 août, l'entreprise a indiqué que des changements de prix étaient à venir, citant une demande accrue comme principal facteur.
Fondée en 2023 par Liang Wenfeng, DeepSeek opère sous une structure de financement qui la distingue dans le paysage compétitif de l'IA. L'entreprise est soutenue exclusivement par High-Flyer, un fonds quantitatif chinois. DeepSeek a attiré l'attention pour avoir livré de grands modèles de langage aux capacités concurrentielles avec les principales alternatives occidentales pour une fraction du coût, suscitant des discussions à travers le secteur mondial de l'IA sur l'efficacité des coûts et l'accessibilité. La hausse des prix marque un point d'inflexion notable pour une entreprise dont la stratégie de tarification ultra-basse était au cœur de cette rupture, et les développeurs construisant sur l'API de DeepSeek suivront probablement avec attention l'éventualité de nouveaux ajustements à mesure que la demande continue de croître.