La hausse des prix de l’API de DeepSeek, jusqu’à 12 fois, redessine la carte de l’IA abordable

Le dimanche 16 août, DeepSeek remplacera sa tarification API plate par jeton par une facturation en heures pleines et heures creuses, la première surtaxe horaire introduite par un laboratoire d’IA chinois et un revirement brutal pour l’entreprise qui a bâti sa réputation mondiale en rendant l’intelligence de niveau quasi frontalier presque gratuite. Les nouveaux tarifs, publiés sur la page officielle des prix de DeepSeek, augmentent les prix sur tous les modèles et toutes les lignes de tarif. À l’extrême, le tarif d’entrée en cas de cache atteint pour V4-Pro en heures pleines passe de 0,003625 $ à 0,044 $ par million de jetons, une multiplication par douze que Quartz a résumée comme une hausse allant jusqu’à 1 100 %. Pour les charges de travail mixtes typiques, l’augmentation se situe plutôt entre deux et quatre fois, et même les heures creuses à prix réduit coûtent plus cher que les tarifs plats actuels.

La structure compte autant que les chiffres. Les heures pleines sont 01:00-04:00 et 06:00-10:00 UTC, autrement dit la journée de travail de Pékin : 09:00-12:00 et 14:00-18:00. Les tarifs des heures creuses représentent la moitié des tarifs des heures pleines, si bien que le calendrier se lit comme un mécanisme de rationnement de la demande dans le style des surtaxes dynamiques des applications de VTC appliquées aux jetons. Les jetons d’entrée (cache manqué) augmentent de 1,5 à 3 fois selon le modèle et la fenêtre, les jetons de sortie de 2,3 à 4,7 fois, et les tarifs de cache atteint qui ont fait de DeepSeek le choix par défaut pour les charges de travail intensives en recherche et les charges de travail agentiques augmentent de 2,5 à 6 fois en heures creuses et de 5 à 12 fois en heures pleines.

La hausse intervient moins de trois mois après que DeepSeek a rendu permanente une réduction de 75 % du prix de V4-Pro, elle-même la continuation de la campagne lancée début 2025, lorsque la sortie de sa gamme de modèles V3 a effacé des centaines de milliards de dollars de la valeur des actions technologiques américaines en une seule séance et a entraîné Alibaba, Zhipu et MiniMax dans une guerre des prix. V4-Flash et V4-Pro ont été lancés en avril à 0,14 $ en entrée et 0,28 $ en sortie, et 0,435 $ en entrée et 0,87 $ en sortie, par million de jetons ; les anciens alias deepseek-chat et deepseek-reasoner ont été retirés le 24 juillet, et la surtaxe de pointe a été signalée pour la première fois le 30 juin avec un démarrage prévu à la mi-juillet. La version publiée pour le 16 août est plus agressive que cette première annonce : la version de juin promettait que les prix hors heures pleines resteraient inchangés, tandis que le calendrier final augmente aussi les tarifs des heures creuses.

La position de DeepSeek sur le marché après ce changement dépend entièrement de l’horloge. En heures creuses, V4-Flash à 0,22 $ en entrée et 0,66 $ en sortie par million de jetons reste le modèle à contexte d’un million le moins cher doté d’une capacité de niveau quasi frontalier, environ 20 à 45 fois moins cher que le produit phare d’OpenAI, GPT-5.6 Sol, qui facture 5 $ par million de jetons d’entrée et 30 $ par million de jetons de sortie, et encore plus loin de Claude Fable 5 à 10 $ et 50 $ par million de jetons respectivement. En heures pleines, le plancher disparaît : la sortie de Flash à 1,32 $ coûte plus cher que les 1,20 $ de MiniMax M3, plusieurs fois les 0,20 $ de Qwen Turbo, et se situe dans la même fourchette que les modèles occidentaux de milieu de gamme. V4-Pro en heures pleines, à 1,32 $ en entrée et 3,96 $ en sortie, n’est plus un produit phare économique ; c’est un produit de milieu de marché qui concurrence Gemini 3 Flash et la gamme GPT-5 la moins chère.

If our reporting has earned your trust, consider helping us continue our work.

Soutenir 1ban.news

La géographie des fenêtres de pointe détermine qui absorbe l’augmentation. Pour l’Afrique de l’Ouest et l’Afrique centrale, la fenêtre 06:00-10:00 UTC couvre la matinée de travail 07:00-11:00, d’Accra à Lagos en passant par Johannesburg. L’Afrique de l’Est est semblable : la matinée de travail 09:00-13:00 de Nairobi tombe en heures pleines. L’Asie du Sud et l’Asie du Sud-Est sont moins bien loties : Delhi, Dacca, Jakarta et Manille ont toutes deux fenêtres de pointe à l’intérieur de la journée de travail, si bien que la surtaxe s’applique pendant une grande partie du temps où les développeurs construisent réellement. La matinée européenne est également taxée. L’Amérique latine est l’exception : les deux fenêtres tombent le soir et la nuit à São Paulo, Mexico et Buenos Aires, ce qui donne à la région des tarifs d’heures creuses pendant toute sa journée de travail, et les heures de travail nord-américaines sont elles aussi en heures creuses. Un calendrier tarifaire calibré sur l’horloge de Pékin taxe en pratique l’utilisation de jour dans les régions mêmes où les prix bas de DeepSeek avaient l’effet le plus démocratisant.

Les conséquences pour les marchés émergents sont concrètes. Les startups de l’edtech, de la fintech, de la healthtech et de l’agritech, en Afrique comme en Asie, ont construit leurs systèmes de production en partant du principe que les prix des jetons continueraient de baisser ; une augmentation de deux à quatre fois, avec des tarifs de cache atteint en hausse jusqu’à six fois ou plus pour les charges de travail agentiques, érode des marges déjà minces. La charge est amplifiée par les devises : les factures d’API sont libellées en dollars tandis que les revenus arrivent en nairas, en shillings, en roupies et en rupiahs, des devises qui ont perdu du terrain face au dollar, si bien que l’augmentation effective en monnaie locale est plus forte que ne le suggère le chiffre en dollars.

La migration est la réponse probable. Qwen Turbo d’Alibaba coûte une fraction du prix de DeepSeek après la hausse sur les tâches simples et offre un contexte d’un million de jetons ; MiniMax M3 est en open weight, moins cher en sortie que Flash en heures pleines, et couvre également un million de jetons ; Kimi et GLM sont tout proches. Les développeurs qui sont arrivés chez DeepSeek par l’intermédiaire d’agrégateurs comme OpenRouter verront l’augmentation s’y répercuter aussi. Pour les charges de travail à fort volume, les poids de l’aperçu V4 d’avril de DeepSeek restent ouverts, ce qui fait de l’auto-hébergement l’échappatoire rationnelle pour ceux qui peuvent obtenir des GPU, mais dans la plupart des marchés émergents, la puissance de calcul est rare, chère et souvent soumise à des restrictions d’importation, si bien que l’auto-hébergement est un luxe plutôt qu’un choix par défaut.

La hausse déplace aussi le plancher tarifaire de tout le segment. DeepSeek a défini ce que coûtaient les jetons bon marché de niveau quasi frontalier, et son nouveau plancher de 0,22 $ en entrée et 0,66 $ en sortie par million de jetons réinitialise les attentes de tout acheteur sensible au prix et donne aux concurrents une marge de manœuvre. The Next Web a noté que les rivaux peuvent désormais courtiser les développeurs avec des promesses de tarif fixe ; le premier à bouger pourrait être Alibaba, qui a l’échelle et l’écosystème open weight pour absorber la demande sensible au prix en Asie et en Afrique. L’ouverture concurrentielle est suffisamment réelle pour que Microsoft, dont Bloomberg rapportait en mars qu’il poussait sa propre campagne d’adoption en Afrique, explicitement pour défier DeepSeek, ait un argumentaire plus facile à vendre après dimanche.

D’un point de vue stratégique, il s’agit de capacité. DeepSeek est la victime la plus visible de la pénurie de puissance de calcul du secteur : les pénuries de mémoire ont fait monter les prix des GPU dans le cloud, Amazon ayant augmenté ses tarifs au milieu de la pression, et une entreprise qui avait promis des jetons presque gratuits a concédé que les puces qui les sous-tendent ne le sont pas. L’entreprise a indiqué aux développeurs que l’augmentation reflète la hausse des coûts de calcul, les goulots d’étranglement de capacité et un trafic record ; son modèle V4-Flash est monté en tête des classements mondiaux d’utilisation de jetons sur OpenRouter et Ollama, en enregistrant des billions de jetons, et Bloomberg a rapporté des projets de centre de données d’un gigawatt en Mongolie intérieure. DeepSeek n’est d’ailleurs pas seul : Zhipu a augmenté ses prix d’API de 83 % en glissement annuel au premier trimestre, et Moonshot et ByteDance ont ajouté des paliers payants ou suspendu les inscriptions pour gérer leur capacité, un recul plus large face à la guerre des prix lancée par les laboratoires chinois. La tarification horaire déplace la charge vers les heures calmes, et les heures calmes se trouvent être la journée de travail de l’Amérique latine et de l’Amérique du Nord. La surtaxe s’accompagne aussi d’une incitation inhabituelle : les discussions sur Hacker News notent que DeepSeek encourage les utilisateurs à augmenter leur utilisation au cours des deux à trois prochains mois, ce qui suggère que de nouveaux modèles arrivent et que le calendrier du 16 août pourrait être autant un pont vers une gamme de produits retarifée qu’un changement autonome.

Rien de tout cela ne rend DeepSeek cher en termes absolus. En heures creuses, elle reste un ordre de grandeur moins chère que les produits phares occidentaux ; l’application grand public est toujours gratuite ; et le chiffre extrême de 12 fois est un cas limite plutôt que la facture typique. Mais l’entreprise qui a fait des prix de l’IA plats et en baisse la référence pour les développeurs les plus sensibles au prix du monde a mis sous eux un plancher et un pic. Les régions qui ont le plus profité de cette référence, l’Afrique et la majeure partie de l’Asie, sont celles dont les heures de travail tombent dans les nouvelles fenêtres de surtaxe. Le résultat probable est une migration silencieuse vers Qwen, MiniMax et les poids ouverts, un argument plus fort en faveur d’une infrastructure d’IA locale et souveraine, et une version plus petite de l’histoire de l’IA abordable sur les marchés où elle était la plus réelle.

Traduit par Lydie

Sources: Models & Pricing (DeepSeek API Docs, official rate card, Aug 2026); DeepSeek raises API pricing for its V4 models (Reuters, Aug 13, 2026); DeepSeek raising API prices by up to 1,100% starting Aug. 16 (Quartz, Aug 13, 2026); DeepSeek breaks China’s AI price war with peak-hour surge pricing (The Next Web, Jul 1, 2026); DeepSeek Prepares Significant Price Hike (Android Headlines, Aug 6, 2026); DeepSeek API Pricing (BenchLM, Aug 2026); LLM API Pricing Comparison (BuildMVPFast, Jul 2026); Microsoft pushes for Africa AI adoption in challenge to DeepSeek (Bloomberg, Mar 2026); DeepSeek announced to raise its API price tremendously (Hacker News, Aug 2026)

Scroll to Top