DeepSeek annonce « moitié prix » et multiplie sa facture par 2,3
Le nouveau barème s'applique le 16 août à 16:00 UTC. L'annonce vante une remise de 50 % en heures creuses ; le tarif de sortie, lui, est multiplié par 2,3.
[ Emplacement Google AdSense — Id: NEXT_PUBLIC_ADSENSE_CLIENT_ID non configuré ]
DeepSeek a publié le 13 août l'annonce de disponibilité générale de V4-Pro. Une ligne y concerne la facturation, et une seule : « Off-peak rates are 50% lower than peak, enabling more flexible workload scheduling. » Des heures creuses moitié prix. La formulation est exacte, la conclusion qu'on en tire spontanément est fausse.
Le nouveau barème entre en vigueur le 16 août 2026 à 16:00 UTC. Il n'introduit pas une remise sur les tarifs actuels : il introduit un tarif de référence nettement supérieur, sur lequel une remise s'applique ensuite. Résultat net, même en heures creuses, vous paierez plus du double d'aujourd'hui.
Les chiffres, relevés sur la page de tarification
Prix par million de tokens, en dollars, pour DeepSeek-V4-Pro.
| Jusqu'au 16 août | Heures creuses | Heures pleines | |
|---|---|---|---|
| Entrée, cache manqué | 0,435 | 0,66 | 1,32 |
| Entrée, cache touché | 0,003625 | 0,022 | 0,044 |
| Sortie | 0,87 | 1,98 | 3,96 |
Sur la sortie, qui domine la facture de tout usage conversationnel ou agentique, le tarif est multiplié par 2,3 en heures creuses et par 4,6 en heures pleines. V4-Flash suit exactement le même mouvement : 0,28 en sortie aujourd'hui, contre 0,66 et 1,32 demain.
L'affirmation de l'annonce reste littéralement vraie. Les heures creuses coûtent bien la moitié des heures pleines. Elle est simplement muette sur le point qui vous intéresse, à savoir la comparaison avec ce que vous payez ce matin.
Le cadrage, et pourquoi il fonctionne
Le procédé est connu des services financiers et de la distribution : on déplace le point de référence, puis on communique sur l'écart au nouveau point plutôt que sur l'écart à l'ancien. Personne ne ment, et personne ne comprend.
Ce qui rend le cas intéressant, c'est que DeepSeek s'est construit une réputation sur le prix. C'est l'argument qui l'a installé, et l'écart avec les modèles occidentaux restera d'ailleurs considérable après le 16 août. La hausse ne remet pas en cause son positionnement. Elle rappelle seulement qu'un tarif d'appel est une décision commerciale révisable, jamais une propriété du modèle — nous faisions la même observation à propos des grilles occidentales dans notre comparatif des modèles IA 2026.
Vos heures pleines tombent sur votre matinée
C'est la partie qu'aucune couverture anglophone ne relèvera, et c'est celle qui change votre facture.
Les heures pleines sont fixées de 01:00 à 04:00 et de 06:00 à 10:00 UTC. En heure d'été française, cela donne 03h–06h et 08h–12h. Autrement dit : votre matinée de travail, de huit heures à midi, est intégralement facturée au tarif fort. Votre après-midi, du déjeuner au soir, est en heures creuses.
Pour un usage interactif, vous n'y pouvez rien — on ne déplace pas une équipe. Mais pour tout ce qui est traitement par lots, l'arbitrage est immédiat : indexation nocturne, génération de résumés, enrichissement de bases, tests de non-régression sur des jeux de prompts. Déplacer ces travaux après midi divise leur coût par deux, sans toucher une ligne de code.
Une précision de calendrier : ces horaires sont exprimés en UTC et ne bougent pas. Le décalage avec Paris, lui, change au passage à l'heure d'hiver — les heures pleines deviendront alors 02h–05h et 07h–11h. La fenêtre coûteuse glissera d'une heure vers le matin, et mordra un peu moins sur votre journée.
Ce qu'il faut faire d'ici ce soir
Si vous appelez l'API DeepSeek en production, deux gestes suffisent avant 18 heures, heure de Paris.
Relevez d'abord votre consommation des trente derniers jours, séparément pour l'entrée et la sortie, et appliquez-lui les deux nouvelles grilles. Vous obtiendrez la fourchette réelle de votre facture de septembre. C'est un calcul de dix minutes, et il évite la découverte en fin de mois.
Vérifiez ensuite si vos traitements par lots sont planifiés. S'ils tournent le matin par habitude plutôt que par nécessité, les repousser après midi est l'optimisation la plus rentable que vous ferez cette semaine.
Il reste un point à surveiller, que nous traitons séparément : le rapport entre cache touché et cache manqué se resserre lui aussi dans ce barème, et il se resserre beaucoup. L'optimisation des préfixes de prompt ne rapportera plus ce qu'elle rapportait.
Tarifs relevés le 15 août 2026 sur la documentation officielle de DeepSeek. Ils sont datés par construction : le barème décrit ici entre en vigueur le 16 août 2026 à 16:00 UTC et remplace celui en cours.
Sources
- DeepSeek — Models & Pricing, grilles avant et après le 16 août 2026
- DeepSeek — DeepSeek-V4-Pro GA Release, annonce du 13 août 2026
- DeepSeek — Change Log
À lire ensuite
- Actualités & Sorties
AI Act : l’obligation s’applique, mais qui vous contrôle en France ?
Il n'y a pas une autorité de contrôle en France, mais une quinzaine : DGCCRF en coordination, CNIL, Arcom, ACPR, AMF, ANSSI. Savoir de laquelle vous relevez.
7 min
- Actualités & Sorties
Gemini 3.7 Flash : le tarif affiché double le 1er janvier
0,75 $ en entrée jusqu'au 31 décembre, exactement le double au 1er janvier 2027. Troisième éditeur en un mois : votre budget 2027 calculé aujourd'hui est faux.
5 min
- Actualités & Sorties
Le prix de vos tokens varie d’un facteur 120 — et cet écart se referme demain
Un million de tokens d'entrée coûte 0,435 $ s'il faut le lire, 0,003625 $ s'il a déjà été lu. Ce levier pèse plus que le choix du modèle — et il faiblit demain.
5 min
- Actualités & Sorties
Trois semaines entre deux versions : arrêtez de choisir un modèle
Gemini 3.7 Flash arrive trois semaines après la 3.6 ; votre cycle d'évaluation en prend six. Vous ne choisissez jamais le meilleur modèle, mais l'avant-dernier.
5 min
[ Emplacement Google AdSense — Id: NEXT_PUBLIC_ADSENSE_CLIENT_ID non configuré ]
Commentaires (0)
Laisser un commentaire
Soyez le premier à commenter cet article.