Combien coûte DeepSeek pour le travail de codage en 2026 ?
DeepSeek-V4-Pro-0813 coûte 0,66 $ par million de jetons d'entrée avec cache miss en heures creuses et 1,98 $ par million de jetons de sortie en heures creuses, et le double de ces chiffres pendant les heures de pointe. L'entrée mise en cache coûte 0,022 $ par million en heures creuses, c'est là que se trouve le véritable avantage financier.
DeepSeek est le seul grand fournisseur de modèles qui facture en fonction de l'heure de la journée. Deux multiplicateurs s'additionnent, et à eux deux, ils expliquent entièrement le coût réel de DeepSeek : les heures creuses divisent la facture par deux, et un cache hit coûte environ 30 fois moins cher qu'un cache miss.
Cette combinaison est la plus importante pour le codage. Une boucle de codage agentique rejoue le même contexte de dépôt à chaque tour, c'est donc la seule charge de travail pour laquelle des taux de cache hit élevés sont plus structurels que fortuits.
DeepSeek lui-même ne propose aucun programme de crédits de démarrage. Les fournisseurs qui le font sont répertoriés sur AI Perks, aux côtés de 7,7 millions de dollars de crédits pour 194 entreprises.

Tarification heures de pointe et heures creuses : le mécanisme que personne n'explique
Les heures de pointe de DeepSeek sont de 01h00 à 04h00 et de 06h00 à 10h00 UTC en semaine. Tout le reste, y compris tout le samedi et le dimanche, est en heures creuses à moitié prix.
Tarification actuelle, par million de jetons :
| Modèle | Entrée, cache hit | Entrée, cache miss | Sortie |
|---|---|---|---|
| DeepSeek-V4-Pro-0813, heures creuses | 0,022 $ | 0,66 $ | 1,98 $ |
| DeepSeek-V4-Pro-0813, heures de pointe | 0,044 $ | 1,32 $ | 3,96 $ |
| DeepSeek-V4.1-Flash, heures creuses | 0,003 $ | 0,15 $ | non publié |
| DeepSeek-V4.1-Flash, heures de pointe | 0,006 $ | 0,30 $ | non publié |
Deux choses découlent de ces créneaux que presque personne ne dit à voix haute. Les deux sont des calculs dérivés du calendrier UTC publié, et non des chiffres cités.
Les heures de pointe ne représentent qu'environ 21 % de la semaine. Sept heures de pointe par jour de semaine font 35 heures sur 168. Un peu moins de 80 % de tout le temps est déjà en heures creuses avant que vous ne changiez quoi que ce soit.
Une journée de travail américaine complète ne touche jamais les heures de pointe. De 9h à 17h dans le Pacifique, cela correspond à 16h00-24h00 UTC. De 9h à 17h dans l'Est, cela correspond à 13h00-21h00 UTC. Aucune de ces fenêtres ne chevauche un bloc de pointe, de sorte que les équipes basées aux États-Unis paient par accident la moitié du prix. Les matins européens font exception : de 08h00 à 10h00 UTC sont des heures de pointe, ce qui correspond à 9h00-11h00 à Londres et 10h00-midi à Berlin.
Il y a également un décalage de deux heures creuses entre les deux blocs de pointe, de 04h00 à 06h00 UTC, ce qui constitue une place de parking gratuite pour les tâches CI nocturnes et les refactorisations par lots.
Pourquoi les cache hits sont plus importants pour le codage que pour le chat
Un cache hit sur DeepSeek-V4-Pro coûte 0,022 $ par million de jetons en heures creuses contre 0,66 $ pour un cache miss, soit un écart de 30x, et les agents de codage génèrent les taux de cache hit naturels les plus élevés de toutes les charges de travail.
Le trafic de chat est un flux d'invites courtes sans rapport les unes avec les autres, donc la plupart des entrées sont nouvelles. Un agent de codage est le contraire : il conserve le même arborescence de fichiers, la même invite système et le même diff récent à travers chaque tour d'une longue session.
Voici ce que font les deux multiplicateurs sur une pièce de travail identique. Volumes illustratifs, arithmétique dérivée des prix indiqués ci-dessus :
| Une exécution d'agent : 2M entrées, 200K sorties | Coût |
|---|---|
| Heures creuses, taux de cache hit de 90 % | 0,57 $ |
| Heures de pointe, taux de cache hit de 90 % | 1,14 $ |
| Heures creuses, pas de cache | 1,72 $ |
| Heures de pointe, pas de cache | 3,43 $ |
Mêmes jetons, même modèle, même sortie. Un écart de 6x sur un travail identique, décidé entièrement par l'heure et la discipline du cache.
Poussons à l'extrême et l'écart se creuse encore : un jeton d'entrée mis en cache en heures creuses à 0,022 $ par million contre un jeton de cache miss en heures de pointe à 1,32 $ par million représente un écart de 60x sur le même modèle. Aucun autre fournisseur n'a un tel levier, c'est pourquoi si peu de tutoriels le mentionnent.
À mille exécutions d'agents par mois, la même arithmétique dérivée donne environ 570 $ contre environ 3 430 $. Pour une équipe qui paie également pour Claude ou GPT pour les tâches difficiles, AI Perks couvre la partie crédits de cette facture.

Ce qui a changé chez DeepSeek depuis le lancement de V4
Quatre versions en cinq mois ont fait passer DeepSeek d'un prix fixe par jeton à un prix par heure de la journée, et la plupart des guides publiés citent encore les anciens chiffres fixes.
La séquence, avec la confiance indiquée là où elle devrait l'être :
- 24 avril 2026 : Préversion de DeepSeek V4-Pro et V4-Flash. Contexte de 1 million de jetons, jusqu'à 384K jetons de sortie, modes de réflexion et sans réflexion commutables. (Confiance : moyenne.)
- 31 juillet 2026 : DeepSeek-V4-Flash-0731, la version stable Flash. Le prix était alors de 0,14 $ par million d'entrées avec cache miss et 0,28 $ par million de sorties. (Contexte historique uniquement, pas la tarification actuelle.)
- 13 août 2026 : DeepSeek-V4-Pro-0813 atteint la disponibilité générale en tant que modèle phare de raisonnement et d'agent.
- 16 août 2026 : la division heures de pointe et heures creuses arrive et la tarification fixe prend fin.
- Environ 10 septembre 2026 : DeepSeek-V4.1-Flash, en direct dans la documentation sous le nom de "DeepSeek-Flash".
Si vous lisez une comparaison des coûts de DeepSeek qui affiche un seul prix d'entrée et un seul prix de sortie sans mention des heures UTC, elle est antérieure au 16 août 2026 et ses conclusions sont erronées dans les deux sens.
Le renommage d'endpoint qui casse le vieux code
DeepSeek-V4.1-Flash a discrètement retiré les noms de modèles deepseek-v4-flash et deepseek-v4-flash-vision-exp. Le code qui les utilise encore échouera.
C'est le genre de changement qui peut mettre une équipe en difficulté à une heure inattendue, car l'échec survient à l'exécution dans le service qui utilise la chaîne, et non à la compilation. Les anciens tutoriels, les réponses Stack Overflow et les fichiers de configuration copiés-collés portent toujours les noms retirés.
Deux conséquences pratiques. Premièrement, faites une recherche grep dans votre dépôt pour ces deux chaînes avant votre prochain déploiement, pas après. Deuxièmement, considérez tout tutoriel DeepSeek publié avant septembre 2026 comme non fiable en ce qui concerne les identifiants de modèle ainsi que le prix.

DeepSeek a-t-il un niveau gratuit ou des crédits de démarrage ?
L'application de chat DeepSeek est gratuite. Il n'y a pas de niveau gratuit d'API indiqué sur la page de tarification officielle, et DeepSeek ne mène aucun programme de crédits de démarrage dédié.
Soyez prudent avec les deuxième et troisième points, car c'est là que la plupart des sites se trompent sur DeepSeek. Les affirmations selon lesquelles les nouveaux comptes API reçoivent des crédits gratuits sont rapportées de manière incohérente et ne sont pas confirmées sur la page de tarification officielle. Quiconque cite un montant spécifique de crédits pour nouveau compte répète quelque chose que DeepSeek n'a pas publié.
L'absence de programme de démarrage est le fait le plus utile. Un prix bas par jeton n'est pas la même chose qu'une subvention, et un fondateur qui optimise uniquement sur le prix catalogue laisse le chiffre le plus important sur la table :
| Voie | Ce que c'est réellement |
|---|---|
| Application de chat DeepSeek | Gratuit, pas d'accès API |
| API DeepSeek | Payant dès le premier jeton, pas de niveau gratuit indiqué |
| Crédits de démarrage DeepSeek | N'existe pas |
| Autres grands fournisseurs de modèles | Nombreux programmes de crédits de démarrage dédiés |
DeepSeek est le moyen le moins cher de payer. Ce n'est pas une façon de ne pas payer. Ce sont des stratégies différentes et les équipes les plus performantes appliquent les deux : DeepSeek pour le travail de codage en cache à haut volume, crédits accordés pour les modèles de pointe en plus. AI Perks suit quels fournisseurs financent actuellement cette seconde partie.
Les hôtes tiers constituent une solution de contournement partielle. Baseten liste l'entrée DeepSeek V4.1 Flash à 0,30 $ par million et offre un crédit d'essai permanent de 30 $ par nouvel espace de travail (confiance : moyenne, à vérifier avant de budgétiser). OpenRouter, Together et Fireworks hébergent également des modèles DeepSeek. Leurs prix évoluent suffisamment souvent pour que le conseil honnête soit de les vérifier vous-même le jour même plutôt que de faire confiance à un chiffre dans un article de blog, y compris celui-ci.
Comment réduire une facture de codage DeepSeek
Étape 1 : Couvrir le niveau de pointe avec des crédits. Vérifiez quels fournisseurs financent actuellement ce niveau sur getaiperks.com, afin que DeepSeek ne prenne en charge que le travail de volume.
Étape 2 : Vérifiez dans quel fuseau horaire vos agents s'exécutent réellement. Si vos tâches CI, vos refactorisations nocturnes ou vos travaux d'évaluation par lots s'exécutent entre 01h00 et 04h00 ou 06h00 et 10h00 UTC, les déplacer de quelques heures divise cette ligne budgétaire par deux sans modification du code.
Étape 3 : Rendre le préfixe en cache stable. Tout ce qui réorganise votre invite système, injecte une horodatage ou mélange le contexte des fichiers transforme un jeton à 0,022 $ en un jeton à 0,66 $.
Étape 4 : Répartir les modèles par tâche. V4-Pro pour le raisonnement et les boucles d'agents, Flash pour la classification, le linting et les appels fréquents et peu coûteux autour d'eux.
Étape 5 : Auditez vos chaînes de modèles dès maintenant. Les noms d'endpoints Flash retirés sont une panne planifiée qui attend celui qui déploiera ensuite.

Questions fréquemment posées
Combien coûte DeepSeek pour le codage ?
DeepSeek-V4-Pro-0813 coûte 0,66 $ par million de jetons d'entrée avec cache miss en heures creuses et 1,98 $ par million de jetons de sortie en heures creuses. Les heures de pointe coûtent exactement le double. L'entrée mise en cache coûte 0,022 $ par million en heures creuses. Les factures de codage réelles se situent entre ces extrêmes en fonction du taux de cache hit et de l'heure.
Quelles sont les heures de pointe et les heures creuses de DeepSeek ?
Les heures de pointe sont de 01h00 à 04h00 et de 06h00 à 10h00 UTC en semaine. Tout le reste, y compris les week-ends, est en heures creuses à moitié prix. Dérivé de ces créneaux, cela laisse environ 80 % de la semaine en heures creuses, et une journée de travail américaine standard se situe entièrement en dehors des deux fenêtres de pointe.
DeepSeek offre-t-il des crédits API gratuits ?
L'application de chat de DeepSeek est gratuite, mais il n'y a pas de niveau gratuit d'API indiqué sur la page de tarification officielle. Les rapports de crédits gratuits pour les nouveaux comptes API sont incohérents et non confirmés. DeepSeek ne mène pas non plus de programme de crédits de démarrage, contrairement à la plupart des grands fournisseurs suivis sur AI Perks.
Pourquoi mon appel API DeepSeek a-t-il cessé de fonctionner ?
DeepSeek-V4.1-Flash a retiré les noms de modèles deepseek-v4-flash et deepseek-v4-flash-vision-exp. Tout code, tutoriel ou configuration utilisant encore ces chaînes échouera à l'exécution. Le renommage n'a pas été annoncé publiquement, de sorte que les anciens exemples et les configurations copiées les utilisent toujours. Recherchez ces deux chaînes dans votre dépôt et mettez-les à jour avec l'identifiant Flash actuel.
DeepSeek est-il moins cher que Claude ou GPT pour le codage ?
Au prix catalogue, considérablement, surtout avec un taux de cache hit élevé en heures creuses. Sur le coût total, la comparaison change une fois que les crédits de démarrage sont impliqués, car DeepSeek n'en accorde aucun et de nombreux concurrents le font. Vérifiez ce que les alternatives financeront avant de supposer sur AI Perks.
Dois-je utiliser DeepSeek via OpenRouter ou Baseten à la place ?
Les hôtes tiers ajoutent de la flexibilité de routage, des solutions de secours et parfois des crédits d'essai, mais ils tarifient indépendamment du calendrier des heures de pointe et creuses de DeepSeek. Baseten propose un crédit d'essai permanent de 30 $ par nouvel espace de travail. Vérifiez tout chiffre par jeton hébergé le jour même, car ces prix changent fréquemment.
Abonnez-vous sur getaiperks.com →
DeepSeek est le moyen le moins cher de payer. Les crédits sont le moyen de ne pas payer.