DeepSeek n'a pas un prix par jeton
DeepSeek-V4-Pro a quatre prix d'entrée, pas un : 0,022 $, 0,044 $, 0,66 $ et 1,32 $ par million de jetons. Le prix que vous payez dépend de l'heure de la journée et si l'invite a atteint le cache. C'est un écart de 60x sur le même modèle, la même invite et le même jour.
Chaque tableau "DeepSeek vs ChatGPT" qui affiche un seul chiffre par modèle compare un chiffre qui n'existe pas. DeepSeek est le seul grand fournisseur de modèles qui facture par heure de la journée. Les heures de pointe sont de 01h00 à 04h00 et de 06h00 à 10h00 UTC, du lundi au vendredi, et tout ce qui se situe en dehors de ces fenêtres, y compris les week-ends, est facturé exactement à moitié prix.
Voici les prix catalogue publiés par million de jetons, les deux moitiés incluses.
| Modèle | Entrée en cache | Entrée fraîche | Sortie |
|---|---|---|---|
| DeepSeek-V4-Pro, hors pointe | 0,022 $ | 0,66 $ | 1,98 $ |
| DeepSeek-V4-Pro, pointe | 0,044 $ | 1,32 $ | 3,96 $ |
| DeepSeek-Flash, hors pointe | 0,003 $ | 0,15 $ | non publié |
| DeepSeek-Flash, pointe | 0,006 $ | 0,30 $ | non publié |
La dernière colonne n'est pas une omission de notre part. DeepSeek publie les taux d'entrée en cache et hors cache pour la gamme V4.1 Flash, mais aucun taux de sortie, donc tout guide citant un chiffre de sortie Flash cite quelque chose que DeepSeek n'a pas déclaré. Nous ne le répéterons pas, et votre feuille de calcul budgétaire ne devrait pas non plus.
La même discipline s'applique dans l'autre sens. Nous ne republions pas les prix catalogue d'OpenAI que nous n'avons pas vérifiés sur la page de tarification d'OpenAI, car ces taux évoluent et un chiffre obsolète dans un tableau comparatif est pire que pas de chiffre du tout. Lisez cet article pour comprendre la structure de la facture de DeepSeek, puis calculez le prix de ChatGPT à partir de la source. AI Perks suit la troisième variable, les crédits, que le prix catalogue n'inclut pas.

Qui paie réellement le tarif de pointe de DeepSeek
La tarification de pointe couvre sept heures par jour de semaine, soit 35 heures sur les 168 heures de la semaine, donc environ 79 % de tout le temps facturé est à moitié prix (dérivé). Le hors pointe n'est pas une fenêtre de réduction. C'est le taux normal pour la majeure partie de la planète.
Converties en UTC+8, les fenêtres de pointe s'étendent de 09h00 à 12h00 et de 14h00 à 18h00, avec un intervalle pendant l'heure du déjeuner. C'est la forme d'une journée de travail sur le marché d'origine de DeepSeek. DeepSeek n'a pas précisé la raison, alors considérez cette coïncidence comme une observation plutôt qu'un fait, mais elle prédit exactement qui paie plus.
| Emplacement de l'équipe | Journée de travail en UTC | Heures de pointe |
|---|---|---|
| San Francisco (UTC-7) | 16h00 à 00h00 | 0 sur 8 |
| New York (UTC-4) | 13h00 à 21h00 | 0 sur 8 |
| Londres (UTC+1) | 08h00 à 16h00 | 2 sur 8 |
| Berlin (UTC+2) | 07h00 à 15h00 | 3 sur 8 |
| Bengaluru (UTC+5:30) | 03h30 à 11h30 | 4,5 sur 8 |
| Shenzhen (UTC+8) | 01h00 à 09h00 | 6 sur 8 |
Une équipe américaine effectuant du trafic interactif pendant les heures ouvrables n'atteint jamais le taux de pointe. Une équipe européenne le paie pendant les deux ou trois premières heures de chaque matin, ce qui constitue un argument concret pour programmer les tâches de traitement par lots et d'évaluation après le déjeuner plutôt qu'avant le stand-up.
Le cache atteint plus que l'horloge
Déplacer une charge de travail hors pointe réduit la facture de moitié. La placer dans le cache la divise par 30. Sur DeepSeek-V4-Pro, un jeton d'entrée mis en cache coûte 0,022 $ par million hors pointe, tandis qu'un jeton frais coûte 0,66 $, soit exactement 30 fois plus (dérivé). Le levier hors pointe vaut 2x. La plupart des équipes règlent le levier 2x et ignorent le levier 30x.
Deux comparaisons dérivées rendent l'ordre évident :
- Un jeton mis en cache sur le V4-Pro phare hors pointe (0,022 $) est 6,8 fois moins cher qu'un jeton frais sur le modèle Flash économique hors pointe (0,15 $). La mise en cache bat la réduction de gamme.
- Même un jeton V4-Pro mis en cache au taux de pointe (0,044 $) est 3,4 fois moins cher qu'un jeton Flash frais hors pointe. La mise en cache bat la réduction de gamme et bat le fait d'attendre les heures creuses combinées.
Augmenter le taux de réussite du cache de 50 % à 90 % sur V4-Pro réduit le coût d'entrée combiné de 0,341 $ à 0,0858 $ par million de jetons, une réduction de 4,0x (dérivé) qu'aucun calendrier ne peut égaler.
Trois conséquences pratiques :
La stabilité du préfixe l'emporte sur la brièveté de l'invite. Une longue invite système qui ne change jamais est moins chère qu'une invite courte que vous réécrivez à chaque demande, car seul le préfixe stable est mis en cache.
Mettez la partie variable en dernier. Tout ce qui est inséré avant le contexte récupéré invalide le cache pour tout ce qui suit.
La profondeur du cache est une décision de tarification, pas technique. DeepSeek tarifie un cache V4-Pro réussi à 3,3 % d'un jeton frais et un cache Flash à 2,0 % (tous deux dérivés). Les fournisseurs qui tarifient les succès du cache à une fraction moins profonde de l'entrée fraîche vous donnent beaucoup moins à optimiser. Ce ratio, pas le taux principal, est ce qu'il faut comparer entre les fournisseurs.

Ce que coûte réellement une tâche
Prenons un appel d'agent réaliste augmenté par la récupération : 40 000 jetons d'entrée avec un taux de réussite du cache de 80 %, plus 2 000 jetons de sortie. Tous les chiffres ci-dessous sont dérivés des taux publiés ci-dessus.
| Scénario | Coût d'entrée | Coût de sortie | Total |
|---|---|---|---|
| V4-Pro, hors pointe | 0,00598 $ | 0,00396 $ | 0,00994 $ |
| V4-Pro, pointe | 0,01197 $ | 0,00792 $ | 0,01989 $ |
| Flash, hors pointe | 0,00130 $ | non publié | non calculable |
| Flash, pointe | 0,00259 $ | non publié | non calculable |
Deux choses en ressortent. Premièrement, l'entrée V4-Pro sur cette tâche coûte 4,6 fois plus cher que l'entrée Flash (dérivé), ce qui est un écart beaucoup plus faible que ce que suggèrent les niveaux de modèles, car le taux de réussite du cache de 80 % fait la majeure partie du travail sur les deux. Deuxièmement, un coût de tâche complet pour Flash n'est pas calculable à partir des données publiées. Si un article comparatif vous en donne un, demandez d'où provient le taux de sortie.
Où la réputation de bon marché s'effondre
Faire passer DeepSeek par un hôte tiers aplatit la division pointe/hors pointe en un seul taux fixe, de sorte que vous payez quelque chose proche du prix de pointe 100 % du temps. Baseten, par exemple, liste DeepSeek V4.1 Flash input à 0,30 $ par million, ce qui est identique au taux de pointe hors cache de DeepSeek et le double du taux hors pointe de 0,15 $ (chiffre publié par Baseten, à confirmer avant de baser votre budget dessus ; son taux de sortie n'a pas été confirmé de manière fiable). Baseten offre un crédit d'essai de nouvel espace de travail de 30 $.
OpenRouter, Together et Fireworks hébergent également des modèles DeepSeek. Leurs taux leur appartiennent et ils évoluent, alors vérifiez chacun d'eux vous-même plutôt que de faire confiance à un chiffre dans un article de blog, y compris celui-ci. Le compromis qualitatif est stable : vous gagnez en commodité de routage, en résilience aux pannes et une facture unique, et vous renoncez définitivement à la réduction de 50 % hors pointe. Pour le trafic qui s'exécute principalement en dehors des heures de pointe, ce compromis est négatif.

Ce qui a changé depuis les anciens guides de tarification DeepSeek
Chaque guide DeepSeek écrit avant le 16 août 2026 cite un prix fixe unique. Ce prix n'existe plus. Si un article donne un chiffre par modèle sans mention des heures de pointe, il est antérieur à la structure actuelle.
- 24 avril 2026 : DeepSeek V4-Pro et V4-Flash sont livrés en avant-première avec une fenêtre contextuelle de 1 million de jetons, jusqu'à 384 000 jetons de sortie, et des modes de pensée et de non-pensée commutables.
- 31 juillet 2026 : DeepSeek-V4-Flash-0731 devient la version stable de Flash. La tarification à l'époque était un prix fixe de 0,14 $ par million d'entrées hors cache et 0,28 $ par million de sorties, sans composante horaire. C'est du passé, pas un taux que vous pouvez acheter aujourd'hui.
- 13 août 2026 : DeepSeek-V4-Pro-0813 atteint la disponibilité générale en tant que modèle phare de raisonnement et d'agent.
- 16 août 2026 : la tarification de pointe et hors pointe arrive.
- Vers le 10 septembre 2026 : DeepSeek-V4.1-Flash est lancé, répertorié dans la documentation simplement sous le nom de DeepSeek-Flash.
Un changement radical mérite sa propre note, car il fait tomber silencieusement le code fonctionnel. DeepSeek-V4.1-Flash a retiré les noms de points d'accès deepseek-v4-flash et deepseek-v4-flash-vision-exp. Les tutoriels, les réponses sur les forums et les exemples de code copiés font toujours référence à ces chaînes et échoueront sur l'API en direct. Vérifiez l'identifiant actuel du modèle dans la documentation de DeepSeek plutôt qu'un exemple de code, car la dénomination a maintenant changé deux fois en cinq mois.
DeepSeek n'a pas de programme de crédits de démarrage
L'application de chat DeepSeek est gratuite. L'API ne l'est pas, et DeepSeek ne mentionne pas de niveau gratuit sur sa page de tarification officielle. Les affirmations de crédits API gratuits pour les nouveaux comptes DeepSeek circulent largement, sont rapportées de manière incohérente et ne sont pas confirmées sur la page officielle. Traitez-les comme non vérifiées.
Plus important encore pour les fondateurs : DeepSeek n'a aucun programme de crédits de démarrage dédié. Pas de subvention, pas d'allocation basée sur les étapes, pas de niveau subventionné. Vous rechargez un solde et vous le dépensez. Moins cher par jeton, zéro subvention.
C'est le seul endroit où l'avantage de coût s'inverse. Un fournisseur qui facture plusieurs fois plus cher par jeton tout en accordant à une jeune entreprise cinq chiffres en crédits est moins cher la première année qu'un fournisseur bon marché sans aucune subvention. Le coût par jeton n'est la bonne métrique qu'une fois que quelqu'un paie réellement en espèces.
La plupart des fournisseurs avec lesquels DeepSeek est en concurrence ont des programmes de crédit. AI Perks suit 7,7 millions de dollars de crédits dans 194 entreprises, ce qui représente toute la couche qu'une comparaison de prix catalogue néglige.
La pile pratique : capacité créditée des fournisseurs qui l'accordent, DeepSeek-Flash hors pointe comme défaut payant, mise en cache agressive du préfixe sur tout ce qui s'exécute en pointe, et une solution de secours vérifiée pour les heures que vous ne pouvez pas décaler. Commencez par les crédits, car ils sont la seule partie de la facture qui peut aller à zéro. Voir ce qui est actuellement disponible.

Questions fréquemment posées
DeepSeek est-il moins cher que ChatGPT ?
Cette question a quatre réponses du côté de DeepSeek seul. L'entrée fraîche de DeepSeek-V4-Pro coûte 0,66 $ par million hors pointe et 1,32 $ en pointe, et un jeton mis en cache coûte 0,022 $ hors pointe. Tarifez votre propre trafic par rapport aux tarifs publiés actuels d'OpenAI, en pondérant chaque taux DeepSeek par la part d'appels qui l'atteint réellement. La réponse dépend de votre horloge et de votre taux de réussite du cache, pas du fournisseur.
Quelles sont les heures de pointe de DeepSeek ?
Les heures de pointe sont de 01h00 à 04h00 et de 06h00 à 10h00 UTC, du lundi au vendredi. Tout le reste, y compris les week-ends, est facturé à moitié prix par rapport au taux de pointe. Cela fait environ 79 % de la semaine hors pointe. Les équipes dans les fuseaux horaires américains n'atteignent presque jamais les prix de pointe pendant les heures de travail normales.
DeepSeek offre-t-il des crédits API gratuits ou un programme de démarrage ?
Non. L'application de chat DeepSeek est gratuite, mais aucun niveau API gratuit n'est indiqué sur sa page de tarification officielle, et les rapports de crédits d'inscription sont incohérents et non confirmés. DeepSeek n'a pas non plus de programme de crédits de démarrage, contrairement à de nombreux fournisseurs suivis sur AI Perks.
Pourquoi mon appel API DeepSeek a-t-il cessé de fonctionner ?
DeepSeek-V4.1-Flash a retiré les identifiants de modèle deepseek-v4-flash et deepseek-v4-flash-vision-exp, silencieusement et sans fenêtre de préavis. Les anciens tutoriels et exemples copiés y font toujours référence et échoueront. Récupérez l'identifiant actuel de la documentation en direct de DeepSeek avant de déboguer quoi que ce soit d'autre.
Combien coûtent les jetons de sortie pour DeepSeek-Flash ?
DeepSeek n'a pas publié cela. La gamme V4.1 Flash n'indique que les taux d'entrée avec succès et sans succès du cache. Tout chiffre de coût total par tâche que vous voyez pour Flash est construit sur un taux de sortie supposé, alors considérez-le comme une estimation plutôt qu'un prix.
Est-il moins cher d'exécuter DeepSeek via un hôte tiers ?
Généralement pas, si votre trafic s'exécute hors pointe. Les hôtes facturent un taux fixe sans division pointe/hors pointe, vous renoncez donc à la réduction de 50 % hors pointe de manière permanente en échange de la commodité de routage et de la résilience aux pannes. Vérifiez vous-même le taux actuel de chaque hôte avant de changer, car les marges varient et changent souvent.
Combien les crédits IA gratuits font-ils économiser à une startup ?
Suffisamment pour inverser la comparaison. Un fournisseur facturant plusieurs fois plus cher par jeton mais accordant cinq chiffres en crédits est moins cher la première année qu'un fournisseur bon marché sans subvention. AI Perks suit 7,7 millions de dollars de crédits dans 194 entreprises, ce qui représente la couche que les comparaisons de prix catalogue ignorent entièrement.
Abonnez-vous pour des largages de crédits hebdomadaires
Le prix par jeton est le chiffre facile. Le prix par tâche, après crédits, est celui qui apparaît sur la carte.