DeepSeek V4-Pro : Coût par rapport à V4.1-Flash

Prix de DeepSeek-V4-Pro-0813 par million de tokens, la répartition pic/hors-pic, la remise sur cache-hit, et pourquoi le choix du modèle surpasse la planification.

DeepSeekDeepSeek V4-ProLLM API PricingOff-Peak PricingAI Perks
Author Avatar
Andrew
AI Perks Team
12,508

Quick Answer

DeepSeek-V4-Pro-0813 coûte 0,66 $ par million de tokens d'entrée avec cache miss en dehors des heures de pointe et 1,32 $ en heures de pointe, avec une sortie à 1,98 $ en dehors des heures de pointe et 3,96 $ en heures de pointe. Un cache hit réduit l'entrée à 0,022 $ en dehors des heures de pointe. DeepSeek ne publie pas de niveau gratuit d'API et n'offre pas de programme de crédits de démarrage, contrairement aux 194 entreprises suivies sur getaiperks.com.

Quel est le coût de DeepSeek-V4-Pro par million de tokens ?

DeepSeek-V4-Pro-0813 coûte 0,66 $ par million de tokens d'entrée en cache-miss en dehors des heures de pointe et 1,32 $ aux heures de pointe. Les sorties coûtent 1,98 $ en dehors des heures de pointe et 3,96 $ aux heures de pointe. Un cache hit réduit le coût d'entrée à 0,022 $ en dehors des heures de pointe.

DeepSeek-V4-Pro-0813 a atteint la disponibilité générale le 13 août 2026 en tant que fleuron de la ligne V4, conçu pour l'utilisation d'outils, l'exécution de code et les flux de travail autonomes en plusieurs étapes. Il est tarifé à l'heure : les heures de pointe sont de 01h00 à 04h00 et de 06h00 à 10h00 UTC en semaine, et chaque autre heure coûte la moitié.

Tarifs publiés dans la documentation API de DeepSeek, en USD par million de tokens :

ModèleType de tokenHeures creusesHeures de pointe
DeepSeek-V4-Pro-0813Entrée, cache hit0,022 $0,044 $
DeepSeek-V4-Pro-0813Entrée, cache miss0,66 $1,32 $
DeepSeek-V4-Pro-0813Sortie1,98 $3,96 $
DeepSeek-V4.1-FlashEntrée, cache hit0,003 $0,006 $
DeepSeek-V4.1-FlashEntrée, cache miss0,15 $0,30 $
DeepSeek-V4.1-FlashSortie0,60 $1,20 $

Lors de la prévisualisation d'avril 2026, la paire V4 aurait eu une fenêtre contextuelle de 1 million de tokens avec jusqu'à 384 000 tokens de sortie, un mode de réflexion commutable, et des poids ouverts sous licence MIT. Ceci est tiré de la couverture de lancement, pas de la page de tarification actuelle de DeepSeek, donc vérifiez-le par rapport à la chaîne de modèle exacte que vous appelez. AI Perks suit les programmes de tarification et de crédits dans 194 entreprises, et DeepSeek se démarque sur le second point : il ne publie aucun programme de crédit de démarrage.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Les heures de pointe ne représentent que 21 % de la semaine

La plupart des couvertures présentent les heures creuses comme une remise que vous débloquez. L'arithmétique dit le contraire : les heures de pointe couvrent 7 heures par semaine, 35 sur 168, donc 79 % de la semaine est déjà facturée au taux le plus bas.

Les heures creuses sont la norme. Les heures de pointe sont un supplément que vous payez par accident, dans une fenêtre tombant sur le matin européen. Vous ne chassez pas une remise, vous évitez une boîte de pénalité de 35 heures, et la solution est de vérifier qu'aucun cron job n'y a atterri. Le trafic interactif est l'exception, car cette horloge est réglée par vos utilisateurs.


Pourquoi V4.1-Flash bat V4-Pro en termes de prix

Déplacer un travail en dehors des heures de pointe réduit la facture de moitié, exactement 2x. Le déplacer de V4-Pro à V4.1-Flash réduit les entrées en cache-miss de 4,4x et les sorties de 3,3x. Le choix du modèle est le levier le plus important, et les deux se cumulent.

Un million de tokens d'entrée en cache-miss plus un million de tokens de sortie, aux deux extrémités de l'horloge :

Modèle et calendrierEntréeSortieTotal
V4-Pro aux heures de pointe1,32 $3,96 $5,28 $
V4-Pro en dehors des heures de pointe0,66 $1,98 $2,64 $
V4.1-Flash aux heures de pointe0,30 $1,20 $1,50 $
V4.1-Flash en dehors des heures de pointe0,15 $0,60 $0,75 $

V4-Pro, même pendant son heure la moins chère, coûte toujours 1,76 fois ce que coûte V4.1-Flash pendant son heure la plus chère. Aucune astuce de planification ne comble cet écart.

En combinant les deux leviers, l'écart se creuse encore : V4-Pro aux heures de pointe par rapport à V4.1-Flash en dehors des heures de pointe, c'est 7x pour des nombres de tokens identiques, et une seule de ces deux décisions est fixée par l'horloge. Le conseil habituel de pousser le travail par lots dans les heures creuses suppose que le modèle est fixe. Il ne l'est presque jamais, et le rétrograder est rentable même lorsque le trafic ne peut pas être reprogrammé.

Flash gagne en prix à chaque heure de la journée, y compris aux heures de pointe. L'avantage de V4-Pro est sa capacité seule, il doit donc justifier sa place par la difficulté de la tâche.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Pourquoi une exécution d'agent V4-Pro coûte plus cher que ce que le tableau suggère

Les sorties coûtent 3 fois plus cher que les entrées en cache-miss sur V4-Pro, et les charges de travail pour lesquelles DeepSeek a construit V4-Pro – boucles d'agents, appels d'outils, exécution en plusieurs étapes – génèrent le plus de sorties par unité de travail.

Un mois d'utilisation réelle : 100 millions de tokens d'entrée avec un taux de cache hit de 70 % plus 20 millions de tokens de sortie, aux tarifs ci-dessus :

ConfigurationEntréeSortieTotal mensuel
V4-Pro, heures de pointe42,68 $79,20 $121,88 $
V4-Pro, heures creuses21,34 $39,60 $60,94 $
V4.1-Flash, heures de pointe9,42 $24,00 $33,42 $
V4.1-Flash, heures creuses4,71 $12,00 $16,71 $

Trois conclusions en découlent.

Les sorties représentent 65 % de la facture V4-Pro en dehors des heures de pointe. Une fois que le cache fonctionne et que les tâches évitent les heures de pointe, DeepSeek n'est plus un problème d'entrée mais un problème de longueur de réponse.

L'écart total est de 7,3x. Mêmes tokens, même fournisseur, même mois. La première ligne par rapport à la dernière ligne représente deux décisions.

La remise de cache est plus importante sur Flash. Un cache hit V4-Pro coûte 30 fois moins cher qu'un cache miss ; sur V4.1-Flash, il coûte 50 fois moins cher. La discipline de préfixe de prompt est plus rentable sur le modèle bon marché, le contraire de ce que supposent les équipes.


Ce que DeepSeek a publié et n'a pas publié

DeepSeek publie des prix par token et peu d'autres choses qu'un acheteur souhaite. Il n'y a pas de niveau gratuit API déclaré sur la page de tarification officielle, pas de programme de crédit de démarrage, et pas de prix publié séparément pour les modèles de prévisualisation d'avril.

Tout guide écrit avant mi-août décrit un modèle de tarification qui n'existe plus :

DateCe qui a été expédiéStatut de la tarification
24 avril 2026Prévisualisation V4-Pro et V4-FlashPas publié séparément à la prévisualisation
31 juillet 2026DeepSeek-V4-Flash-0731, stableRapporté à 0,14 $ entrée / 0,28 $ sortie, forfaitaire
13 août 2026DeepSeek-V4-Pro-0813, disponibilité généraleRemplacé par la division ci-dessous
Mi-août 2026Tarification heures creuses et de pointe introduiteStructure actuelle
Vers le 10 septembre 2026DeepSeek-V4.1-FlashTarifs Flash actuels

Les détails de la prévisualisation d'avril, les chiffres de juillet pour Flash et la date exacte du changement sont rapportés, non confirmés sur la page de tarification actuelle de DeepSeek : considérez-les comme de l'histoire, pas comme des intrants budgétaires. Les tarifs V4-Pro et V4.1-Flash ci-dessus proviennent directement de DeepSeek.

Le changement d'août, tel que rapporté, a fait passer Flash d'un prix forfaitaire de 0,14 $ en entrée cache-miss au prix actuel de 0,15 $ en dehors des heures de pointe et 0,30 $ aux heures de pointe. Ce n'est pas une réduction de prix avec un astérisque, mais une division des prix : si vous exécutez en dehors des heures de pointe, vous payez environ l'ancien tarif, si vous exécutez aux heures de pointe, vous payez environ le double.

Concernant l'accès gratuit : l'application de chat DeepSeek est gratuite. Les affirmations selon lesquelles les nouveaux comptes API reçoivent des crédits gratuits sont rapportées de manière incohérente et non confirmées sur la page de tarification officielle, alors traitez tout chiffre que vous voyez ailleurs comme non vérifié. DeepSeek ne propose pas non plus de programme de crédit de démarrage, ne laissant aucune piste gratuite du tout. AI Perks suit 7,7 millions de dollars de crédits dans 194 entreprises qui en proposent un.

Trouvez les fournisseurs qui offrent réellement des crédits sur getaiperks.com →


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Où la remise hors heures de pointe ne s'applique pas

La tarification horaire est une mécanique de premier niveau de DeepSeek. Les hôtes et routeurs tiers fixent leurs propres tarifs, et un tarif forfaitaire qui semble bon marché sur le papier peut se situer au prix de pointe de DeepSeek, 24h/24 et 7j/7.

Baseten aurait ajouté DeepSeek V4.1 Flash à ses API de modèles le 10 septembre 2026, avec une entrée indiquée à 0,30 $ par million de tokens. Ni ce chiffre ni le chiffre correspondant pour la sortie ne sont confirmés ici (le nombre de sorties n'était pas lisible de manière fiable lors de la vérification), alors vérifiez les deux auprès du fournisseur avant de budgétiser. Pris au pied de la lettre, 0,30 $ est exactement le taux d'entrée aux heures de pointe de DeepSeek et le double de son taux hors heures de pointe, facturé chaque heure de la journée. Le crédit d'essai standard de Baseten pour les nouveaux espaces de travail est rapporté à 30 $, ce qui n'est ni spécifique à DeepSeek ni nouveau.

L'échange peut toujours être correct : vous achetez la latence, la région et la simplicité, et un tarif forfaitaire est plus facile à prévoir qu'un calendrier. Tarifez-le honnêtement cependant, car un tarif fixé au chiffre de pointe ne bénéficie jamais des 79 % de la semaine qui seraient autrement facturés à moitié prix. La piste gratuite provient des fournisseurs qui la financent, et cette liste se trouve sur getaiperks.com.


Comment réduire une facture DeepSeek-V4-Pro, par ordre d'impact

Levier 1 : Financer les niveaux coûteux ailleurs. DeepSeek ne fournit aucun crédit, utilisez donc getaiperks.com pour couvrir les fournisseurs premium vers lesquels vous redirigez les tâches difficiles, et laissez DeepSeek gérer le volume.

Levier 2 : Rétrograder chaque tâche qui n'a pas besoin du fleuron. Sur la charge de travail ci-dessus, passer de V4-Pro à V4.1-Flash est 3,6 fois moins cher avec des paramètres identiques. Rien d'autre ici ne s'en approche.

Levier 3 : Auditer votre calendrier pour une utilisation accidentelle aux heures de pointe. Les heures de pointe représentent 35 heures par semaine, alors vérifiez qu'aucun cron job n'est tombé entre 01h00 et 04h00 ou entre 06h00 et 10h00 UTC un jour de semaine.

Levier 4 : Stabiliser votre préfixe de prompt. Les cache hits nécessitent un préfixe identique, donc placez le contenu volatile en dernier. C'est là que se trouvent les 30x sur V4-Pro et les 50x sur Flash.

Levier 5 : Attaquer la longueur de la réponse. Après les quatre précédents, les sorties représentent environ les deux tiers de la facture et sont la plus grande partie restante.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Foire aux questions

Quel est le coût de DeepSeek-V4-Pro par million de tokens ?

Les entrées en cache-miss coûtent 0,66 $ en dehors des heures de pointe et 1,32 $ aux heures de pointe. Les sorties coûtent 1,98 $ en dehors des heures de pointe et 3,96 $ aux heures de pointe. Un cache hit coûte 0,022 $ en dehors des heures de pointe et 0,044 $ aux heures de pointe. Les heures de pointe sont de 01h00 à 04h00 et de 06h00 à 10h00 UTC en semaine.

Quelles sont les heures de pointe de DeepSeek et quelle proportion de la semaine représentent-elles ?

Les heures de pointe sont de 01h00 à 04h00 et de 06h00 à 10h00 UTC, du lundi au vendredi. Cela représente 7 heures par semaine, 35 sur 168 dans une semaine, soit environ 21 %. Les 79 % restants, y compris tout le week-end, sont facturés à la moitié du tarif de pointe.

DeepSeek-V4-Pro vaut-il la peine par rapport à V4.1-Flash ?

Seulement pour le travail qui nécessite réellement le fleuron. V4-Pro coûte 4,4 fois plus cher en entrées cache-miss, 3,3 fois plus cher en sorties, et environ 3,6 fois plus cher sur une charge de travail mensuelle mixte. Orientez d'abord par difficulté de tâche, puis optimisez le calendrier.

DeepSeek offre-t-il des crédits gratuits pour V4-Pro ?

Non. L'application de chat DeepSeek est gratuite, mais la page de tarification officielle n'indique aucun niveau gratuit pour l'API et il n'y a pas de programme de crédit de démarrage. Les rapports de crédits gratuits pour les nouveaux comptes API ne sont pas confirmés. Pour une véritable piste gratuite, AI Perks suit 7,7 millions de dollars dans 194 entreprises.

Les hôtes tiers répercutent-ils la tarification hors heures de pointe de DeepSeek ?

Généralement non. La tarification horaire est une mécanique de premier niveau, et les hôtes fixent leurs propres tarifs. Baseten aurait indiqué l'entrée DeepSeek V4.1 Flash à 0,30 $ par million, ce qui équivaudrait au taux de pointe de DeepSeek facturé toute la journée, bien que cela ne soit pas confirmé ici. Vérifiez le tarif actuel auprès de l'hôte avant de vous engager.

Qu'est-il advenu du nom du point de terminaison deepseek-v4-flash ?

DeepSeek-V4.1-Flash a retiré les noms de modèles deepseek-v4-flash et deepseek-v4-flash-vision-exp, et les requêtes sont désormais routées vers le modèle Flash actuel aux tarifs Flash. Le code écrit contre les anciens identifiants doit être mis à jour, alors épinglez la chaîne de modèle actuelle plutôt que de vous fier aux alias.


Abonnez-vous sur getaiperks.com →

DeepSeek fixe des prix bas et ne finance rien. Les fournisseurs qui vous financent se trouvent sur getaiperks.com.

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.