DeepSeek est-il moins cher en direct ou par l'intermédiaire d'un hébergeur ?
En direct, dans presque tous les cas, et la raison est structurelle plutôt qu'une question de marge. Le bas prix de DeepSeek provient de deux multiplicateurs qui n'existent que sur l'API du premier parti : une réduction de moitié pendant les heures creuses et une réponse de cache qui coûte environ 30 fois moins cher qu'une absence de réponse de cache sur V4-Pro. Les revendeurs facturent un tarif forfaitaire par jeton, donc les deux multiplicateurs disparaissent à la porte.
C'est toute la décision de routage en une seule ligne. Un hébergeur ne vous facture pas une modeste prime sur le même prix, il vous facture un prix forfaitaire par rapport à une facture qui aurait pu être une fraction de ce prix.
L'écart est plus important que ce que quiconque qui route sur un classement ne pourrait deviner. Les équipes qui recherchent ce type d'économie unitaire recherchent généralement aussi des crédits gratuits, que AI Perks suit auprès de 194 entreprises et pour 7,7 millions de dollars de crédits.

Les quatre prix que DeepSeek facture pour le même jeton
DeepSeek-V4-Pro a quatre prix d'entrée différents en fonction de l'heure de la journée et du fait que votre préfixe de prompt ait été mis en cache ou non. Aucun autre fournisseur majeur ne fixe ses prix de cette manière.
Les heures de pointe sont de 01h00 à 04h00 et de 06h00 à 10h00 UTC en semaine. Tout ce qui se trouve en dehors de ces périodes, y compris tout le week-end, est considéré comme hors pointe et facturé à moitié prix.
| DeepSeek-V4-Pro-0813 | Hors pointe (par 1M) | Pointe (par 1M) |
|---|---|---|
| Entrée, réponse de cache | 0,022 $ | 0,044 $ |
| Entrée, absence de réponse de cache | 0,66 $ | 1,32 $ |
| Sortie | 1,98 $ | 3,96 $ |
| DeepSeek-V4.1-Flash | Hors pointe (par 1M) | Pointe (par 1M) |
|---|---|---|
| Entrée, réponse de cache | 0,003 $ | 0,006 $ |
| Entrée, absence de réponse de cache | 0,15 $ | 0,30 $ |
Les deux multiplicateurs s'additionnent. Un jeton d'entrée hors pointe mis en cache à 0,022 $ par rapport à une absence de réponse de cache en pointe à 1,32 $ représente un écart de 60x pour le même modèle (dérivé du tableau ci-dessus). Sur Flash, l'écart est encore plus grand : 0,003 $ contre 0,30 $, soit 100x, également dérivé.
Les heures de pointe totalisent 7 heures par jour sur 5 jours ouvrables, donc environ 79 % de la semaine est facturée au tarif hors pointe par défaut (dérivé). Vous n'avez rien de compliqué à faire pour y parvenir. Vous devez éviter de faire quelque chose d'insouciant.
Ce qui a changé dans la tarification de DeepSeek en août 2026
Le modèle de tarification lui-même a changé le 16 août 2026, lorsqu'un tarif forfaitaire par jeton a cédé la place à la répartition entre pointe et hors pointe. Toute comparaison de coûts rédigée avant cette date décrit une grille tarifaire qui n'existe plus.
Le calendrier qui importe :
- 24 avril 2026 : Aperçu V4-Pro et V4-Flash, avec un contexte de 1 million de jetons et des modes de réflexion commutables (confiance : moyenne).
- 31 juillet 2026 : DeepSeek-V4-Flash-0731 est lancé en tant que version stable de Flash. Le dernier prix forfaitaire connu était de 0,14 $ par 1 million d'entrées sans réponse de cache et 0,28 $ pour la sortie (confiance : moyenne, historique uniquement).
- 13 août 2026 : DeepSeek-V4-Pro-0813 est disponible en général.
- Vers le 10 septembre 2026 : DeepSeek-V4.1-Flash arrive, indiqué dans la documentation comme DeepSeek-Flash.
Comparez l'ancien tarif forfaitaire de 0,14 $ avec les prix actuels de Flash, et la conception du changement devient évidente. Une entrée hors pointe sans réponse de cache à 0,15 $ se situe presque exactement là où se trouvait l'ancien tarif forfaitaire, tandis que le prix de pointe est de 0,30 $, légèrement plus du double (dérivé). DeepSeek n'a pas augmenté ses prix autant qu'il a instauré une taxe de congestion.

Ce que coûtent les hébergeurs tiers et pourquoi ils ne peuvent pas rivaliser
Un hébergeur achète de la capacité et vend des jetons, il doit donc indiquer un seul chiffre qui couvre sa pire heure. Ce chiffre se situe au-dessus du taux hors pointe de DeepSeek et astronomiquement au-dessus de son taux hors pointe mis en cache.
Deux éléments se brisent dans la revente :
La tarification horaire ne survit pas. Un hébergeur desservant tous les fuseaux horaires ne peut pas répercuter une remise ancrée sur l'UTC sans arbitrage ou une page de tarification invendable.
L'état du cache est par locataire. La mise en cache de préfixes est rentable lorsque le même prompt système atteint le même backend à plusieurs reprises. Si vous routez ce prompt via un agrégateur qui équilibre la charge entre les fournisseurs, vous payez des prix d'absence de réponse de cache pour un prompt que vous avez envoyé mille fois.
Vérifiez vous-même tout prix d'hébergeur avant de vous engager, car les chiffres publiés évoluent et la plupart des articles comparatifs citent des tarifs qui ont expiré il y a des semaines. Un chiffre encadre l'écart clairement. Baseten indique l'entrée DeepSeek V4.1 Flash à 0,30 $ par 1 million (confiance : moyenne, à vérifier avant de citer), ainsi qu'un crédit d'essai de 30 $ pour un nouveau poste de travail. Le chiffre de sortie n'a pas été confirmé de manière fiable, il n'est donc pas cité ici.
| Route | Tarification horaire | Remise sur le cache de préfixe | Signal de prix vérifié |
|---|---|---|---|
| DeepSeek premier parti, V4-Pro | Oui, swing 2x | Oui, 30x | 0,66 $ en / 1,98 $ en sortie, hors pointe |
| DeepSeek premier parti, V4.1-Flash | Oui, swing 2x | Oui, 50x (dérivé) | 0,15 $ en, hors pointe |
| Baseten | Non publié | Non publié | 0,30 $ en, V4.1 Flash |
| OpenRouter, Together AI, Fireworks | Non publié | Varie selon le fournisseur | À vérifier à la source |
Par rapport aux 0,30 $ indiqués par Baseten, l'entrée hors pointe sans réponse de cache de DeepSeek à 0,15 $ coûte la moitié du prix, et son entrée hors pointe mise en cache à 0,003 $ est 100 fois moins chère (dérivé). Ce n'est pas un revendeur qui est avide. C'est un tarif forfaitaire qui rencontre un tarif à quatre niveaux.
OpenRouter, Together AI et Fireworks hébergent tous des modèles DeepSeek. Leurs prix ne sont pas cités ici car ils n'ont pas été vérifiés, et un prix obsolète dans une comparaison de coûts est pire qu'aucun prix.
Quand payer la marge de l'hébergeur est la bonne décision
Routez via un hébergeur lorsque ce que vous achetez ne sont pas des jetons. Il y a quatre situations où la prime est rationnelle.
L'approvisionnement bloque le point de terminaison chinois. Si votre examen de sécurité n'approuve pas l'appel direct à DeepSeek, l'hébergeur n'est pas une majoration, c'est la seule façon d'expédier. C'est la raison la plus courante pour laquelle les équipes routent DeepSeek via un fournisseur américain.
Vous avez besoin d'une seule facture et d'une seule clé pour de nombreux modèles. Un agrégateur qui bascule de DeepSeek vers un point de terminaison Llama ou Qwen lorsqu'un élément est défaillant vend de la disponibilité, pas du prix.
Votre trafic est en heure de pointe et est déjà sans cache. Un produit interactif à faible volume desservant les matins européens se situe dans la fenêtre de pointe avec des prompts courts et uniques. Cette charge de travail abandonne les deux remises, ce qui réduit considérablement l'avantage du premier parti.
Vous êtes toujours en évaluation. Un crédit d'essai comme les 30 $ de Baseten ne coûte rien et répond à la question de la qualité avant que vous ne connectiez un deuxième fournisseur. Le crédit d'évaluation gratuit est la forme la plus économique de diligence, et AI Perks existe pour cataloguer où il est disponible.

Le renommage du point de terminaison qui casse les configurations de routage
DeepSeek-V4.1-Flash a discrètement retiré les noms de modèles deepseek-v4-flash et deepseek-v4-flash-vision-exp. Les exemples de code et les tutoriels rédigés avant septembre 2026 les référencent toujours, et ces appels échouent désormais.
Cela affecte le plus durement la configuration dont parle cet article. Une configuration de routeur contient les identificateurs de modèles pour plusieurs fournisseurs dans un seul fichier, la plupart étant stables depuis des années, de sorte qu'un nom discrètement retiré apparaît comme une défaillance intermittente sur une route plutôt qu'une panne évidente.
Deux conséquences pratiques :
- Recherchez dans votre base de code et vos modèles de prompt les anciens noms avant de déboguer quoi que ce soit d'autre.
- Les identificateurs de modèles côté hébergeur sont encapsulés dans un espace de noms différent de celui de DeepSeek, alors confirmez la chaîne exacte que votre fournisseur expose plutôt que de supposer que le nom du premier parti fonctionne.
DeepSeek n'a pas de programme de crédits de démarrage. D'autres en ont.
L'application de chat de DeepSeek est gratuite, il n'y a pas de niveau gratuit d'API indiqué sur la page de tarification officielle, et DeepSeek n'exécute aucun programme de crédits de démarrage dédié. Les affirmations de crédits d'API gratuits pour les nouveaux comptes circulent largement mais sont rapportées de manière inconsistante et non confirmées sur la page officielle. Traitez-les comme non vérifiées.
C'est une réelle lacune. Une API tarifée aussi bas est l'une des rares qui ne donnera pas à une startup un centime de piste, ce qui fait de DeepSeek un plancher de coûts plutôt qu'un jeu de crédits.
Les fournisseurs qui exécutent des programmes sont ceux auxquels il vaut la peine de postuler, et il y en a beaucoup plus que ce que la plupart des fondateurs ne le savent. AI Perks suit 7,7 millions de dollars de crédits dans 194 entreprises, ce qui est la ligne budgétaire que DeepSeek lui-même ne couvrira jamais.
Voir quels fournisseurs offrent des crédits sur getaiperks.com →

Questions fréquemment posées
DeepSeek est-il moins cher sur OpenRouter ou en direct ?
En direct, structurellement. Le prix réduit de moitié hors pointe de DeepSeek et sa remise d'environ 30x sur les réponses de cache V4-Pro sont des mécanismes de premier parti que les revendeurs facturent comme un tarif forfaitaire unique. Un hébergeur justifie son prix par la conformité, le basculement et une seule facture pour plusieurs modèles. Pour le coût brut des jetons, le premier parti gagne. Les crédits des fournisseurs qui proposent des programmes se trouvent sur AI Perks.
Quand sont les heures de pointe de DeepSeek ?
Les heures de pointe sont de 01h00 à 04h00 et de 06h00 à 10h00 UTC en semaine. Tout le reste, y compris tout le samedi et le dimanche, est facturé à moitié prix. Cela laisse environ 79 % de la semaine au taux hors pointe par défaut (dérivé), de sorte que le traitement par lots et le travail mis en file d'attente y arrivent presque toujours sans aucun effort de planification.
Combien économise une réponse de cache DeepSeek ?
Sur DeepSeek-V4-Pro, une réponse de cache coûte 0,022 $ par million de jetons d'entrée hors pointe contre 0,66 $ pour une absence de réponse, soit environ 30 fois moins. Sur V4.1-Flash, la même comparaison est de 0,003 $ contre 0,15 $, soit environ 50 fois moins (dérivé). En additionnant la remise sur cache avec les heures creuses, l'écart par rapport à une absence de réponse en pointe atteint 60x sur V4-Pro.
Pourquoi mon appel API deepseek-v4-flash a-t-il cessé de fonctionner ?
DeepSeek-V4.1-Flash a retiré les noms de points de terminaison deepseek-v4-flash et deepseek-v4-flash-vision-exp. Tout tutoriel ou exemple de code écrit avant septembre 2026 les utilise toujours et échouera désormais. Mettez à jour l'identificateur du modèle, et notez que les hébergeurs tiers encapsulent leurs propres identificateurs différemment de ceux de DeepSeek.
DeepSeek offre-t-il des crédits API gratuits aux nouveaux comptes ?
L'application de chat DeepSeek est gratuite, mais il n'y a pas de niveau gratuit d'API indiqué sur la page de tarification officielle, et les affirmations de crédits pour nouveaux comptes sont rapportées de manière inconsistante et non confirmées. DeepSeek n'exécute pas non plus de programme de crédits de démarrage. Les fournisseurs qui le font sont suivis sur AI Perks dans 194 entreprises.
Quel est le coût de DeepSeek V4-Pro par million de jetons ?
DeepSeek-V4-Pro-0813 coûte 0,66 $ par million de jetons d'entrée sans réponse de cache et 1,98 $ par million de jetons de sortie hors pointe, doublant à 1,32 $ et 3,96 $ pendant les heures de pointe. L'entrée mise en cache coûte 0,022 $ hors pointe. Cette stratification sur un seul modèle est la raison pour laquelle un tarif forfaitaire de revendeur rivalise rarement. Compensez vos factures d'autres modèles sur AI Perks.
Abonnez-vous sur getaiperks.com →
DeepSeek fixe le prix plancher. Les crédits gratuits de tous les autres couvrent le reste.