AI Perks biedt toegang tot exclusieve kortingen, tegoeden en deals op AI-tools, cloudservices en API's om startups en ontwikkelaars te helpen besparen.

Wat een DeepSeek Cache Hit Daadwerkelijk Kost
Op DeepSeek-V4-Pro kost een input token dat uit de cache wordt geleverd $0,022 per miljoen buiten piekuren tegenover $0,66 voor een cache miss. Dat is een korting van 30x voor het twee keer versturen van hetzelfde voorvoegsel.
De meeste prijslijsten vermelden één inputgetal en gaan verder. DeepSeek heeft er vier, omdat twee afzonderlijke vermenigvuldigers van toepassing zijn op elke enkele aanroep: of het voorvoegsel de cache heeft geraakt, en hoe laat op de dag je het hebt verzonden.
| Model en venster | Input cache hit | Input cache miss | Output |
|---|---|---|---|
| DeepSeek-V4-Pro-0813, buiten piekuren | $0,022 | $0,66 | $1,98 |
| DeepSeek-V4-Pro-0813, piekuren | $0,044 | $1,32 | $3,96 |
| DeepSeek-V4.1-Flash, buiten piekuren | $0,003 | $0,15 | niet geverifieerd |
| DeepSeek-V4.1-Flash, piekuren | $0,006 | $0,30 | niet geverifieerd |
Alle bedragen zijn USD per miljoen tokens, uit de officiële API-documentatie per september 2026. De outputprijs voor V4.1-Flash is hier niet geverifieerd, dus controleer de officiële pagina voordat je hierop budgetteert.
De Flash-ratio is nog breder dan die van het vlaggenschip: $0,003 tegenover $0,15 is een verschil van 50x (afgeleid van de bovenstaande tarieven). AI Perks volgt dit soort leveranciersmechanismen naast de kredietprogramma's die ze compenseren.
Beste AI-credits voor start-ups
Meld u direct aan via deze geverifieerde programma's.
Claude $10,000 credits
Gekwalificeerd voor start-ups in een vroege fase
OpenAI $2,500 credits
Gekwalificeerd voor start-ups in een vroege fase
Anthropic $25,000 credits
Gekwalificeerd voor start-ups in een vroege fase
AWS $300,000 credits
Gekwalificeerd voor start-ups in een vroege fase
Google Cloud $350,000 credits
Gekwalificeerd voor start-ups in een vroege fase
Lovable $6,000 credits
Gekwalificeerd voor start-ups in een vroege fase
Piek en Buiten Piekuren: De Enige Leverancier Die per Klok Uur Rekent
DeepSeek piekuren zijn doordeweeks van 01:00-04:00 en 06:00-10:00 UTC. Al het andere, inclusief het hele weekend, wordt gefactureerd tegen precies de helft van de prijs.
Geen enkele andere grote modelleverancier prijst op basis van het tijdstip van de dag, wat het tot de meest over het hoofd geziene hefboom maakt in LLM-kostenbeheer. Geen enkele optimalisatiegids geschreven voor OpenAI of Anthropic heeft reden om het te vermelden.
Afgeleid van die vensters: piek is 7 uur per dag gedurende 5 weekdagen, dus 35 van de 168 uren van de week. Ongeveer 79% van de kalender is al buiten piekuren, dus de meeste teams krijgen de korting per ongeluk en zouden er meer bewust van kunnen profiteren.
Waar je zit bepaalt hoeveel van je werkdag wordt blootgesteld:
| Locatie van het team | Piekvensters, lokale tijd | Bedrijfstijd blootstelling |
|---|---|---|
| US Eastern (UTC-4) | 21:00-00:00, 02:00-06:00 | Geen, de hele werkdag is buiten piekuren |
| US Pacific (UTC-7) | 18:00-21:00, 23:00-03:00 | Geen |
| Centraal Europa (UTC+2) | 03:00-06:00, 08:00-12:00 | De hele ochtend |
| India (UTC+5:30) | 06:30-09:30, 11:30-15:30 | Het grootste deel van de werkdag |
| China (UTC+8) | 09:00-12:00, 14:00-18:00 | Bijna alles |
Lokale tijden worden geconverteerd vanuit de gepubliceerde UTC-vensters met de getoonde offset, en zomertijd verschuift deze met een uur. Het patroon is geen toeval: de piekvensters vallen samen met de Chinese werkdag, dus het interactieve verkeer van een Amerikaans team valt gratis in de goedkope helft van de klok.
Beide Kortingen Combineren: Een Spreiding van 60x op één Model
Een gecached input token buiten piekuren à $0,022 tegenover een piek cache miss à $1,32 is een spreiding van 60x op identieke output van hetzelfde model.
Dit is hoe dat eruitziet bij een realistische agent-workflow: een context van 200.000 tokens, 1.000 keer per dag opnieuw verzonden, dus 200 miljoen input tokens dagelijks op V4-Pro.
| Scenario | Tarief per 1M | Dagelijkse inputkosten |
|---|---|---|
| Piekuren, elke aanroep een cache miss | $1,32 | $264,00 |
| Buiten piekuren, elke aanroep een cache miss | $0,66 | $132,00 |
| Piekuren, elke aanroep een cache hit | $0,044 | $8,80 |
| Buiten piekuren, elke aanroep een cache hit | $0,022 | $4,40 |
Alle vier de rijen zijn afgeleid door de gepubliceerde tarieven met 200 te vermenigvuldigen. Het verschil tussen de bovenste en onderste rij is ongeveer $260 per dag, of ruwweg $95.000 per jaar, op een workload die helemaal niet verandert.
Twee dingen volgen daaruit die de meeste kostenanalyses missen:
Een gecached vlaggenschip verslaat een niet-gecached klein model. V4-Pro gecachte input à $0,022 buiten piekuren is ongeveer 7x goedkoper dan V4.1-Flash niet-gecachte input à $0,15 (afgeleid). Het model downgraden om geld te besparen is de verkeerde zet als het werkelijke probleem een cache is die je nooit hebt opgewarmd.
Output wordt nooit gecached. Voor $1,98 buiten piekuren kost een output token ongeveer 90x een gecached input token (afgeleid). Zodra caching werkt, heb je geen inputrekening meer, maar een outputrekening, en elke verdere besparing komt voort uit kortere antwoorden of beperkte denkbudgetten. Teams die die outputrekening financieren met leverancierskredieten kunnen vergelijken wat beschikbaar is op getaiperks.com.
Beste AI-credits voor start-ups
Meld u direct aan via deze geverifieerde programma's.
Claude $10,000 credits
Gekwalificeerd voor start-ups in een vroege fase
OpenAI $2,500 credits
Gekwalificeerd voor start-ups in een vroege fase
Anthropic $25,000 credits
Gekwalificeerd voor start-ups in een vroege fase
AWS $300,000 credits
Gekwalificeerd voor start-ups in een vroege fase
Google Cloud $350,000 credits
Gekwalificeerd voor start-ups in een vroege fase
Lovable $6,000 credits
Gekwalificeerd voor start-ups in een vroege fase
Wat is er Veranderd Sinds Onze Eerdere DeepSeek Prijsgids
Drie dingen veranderden in 2026: V4-Pro-0813 bereikte algemene beschikbaarheid op 13 augustus, piek- en buiten piekuren-prijzen vervingen vlakke tarieven half augustus, en V4.1-Flash landde rond 10 september.
Onze eerdere DeepSeek prijsgids vermeldt vlakke per-token tarieven zonder tijdscomponent. Die dateren van vóór de wijziging en moeten als geschiedenis worden gelezen.
De tijdlijn, met eerlijk weergegeven betrouwbaarheid:
- 24 april 2026 (gemiddelde betrouwbaarheid): V4-Pro en V4-Flash preview, met een contextvenster van 1 miljoen tokens, tot 384K output tokens, en schakelbare denk- en niet-denkmodi.
- 31 juli 2026 (gemiddelde betrouwbaarheid): DeepSeek-V4-Flash-0731, de stabiele Flash-release. Laatst bekende prijzen vóór de wijziging waren $0,14 per miljoen cache-miss input en $0,28 per miljoen output, beide vlak. Historisch.
- 13 augustus 2026: DeepSeek-V4-Pro-0813 algemene beschikbaarheid, het huidige vlaggenschip redeneer- en agentmodel.
- Rond 10 september 2026: DeepSeek-V4.1-Flash, vermeld in de documentatie als "DeepSeek-Flash".
Als je werkt met een tutorial of een kostenmodel dat vóór augustus 2026 is geschreven, zijn alle inputgetallen daarin in beide richtingen onjuist: te hoog voor een cache hit, te laag voor een piek cache miss.
De Endpoint Naamswijziging Die Oude Code Breek
DeepSeek-V4.1-Flash heeft de modelnamen deepseek-v4-flash en deepseek-v4-flash-vision-exp stilzwijgend met pensioen gestuurd. Verzoeken die deze strings nog steeds doorgeven, zullen mislukken.
Dit is het soort wijziging dat zich manifesteert als een productie-incident in plaats van een migratieticket, omdat de modelnaam meestal in een configuratiebestand staat dat niemand in maanden heeft geopend. Oudere codevoorbeelden, SDK-wrappers en tutorials van derden verwijzen nog steeds naar de gepensioneerde namen.
De moeite waard om te doen vóór je volgende implementatie:
- Doorzoek de hele repository naar beide gepensioneerde strings, inclusief infrastructuurconfiguratie en notebooks
- Controleer elke ingekochte SDK of agentframework die een standaard DeepSeek-model hardcoded
- Bevestig afzonderlijk het visiepad, aangezien het experimentele visie-endpoint ook is hernoemd
- Voer je kostenmodel daarna opnieuw uit, omdat de vervanging op het nieuwe piek- en buiten piekuren schema staat
Beste AI-credits voor start-ups
Meld u direct aan via deze geverifieerde programma's.
Claude $10,000 credits
Gekwalificeerd voor start-ups in een vroege fase
OpenAI $2,500 credits
Gekwalificeerd voor start-ups in een vroege fase
Anthropic $25,000 credits
Gekwalificeerd voor start-ups in een vroege fase
AWS $300,000 credits
Gekwalificeerd voor start-ups in een vroege fase
Google Cloud $350,000 credits
Gekwalificeerd voor start-ups in een vroege fase
Lovable $6,000 credits
Gekwalificeerd voor start-ups in een vroege fase
DeepSeek Gratis Tier en Kredieten: Wat is Werkelijk Waar
De DeepSeek chat-app is gratis te gebruiken. De API is dat niet, en er is geen vermelde gratis tier op de officiële prijslijst.
Hier gaat het bij de meeste artikelen mis. Claims dat nieuwe API-accounts gratis kredieten ontvangen circuleren wijdverbreid, worden inconsistent gerapporteerd en zijn niet bevestigd op de officiële prijslijst. Als je een startsaldo nodig hebt, ga er dan van uit dat je ervoor betaalt.
Belangrijker voor oprichters: DeepSeek voert geen speciaal opstartkredietenprogramma uit. Er is geen aanvraag, geen fasegebonden tier, geen partnerkanaal. Lage per-token prijzen zijn het hele aanbod, wat een leemte is als je een stapel kredieten samenstelt.
Die leemte is precies waarom de routeringsbeslissing ertoe doet. Tal van providers bieden wel startup-programma's aan, en AI Perks volgt $7,7 miljoen aan kredieten bij 194 bedrijven die deze aanbieden. Het praktische patroon is om verkeer met hoog volume, dat geschikt is voor caching, naar DeepSeek te routeren à $0,022 per miljoen en verleende kredieten uit te geven aan de duurdere providers, waar een gratis token veel meer waard is.
DeepSeek Kopen van Iemand Anders
Derde partij hosts repliceren DeepSeek's piek- en buiten piekuren schema niet, wat betekent dat ze de first-party API tijdens piekuren kunnen onderschrijden en er buiten piekuren slecht aan verliezen.
Baseten vermeldt DeepSeek V4.1 Flash input à $0,30 per miljoen (gemiddelde betrouwbaarheid, verifieer voordat je erop budgetteert), en het outputcijfer werd niet betrouwbaar bevestigd. Baseten biedt ook een vaste $30 proefkrediet voor nieuwe werkruimtes.
Merk op wat $0,30 gelijk is aan: het is exact DeepSeek's eigen piek cache-miss tarief, en het dubbele van het buiten piekuren tarief (afgeleid). Voor een Amerikaans of Europees team wiens verkeer sowieso grotendeels buiten piekuren valt, is een vlak derde partij tarief niet duidelijk een besparing.
OpenRouter, Together en Fireworks hosten ook DeepSeek modellen. We vermelden hun prijzen hier niet omdat we ze niet hebben geverifieerd, en dat zou niets anders wat je leest ook moeten doen. De kwalitatieve afweging is echter consistent:
- First-party API: de enige plek waar de volledige cache-hit en buiten piekuren stack van toepassing is, en het goedkoopste pad met ruime marge wanneer beide actief zijn
- Derde partij hosts: vlakke tarieven, verschillende regio's, uniforme facturering, en meestal geen blootstelling aan DeepSeek's cache-hit tier
- Aggregators: nuttig voor failover, tegen een premie die je moet meten in plaats van aannemen
Prijzen je eigen verkeer tegen beide, en vergelijk dan het resultaat met de kredieten die beschikbaar zijn bij andere providers op getaiperks.com. Een gratis token verslaat een goedkoop token.
Beste AI-credits voor start-ups
Meld u direct aan via deze geverifieerde programma's.
Claude $10,000 credits
Gekwalificeerd voor start-ups in een vroege fase
OpenAI $2,500 credits
Gekwalificeerd voor start-ups in een vroege fase
Anthropic $25,000 credits
Gekwalificeerd voor start-ups in een vroege fase
AWS $300,000 credits
Gekwalificeerd voor start-ups in een vroege fase
Google Cloud $350,000 credits
Gekwalificeerd voor start-ups in een vroege fase
Lovable $6,000 credits
Gekwalificeerd voor start-ups in een vroege fase
Veelgestelde Vragen
Hoeveel goedkoper is een DeepSeek cache hit?
Op DeepSeek-V4-Pro is een cache hit $0,022 per miljoen input tokens buiten piekuren tegenover $0,66 voor een cache miss, een verschil van 30x. Op V4.1-Flash is het verschil nog groter, $0,003 tegenover $0,15, een verschil van 50x (afgeleid). Tarieven zijn uit de officiële API-documentatie per september 2026.
Wanneer zijn de DeepSeek piekuren?
Piekuren zijn doordeweeks van 01:00-04:00 en 06:00-10:00 UTC. Al het andere, inclusief beide weekenddagen, wordt gefactureerd tegen het halve piekuren tarief. Dat komt neer op ongeveer 79% van de week buiten piekuren (afgeleid), dus teams uit de VS krijgen de korting tijdens hun hele werkdag zonder iets te veranderen.
Heeft DeepSeek een gratis API tier?
Er is geen gratis API tier vermeld op de officiële prijslijst. De consumenten chat-app is gratis, maar de API is betaald vanaf het eerste token. Rapporten over gratis kredieten voor nieuwe accounts zijn inconsistent en ongeverifieerd. Providers die kredieten verstrekken worden gevolgd op getaiperks.com.
Biedt DeepSeek startup-kredieten aan?
DeepSeek voert geen speciaal startup-kredietenprogramma uit. Lage per-token prijzen zijn het hele aanbod. Voor oprichters die een stapel kredieten opbouwen, is dat een leemte die elders gevuld kan worden: AI Perks dekt $7,7 miljoen aan kredieten bij 194 bedrijven van de providers die wel programma's aanbieden.
Waarom werkte mijn DeepSeek API aanroep niet meer?
De meest waarschijnlijke oorzaak is de modelnaam. DeepSeek-V4.1-Flash heeft de endpointnamen deepseek-v4-flash en deepseek-v4-flash-vision-exp met pensioen gestuurd, en oudere tutorials en configuratiebestanden verwijzen er nog steeds naar. Doorzoek je repository op beide strings, inclusief ingekochte SDK's en notebooks, en controleer daarna je kostenmodel tegen de huidige tarieven.
Moet ik DeepSeek V4-Pro of V4.1-Flash gebruiken?
Voer de berekening uit voordat je aanneemt dat Flash goedkoper is. V4-Pro gecachte input à $0,022 buiten piekuren is ongeveer 7x goedkoper dan Flash niet-gecachte input à $0,15 (afgeleid), dus een goed gecached vlaggenschip kan een niet-gecached klein model volledig verslaan op de inputlijn. Het outputvolume, niet de modelgrootte, bepaalt meestal de rekening.
Cache het voorvoegsel, verzend buiten piekuren en laat andermans kredieten de rest dekken.