DeepSeek V4.1 Flash-priser og udfasede V4 API-slutpunkter

DeepSeek V4.1 Flash prissætning, opdelingen mellem spids- og off-peak timer, cache hit versus miss, og endpointnavnene deepseek-v4-flash, som nu fejler.

DeepSeekDeepSeek V4LLM PricingAI APIAI Perks
Author Avatar
Andrew
AI Perks Team
8,954

Quick Answer

DeepSeek V4.1 Flash koster $0,15 pr. million cache-miss input-tokens uden for spidsbelastningstid og $0,30 i spidsbelastningstid, med cachede input til $0,003 uden for spidsbelastningstid. DeepSeek er den eneste store leverandør, der opkræver betaling efter tidspunkt på dagen, og de tilbyder intet opstarts-kreditprogram, i modsætning til de 194 virksomheder, der følges på getaiperks.com.

AI Perks

AI Perks giver adgang til eksklusive rabatter, kreditter og tilbud på AI-værktøjer, cloud-tjenester og API'er for at hjælpe startups og udviklere med at spare penge.

AI Perks Cards

Hvad DeepSeek V4.1 Flash Koster Pr. Million Tokens

DeepSeek V4.1 Flash koster $0,15 pr. million cache-miss input tokens uden for spidsbelastning og $0,30 i spidsbelastning. En cachet input token koster $0,003 uden for spidsbelastning, hvilket er 50x under Flash's egen cache-miss rate (afledt).

Flash ankom omkring den 10. september 2026 og optræder i den officielle dokumentation som DeepSeek-Flash. Flagskibet DeepSeek-V4-Pro-0813 har været generelt tilgængelig siden den 13. august 2026.

Alle figurer herunder er USD pr. million tokens, taget fra api-docs.deepseek.com og bekræftet i september 2026.

Model og vindueInput, cache hitInput, cache missOutput
DeepSeek-V4-Pro-0813, uden for spidsbelastning$0,022$0,66$1,98
DeepSeek-V4-Pro-0813, spidsbelastning$0,044$1,32$3,96
DeepSeek-V4.1-Flash, uden for spidsbelastning$0,003$0,15Ikke offentliggjort
DeepSeek-V4.1-Flash, spidsbelastning$0,006$0,30Ikke offentliggjort

DeepSeek har ikke offentliggjort en outputpris for V4.1 Flash, der kan bekræftes på den officielle side. Hvis du ser en citeret andre steder, skal du betragte den som uverificeret, indtil den optræder i den officielle tabel.

DeepSeek er usædvanlig på en anden måde, der er vigtigere for stiftere end prisen pr. token: den kører slet ingen startup-kreditprogram. Dette gab dækkes nedenfor, og det er derfor, AI Perks sporer de udbydere, der kører et.


Top AI-kompetencer til startups

Ansøg direkte gennem disse verificerede programmer.

Hvorfor DeepSeek Oplader To Forskellige Priser For Den Samme Token

DeepSeek er den eneste store modeludbyder, der afregner efter tidspunkt på dagen. Spidsbelastningstimer er 01:00 til 04:00 og 06:00 til 10:00 UTC på hverdage, og alt uden for disse vinduer koster præcis det halve.

Læs vindueslisten to gange, for der er et gab i midten af den. Perioden fra 04:00 til 06:00 UTC ligger mellem de to spidsbelastningsblokke og afregnes til prisen uden for spidsbelastning. Det er ikke en kontinuerlig ni-timers spidsbelastning.

Afledt af de offentliggjorte vinduer: spidsbelastning dækker syv timer om dagen, kun på hverdage, hvilket er 35 timer ud af de 168 i en uge. Omkring 79 procent af kalenderen er allerede uden for spidsbelastning.

Det omformulerer problemet. Du forsøger ikke at finde det billige vindue, du forsøger at undgå det dyre. Tre arbejdsbyrder, hvor det er næsten gratis at gøre:

  • Natlige batchjobs. Et job, der planlægges til kl. 08:00 UTC, ligger inden for spidsbelastningen. At flytte det til kl. 12:00 UTC halverer regningen og ændrer intet andet.
  • Evaluerings- og regressionskørsler. Disse har ingen brugere, der venter på dem, så de hører som standard til uden for spidsbelastningsblokkene.
  • Embedding og genindekseringspasninger. Store engangsinputbrændinger er den enkelt mest spidsbelastningsfølsomme ting, de fleste teams kører.

Interaktiv trafik er den del, du ikke kan flytte, og den bør prissættes til spidsbelastningspriser i enhver prognose, du opbygger.


Cache Hit Er Den Større Multiplikator

På DeepSeek-V4-Pro koster en cachet input token $0,022 pr. million mod $0,66 for en miss. Det er en 30x forskel (afledt fra tabellen ovenfor), og det overskygger de 2x, du får fra tidsplanlægning.

De to multiplikatorer stables, og denne stabling er hele historien om DeepSeek's omkostningsprofil. En peak cache-miss input token til $1,32 mod en off-peak cache-hit token til $0,022 er en 60x spredning på den samme model (afledt).

På V4.1 Flash er cache-forholdet endnu bredere: $0,15 for en miss mod $0,003 for et hit er 50x (afledt).

Hvad dette betyder i praksis er, at promptstruktur slår modelvalg. At skifte fra V4-Pro til Flash reducerer cache-miss input med 4,4x (afledt, $0,66 mod $0,15). At få din cache til at ramme på V4-Pro reducerer den med 30x. Den billigere model er den mindste løftestang.

Cache hits kommer fra et stabilt præfiks, så de praktiske regler er kedelige og effektive: hold systemprompten byte-identisk på tværs af kald, placer værktøjsdefinitioner og hentet kontekst før noget brugerspecifikt, og interpoler aldrig et tidsstempel eller et sessions-id nær toppen af en prompt.


Top AI-kompetencer til startups

Ansøg direkte gennem disse verificerede programmer.

Endpoint Navnene DeepSeek V4.1 Flash Pensionerede

DeepSeek-V4.1-Flash pensionerede modelnavnene deepseek-v4-flash og deepseek-v4-flash-vision-exp. Kode, der stadig sender en af ​​disse strenge, vil fejle.

Pensioneret modelnavnStatus
deepseek-v4-flashPensioneret med V4.1 Flash
deepseek-v4-flash-vision-expPensioneret med V4.1 Flash

Dette var en stille ændring snarere end en headline-nedlæggelse, hvilket er præcis det, der gør det dyrt. Modelstrengen er normalt den mindst gennemgåede linje i en AI-integration: den sidder i en miljøvariabel, en konfigurationsfil, en Terraform-skabelon eller en leverandørs SDK-wrapper, og ingen rører den mellem udgivelserne.

Det bredere problem er den lange hale af indhold. Vejledninger, YouTube-walkthroughs, forum-svar og genererede kodeprøver skrevet før september 2026 refererer alle stadig til de gamle navne, og ingen af ​​dem vil blive rettet. En assistent, der lærte fra disse sider, vil blive ved med at foreslå dem.

Hvis du kører DeepSeek i produktion, skal du greppe dit arkiv for begge strenge, derefter kontrollere din infrastrukturkonfiguration og enhver secret manager separat. Et modelnavn, der blev indstillet for seks måneder siden i en deployeringsvariabel, vises ikke i en kodesøgning.


Hvad Ændrede Sig Siden Den Tidligere DeepSeek Prisguide

Tre ting har ugyldiggjort dele af enhver DeepSeek pris side skrevet før midten af ​​august 2026: spidsbelastnings- og off-peak-opdelingen, V4-Pro- og Flash-opdelingen og de pensionerede endpoint-navne.

DatoUdgivelse eller ændringKonfidens
24. april 2026V4-Pro og V4-Flash preview: 1 mio. tokens kontekst, op til 384K output, skiftbare tænke- og ikke-tænke-tilstandeMedium
31. juli 2026DeepSeek-V4-Flash-0731, stabil udgivelse af Flash-linjenMedium
13. august 2026DeepSeek-V4-Pro-0813 generel tilgængelighedHøj
16. august 2026Spidsbelastnings- og off-peak-prissætning introduceretMedium
Omkring 10. september 2026DeepSeek-V4.1-Flash, gamle Flash-endpoint-navne pensioneretHøj

Den historiske figur, der er værd at kende, er den sidste kendte Flash-pris før ændringen den 16. august: $0,14 pr. million cache-miss input og $0,28 pr. million output. Det er det tal, de fleste tredjeparts sammenligningstabeller stadig viser. Det er ikke den aktuelle pris, og den går forud for spidsbelastningsmultiplikatoren helt, så enhver prognose bygget på den undervurderer en spidsbelastnings tung arbejdsbyrde med cirka 2x (afledt: $0,14 mod den nuværende $0,30 peak cache-miss rate er 2,1x).

En enkelt flad inputpris for DeepSeek er nu meningsløs uden to kvalifikatorer: hvilken side af cachen, og hvilken side af klokken.


Top AI-kompetencer til startups

Ansøg direkte gennem disse verificerede programmer.

DeepSeek Har Ingen Gratis API-Tier Og Intet Startup Kreditprogram

DeepSeek chat-appen er gratis at bruge. API'en er det ikke, og der er ingen angivet gratis tier på den officielle pris side. DeepSeek kører heller ingen dedikeret startup kreditprogram.

Påstande om, at nye API-konti modtager gratis kreditter, cirkulerer bredt og rapporteres inkonsistent. De er ikke bekræftet på den officielle pris side, så planlæg din første måneds forbrug, som om de ikke eksisterer.

Tredjeparts host er en delvis vej udenom dette, med den sædvanlige forbehold for, at deres priser og deres vilkår er deres egne. Baseten lister DeepSeek V4.1 Flash input til $0,30 pr. million og har en stående $30 ny-workspace prøvekredit (verificer begge, før du budgetterer imod dem). OpenRouter, Together og Fireworks hoster også DeepSeek-modeller, og valget mellem dem handler normalt om routing, region og rate limits snarere end overskrift.

Det virkelige hul for stiftere er strukturelt. De fleste model- og infrastrukturudbydere, som en startup kører på, opererer en eller anden form for kreditprogram, og de nuværende beløb og vilkår for hver enkelt er det, som AI Perks sporer. DeepSeek opererer ingen, hvilket betyder, at DeepSeek er den eneste linje på din AI-regning, som du altid betaler kontant.

Det er argumentet for at behandle den som den billige standard tier inde i et stack snarere end hele stacket. Ruter det højvolumen, cache-venlige, off-peak arbejde til DeepSeek, og ruter arbejdet, der har brug for frontlinjeresoning, til en udbyder, hvis regning nogen anden dækker. AI Perks sporer 7,7 mio. USD i kreditter på tværs af 194 virksomheder, hvilket er, hvor den anden halvdel kommer fra.

Se hvilke udbydere der kører kreditprogrammer på getaiperks.com →


Ofte Stillede Spørgsmål

Hvor meget koster DeepSeek V4.1 Flash?

DeepSeek V4.1 Flash koster $0,15 pr. million cache-miss input tokens uden for spidsbelastning og $0,30 i spidsbelastning. Cached input koster $0,003 uden for spidsbelastning og $0,006 i spidsbelastning. DeepSeek har ikke offentliggjort en bekræftbar outputpris for Flash, så betragt enhver outputpris, du finder andre steder, som uverificeret.

Hvad er DeepSeek's spidsbelastnings- og off-peak timer?

Spidsbelastningstimer er 01:00 til 04:00 og 06:00 til 10:00 UTC på hverdage. Alt andet, inklusive 04:00 til 06:00 UTC-gabet mellem de to blokke og al trafik i weekenden, er uden for spidsbelastning til halv pris. Afledt af disse vinduer er omkring 79 procent af ugen allerede uden for spidsbelastning.

Hvorfor fejler mit deepseek-v4-flash API-kald pludselig?

DeepSeek-V4.1-Flash pensionerede modelnavnene deepseek-v4-flash og deepseek-v4-flash-vision-exp. Enhver kode, vejledning eller konfiguration, der stadig sender disse strenge, vil fejle. Tjek dine miljøvariabler og din deployeringskonfiguration samt din kilde, da modelnavne ofte lever uden for arkivet. Ændringen blev udgivet stille omkring den 10. september 2026.

Giver DeepSeek gratis API-kreditter til nye konti?

Der er ingen angivet API gratis tier på DeepSeek's officielle pris side. Rapporter om nye kontokreditter er inkonsistente og ubekræftede, så budgetter, som om ingen eksisterer. Chat-appen er gratis. For udbydere, der offentliggør kreditprogrammer, se AI Perks.

Har DeepSeek et startup kreditprogram?

Nej. DeepSeek kører intet dedikeret startup kreditprogram, hvilket gør det til en af ​​de få store model API'er, du altid betaler for kontant. De fleste andre udbydere kører et, og AI Perks sporer 7,7 mio. USD i kreditter på tværs af 194 virksomheder, der dækker dem.

Er DeepSeek V4-Pro eller V4.1 Flash billigere?

Flash er billigere på alle offentliggjorte sammenlignelige: $0,15 mod $0,66 pr. million cache-miss input tokens uden for spidsbelastning, et 4,4x gab (afledt). Men at fikse din prompt caching på V4-Pro er en 30x løftestang, så promptstruktur betyder mere end modelvalg. Ingen af ​​dem har et kreditprogram bag sig, hvilket er det, som AI Perks sporer for de udbydere, der gør.


Tilmeld dig på getaiperks.com →

DeepSeek er den billigste linje på din AI-regning. Få de andre linjer dækket på getaiperks.com.

AI Perks

AI Perks giver adgang til eksklusive rabatter, kreditter og tilbud på AI-værktøjer, cloud-tjenester og API'er for at hjælpe startups og udviklere med at spare penge.

AI Perks Cards

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.