DeepSeek V4-Pro Prissætning: Hvad det koster vs V4.1-Flash

Pris pr. million tokens for DeepSeek-V4-Pro-0813, opdeling mellem spidsbelastning og lav belastning, rabat ved cache-hit, og hvorfor modelvalg slår planlægning.

DeepSeekDeepSeek V4-ProLLM API PricingOff-Peak PricingAI Perks
Author Avatar
Andrew
AI Perks Team
5,904

Quick Answer

DeepSeek-V4-Pro-0813 koster $0,66 pr. million input-tokens ved cache-miss uden for spidsbelastning og $1,32 ved spidsbelastning, med output til $1,98 uden for spidsbelastning og $3,96 ved spidsbelastning. En cache-hit reducerer input til $0,022 uden for spidsbelastning. DeepSeek udgiver ingen API-gratis niveau og kører intet startup-kreditprogram, i modsætning til de 194 virksomheder, der spores på getaiperks.com.

AI Perks

AI Perks giver adgang til eksklusive rabatter, kreditter og tilbud på AI-værktøjer, cloud-tjenester og API'er for at hjælpe startups og udviklere med at spare penge.

AI Perks Cards

Hvad koster DeepSeek-V4-Pro per million tokens?

DeepSeek-V4-Pro-0813 koster $0,66 per million cache-miss input tokens uden for spidsbelastningstid og $1,32 i spidsbelastningstid. Output koster $1,98 uden for spidsbelastningstid og $3,96 i spidsbelastningstid. Et cache hit reducerer input til $0,022 uden for spidsbelastningstid.

DeepSeek-V4-Pro-0813 blev generelt tilgængelig den 13. august 2026 som flagskibet for V4-linjen, bygget til værktøjsbrug, kodekørsel og multi-trins autonome arbejdsgange. Den prissættes efter klokken: spidsbelastning er 01:00 til 04:00 og 06:00 til 10:00 UTC på hverdage, og hver anden time koster halvdelen.

Satser publiceret i DeepSeek's API-dokumentation, i USD per million tokens:

ModelTokentypeUden for spidsbelastningSpidsbelastning
DeepSeek-V4-Pro-0813Input, cache hit$0,022$0,044
DeepSeek-V4-Pro-0813Input, cache miss$0,66$1,32
DeepSeek-V4-Pro-0813Output$1,98$3,96
DeepSeek-V4.1-FlashInput, cache hit$0,003$0,006
DeepSeek-V4.1-FlashInput, cache miss$0,15$0,30
DeepSeek-V4.1-FlashOutput$0,60$1,20

På forhåndsvisningen i april 2026 blev V4-parret rapporteret at have et 1M-token kontekstvindue med op til 384K tokens output, en skiftbar tænketilstand og åbne vægte under en MIT-licens. Det stammer fra lanceringens dækning, ikke DeepSeek's nuværende prisside, så bekræft det mod den nøjagtige modelstreng, du kalder. AI Perks sporer prissætning og kreditprogrammer på tværs af 194 virksomheder, og DeepSeek skiller sig ud på det andet punkt: den udgiver intet program for startkreditter.


Top AI-kompetencer til startups

Ansøg direkte gennem disse verificerede programmer.

Spidsbelastning er kun 21% af ugen

Det meste dækning indrammer uden for spidsbelastningstid som en rabat, du låser op for. Matematikken siger det modsatte: spidsbelastning dækker 7 timer en ugedag, 35 ud af 168, så 79% af ugen faktureres allerede til den lavere sats.

Uden for spidsbelastningstid er standarden. Spidsbelastning er et tillæg, du betaler ved et uheld, i et vindue, der falder over den europæiske morgen. Du jager ikke en rabat, du undgår en 35-timers straffebok, og løsningen er at tjekke, at ingen cron job er landet der. Interaktiv trafik er undtagelsen, fordi den ur er sat af dine brugere.


Hvorfor V4.1-Flash slår V4-Pro på pris

At flytte et job uden for spidsbelastningstid halverer regningen, præcis 2x. At flytte det fra V4-Pro til V4.1-Flash reducerer cache-miss input med 4,4x og output med 3,3x. Modelvalg er den største løftestang, og de to sammensættes.

En million cache-miss input tokens plus en million output tokens, på begge ender af uret:

Model og tidspunktInputOutputTotal
V4-Pro i spidsbelastningstid$1,32$3,96$5,28
V4-Pro uden for spidsbelastningstid$0,66$1,98$2,64
V4.1-Flash i spidsbelastningstid$0,30$1,20$1,50
V4.1-Flash uden for spidsbelastningstid$0,15$0,60$0,75

V4-Pro i sin billigste time koster stadig 1,76x, hvad V4.1-Flash koster i sin dyreste time. Ingen tidsplanlægningstrick lukker det hul.

Stabl begge løftestænger, og spredningen udvides igen: V4-Pro i spidsbelastningstid mod V4.1-Flash uden for spidsbelastningstid er 7x på identiske tokenantal, og kun en af disse to beslutninger sættes af uret. Det sædvanlige råd om at skubbe batcharbejde ind i billige timer antager, at modellen er fastlåst. Det er den sjældent, og at nedgradere den betaler sig, selv når trafikken ikke kan omplanlægges.

Flash vinder på pris i alle timer af dagen, også spidsbelastningstid. V4-Pro's fordel er alene kapacitet, så den skal tjene sin plads på opgavevanskelighed.


Top AI-kompetencer til startups

Ansøg direkte gennem disse verificerede programmer.

Hvorfor en V4-Pro Agent Kørsel Koster Mere End Tabellen Indikerer

Output koster 3x hvad cache-miss input koster på V4-Pro, og de arbejdsbyrder, DeepSeek byggede V4-Pro til - agenter-loops, værktøjsopkald, multi-trins udførelse - genererer mest output per arbejdsenhed.

En måned med reel brug: 100M input tokens med en cache hit rate på 70% plus 20M output tokens, til de ovennævnte satser:

KonfigurationInputOutputMånedlig total
V4-Pro, spidsbelastningstid$42,68$79,20$121,88
V4-Pro, uden for spidsbelastningstid$21,34$39,60$60,94
V4.1-Flash, spidsbelastningstid$9,42$24,00$33,42
V4.1-Flash, uden for spidsbelastningstid$4,71$12,00$16,71

Tre ting følger.

Output er 65% af V4-Pro regningen uden for spidsbelastningstid. Når caching fungerer, og jobs undgår spidsbelastningstid, stopper DeepSeek med at være et inputproblem og bliver et problem med responsens længde.

Hele spredningen er 7,3x. Samme tokens, samme leverandør, samme måned. Toprækken til bundrækken er to beslutninger.

Cache-rabatten er stejlere på Flash. Et V4-Pro cache hit er 30x billigere end et miss; på V4.1-Flash er det 50x. Disciplin med prompt-præfiks betaler sig mere på den billige model, det modsatte af hvad teams antager.


Hvad DeepSeek Har og Ikke Har Publiceret

DeepSeek publicerer per-token prissætning og lidt andet, som en køber ønsker. Der er ingen angivet API gratis niveau på den officielle prisside, intet program for startkreditter, og ingen separat publiceret prissætning for april forhåndsvisningsmodellerne.

Enhver guide skrevet før midten af august beskriver en prismodel, der ikke længere eksisterer:

DatoHvad blev frigivetPrissætning status
24. april 2026V4-Pro og V4-Flash forhåndsvisningIkke separat publiceret ved forhåndsvisning
31. juli 2026DeepSeek-V4-Flash-0731, stabilRapporteret til $0,14 input / $0,28 output, fast
13. august 2026DeepSeek-V4-Pro-0813, generel tilgængelighedErstattet af opdelingen nedenfor
Midt august 2026Spidsbelastnings- og uden for spidsbelastningstid prissætning introduceretNuværende struktur
Omkring 10. september 2026DeepSeek-V4.1-FlashNuværende Flash-satser

April forhåndsvisningsdetaljerne, juli Flash-tallene og den nøjagtige dato for ændringen er rapporteret, ikke bekræftet på DeepSeek's nuværende prisside: betragt dem som historie, ikke budgetinput. V4-Pro og V4.1-Flash satserne ovenfor kommer direkte fra DeepSeek.

Augustændringen, som rapporteret, flyttede Flash fra en fast $0,14 cache-miss input til de nuværende $0,15 uden for spidsbelastningstid og $0,30 i spidsbelastningstid. Det er ikke en prisnedsættelse med en asterisk, men en prissplit: kør uden for spidsbelastningstid, og du betaler omtrent den gamle sats, kør i spidsbelastningstid, og du betaler cirka dobbelt.

Om gratis adgang: DeepSeek chat-appen er gratis. Påstande om, at nye API-konti modtager gratis kreditter, rapporteres inkonsistent og er ikke bekræftet på den officielle prisside, så betragt ethvert tal, du ser andre steder, som uverificeret. DeepSeek kører heller intet program for startkreditter, hvilket efterlader ingen gratis landingsbane overhovedet. AI Perks sporer 7,7 mio. $ i kreditter på tværs af 194 virksomheder, der kører et sådant program.

Find de udbydere, der rent faktisk giver kreditter, på getaiperks.com →


Top AI-kompetencer til startups

Ansøg direkte gennem disse verificerede programmer.

Hvor Dyxtidsrabatten Ikke Gælder

Tid-på-dagen prissætning er en DeepSeek-mekanik fra første part. Tredjeparts-hosts og routere sætter deres egne satser, og en fast sats, der ser billig ud på papiret, kan ligge på DeepSeek's spidsbelastningspris døgnet rundt.

Baseten rapporteres at have tilføjet DeepSeek V4.1 Flash til sine Model API'er den 10. september 2026, med input angivet til $0,30 per million tokens. Hverken dette tal eller det matchende outputtal er bekræftet her (outputtallet var ikke pålideligt læsbart ved kontrol), så verificer begge med udbyderen, før du budgetterer. Hvis man tager det for pålydende, er $0,30 præcis DeepSeek's input sats i spidsbelastningstid og dobbelt dens sats uden for spidsbelastningstid, opkrævet hver time af dagen. Baseten's stående prøvetilbuds-kredit for nye arbejdsområder rapporteres til at være $30, hvilket hverken er DeepSeek-specifikt eller nyt.

Handlen kan stadig være korrekt: du køber latenstid, region og enkelhed, og en fast sats forudser lettere end en tidsplan. Prissæt den ærligt, for en sats, der er sat til spidsbelastningsnummeret, får aldrig de 79% af ugen, der ellers ville faktureres til halv pris. Gratis landingsbane kommer fra udbydere, der finansierer den, og den liste er på getaiperks.com.


Sådan Reducerer Du En DeepSeek-V4-Pro Regning, I Rækkefølge Efter Virkning

Løftestang 1: Finansier de dyre niveauer andetsteds. DeepSeek giver ingen kreditter, så brug getaiperks.com til at dække de premium udbydere, du sender tunge opgaver til, og lad DeepSeek håndtere volumenarbejde.

Løftestang 2: Nedgradér alle opgaver, der ikke behøver flagskibet. På den ovennævnte arbejdsbyrde er V4-Pro til V4.1-Flash 3,6x billigere med identiske indstillinger. Intet andet her kommer tæt på.

Løftestang 3: Gennemgå din tidsplan for utilsigtet spidsbelastningsbrug. Spidsbelastning er 35 timer om ugen, så tjek, at ingen cron job er landet mellem 01:00 og 04:00 eller 06:00 og 10:00 UTC på en ugedag.

Løftestang 4: Stabilisér din prompt-præfiks. Cache hits kræver et identisk førende præfiks, så placer volatilt indhold sidst. Det er der, 30x på V4-Pro og 50x på Flash bor.

Løftestang 5: Angrib responslængden. Efter de fire ovenstående er output omtrent to tredjedele af regningen og det største tilbageværende element.


Top AI-kompetencer til startups

Ansøg direkte gennem disse verificerede programmer.

Ofte Stillede Spørgsmål

Hvad koster DeepSeek-V4-Pro per million tokens?

Cache-miss input er $0,66 uden for spidsbelastningstid og $1,32 i spidsbelastningstid. Output er $1,98 uden for spidsbelastningstid og $3,96 i spidsbelastningstid. Et cache hit koster $0,022 uden for spidsbelastningstid og $0,044 i spidsbelastningstid. Spidsbelastningstimer er 01:00 til 04:00 og 06:00 til 10:00 UTC på hverdage.

Hvad er DeepSeek's spidsbelastningstimer, og hvor stor en del af ugen er de?

Spidsbelastning er 01:00 til 04:00 og 06:00 til 10:00 UTC, mandag til fredag. Det er 7 timer en ugedag, 35 ud af de 168 i en uge, eller omkring 21%. De resterende 79%, inklusive hele weekenden, faktureres til halvdelen af spidsbelastningssatsen.

Er DeepSeek-V4-Pro det værd frem for V4.1-Flash?

Kun for arbejde, der oprigtigt kræver flagskibet. V4-Pro koster 4,4x mere på cache-miss input, 3,3x mere på output, og omkring 3,6x mere på en blandet månedlig arbejdsbyrde. Ruter efter opgavevanskelighed først, optimér derefter tidsplanen.

Giver DeepSeek gratis kreditter til V4-Pro?

Nej. DeepSeek chat-appen er gratis, men den officielle prisside angiver ingen API gratis niveau, og der er intet program for startkreditter. Rapporter om gratis kreditter til nye API-konti er uverificerede. For reel gratis landingsbane sporer AI Perks 7,7 mio. $ på tværs af 194 virksomheder.

Sender tredjeparts-hosts DeepSeek uden for spidsbelastningstid prissætning videre?

Generelt nej. Tid-på-dagen prissætning er en førsteparts-mekanik, og hosts sætter deres egne satser. Baseten rapporteres at liste DeepSeek V4.1 Flash input til $0,30 per million, hvilket ville svare til DeepSeek's spidsbelastningssats opkrævet hele dagen, selvom det ikke er bekræftet her. Verificér den aktuelle sats med hosten, før du forpligter dig.

Hvad skete der med endpoint-navnet deepseek-v4-flash?

DeepSeek-V4.1-Flash har trukket modelnavnene deepseek-v4-flash og deepseek-v4-flash-vision-exp tilbage, og anmodninger rutes nu til den aktuelle Flash-model til Flash-prissætning. Kode skrevet mod de gamle identifikatorer skal opdateres, så pin den aktuelle modelstreng i stedet for at stole på aliaser.


Abonnér på getaiperks.com →

DeepSeek prissætter lavt og finansierer intet. Udbyderne, der finansierer dig, findes på getaiperks.com.

AI Perks

AI Perks giver adgang til eksklusive rabatter, kreditter og tilbud på AI-værktøjer, cloud-tjenester og API'er for at hjælpe startups og udviklere med at spare penge.

AI Perks Cards

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.