DeepSeek V4-Pro Prissättning: Vad det kostar jämfört med V4.1-Flash

Prissättning för DeepSeek-V4-Pro-0813 per miljon tokens, uppdelningen mellan högljudd och lågljudd tid, rabatten vid cacheträff och varför modellval är bättre än schemaläggning.

DeepSeekDeepSeek V4-ProLLM API PricingOff-Peak PricingAI Perks
Author Avatar
Andrew
AI Perks Team
11,301

Quick Answer

DeepSeek-V4-Pro-0813 kostar 0,66 USD per miljon cache-miss input-tokens utanför rusningstid och 1,32 USD under rusningstid, med output till 1,98 USD utanför rusningstid och 3,96 USD under rusningstid. En cache-träff sänker input till 0,022 USD utanför rusningstid. DeepSeek publicerar ingen API-gratistjänst och kör inget program för startkrediter, till skillnad från de 194 företag som spåras på getaiperks.com.

AI Perks

AI Perks ger tillgång till exklusiva rabatter, krediter och erbjudanden på AI-verktyg, molntjänster och API:er för att hjälpa startups och utvecklare att spara pengar.

AI Perks Cards

Vad kostar DeepSeek-V4-Pro per miljon tokens?

DeepSeek-V4-Pro-0813 kostar 0,66 USD per miljon cache-miss input-tokens utanför rusningstid och 1,32 USD under rusningstid. Output kostar 1,98 USD utanför rusningstid och 3,96 USD under rusningstid. En cache-träff sänker inputkostnaden till 0,022 USD utanför rusningstid.

DeepSeek-V4-Pro-0813 blev allmänt tillgänglig den 13 augusti 2026 som flaggskeppet i V4-serien, byggd för verktygsanvändning, kodexekvering och autonoma arbetsflöden i flera steg. Den prissätts per klockslag: rusningstid är 01:00 till 04:00 och 06:00 till 10:00 UTC på vardagar, och varje annan timme kostar hälften.

Priser publicerade i DeepSeeks API-dokumentation, i USD per miljon tokens:

ModellToken-typUtanför rusningstidRusningstid
DeepSeek-V4-Pro-0813Input, cache-träff0,022 USD0,044 USD
DeepSeek-V4-Pro-0813Input, cache-miss0,66 USD1,32 USD
DeepSeek-V4-Pro-0813Output1,98 USD3,96 USD
DeepSeek-V4.1-FlashInput, cache-träff0,003 USD0,006 USD
DeepSeek-V4.1-FlashInput, cache-miss0,15 USD0,30 USD
DeepSeek-V4.1-FlashOutput0,60 USD1,20 USD

Vid förhandsvisningen i april 2026 rapporterades V4-paret ha ett kontextfönster på 1 miljon tokens med upp till 384K tokens av output, ett omkopplingsbart tankeläge och öppna vikter under en MIT-licens. Detta kommer från lanseringsbevakning, inte DeepSeeks aktuella prissida, så bekräfta det mot den exakta modellsträngen du anropar. AI Perks spårar prissättning och kreditprogram hos 194 företag, och DeepSeek sticker ut på den andra punkten: den publicerar inget startprogram för krediter.


Bästa AI-krediter för startups

Ansök direkt via dessa verifierade program.

Rusningstid är bara 21 % av veckan

De flesta bevakningar ramar in rusningstid som en rabatt du låser upp. Aritmetiken säger motsatsen: rusningstid täcker 7 timmar en veckodag, 35 av 168, så 79 % av veckan faktureras redan till lägre pris.

Utanför rusningstid är standard. Rusningstid är ett tillägg du betalar av misstag, i ett fönster som infaller under den europeiska morgonen. Du jagar inte en rabatt, du undviker en straffbox på 35 timmar, och lösningen är att kontrollera att ingen cron-jobb hamnade där. Interaktiv trafik är undantaget, eftersom den klockan styrs av dina användare.


Varför V4.1-Flash slår V4-Pro i pris

Att flytta ett jobb utanför rusningstid halverar fakturan, exakt 2x. Att flytta det från V4-Pro till V4.1-Flash minskar cache-miss input med 4,4x och output med 3,3x. Modellvalet är den större hävstången, och de två samverkar.

En miljon cache-miss input-tokens plus en miljon output-tokens, i båda ändar av klockan:

Modell och tidpunktInputOutputTotalt
V4-Pro under rusningstid1,32 USD3,96 USD5,28 USD
V4-Pro utanför rusningstid0,66 USD1,98 USD2,64 USD
V4.1-Flash under rusningstid0,30 USD1,20 USD1,50 USD
V4.1-Flash utanför rusningstid0,15 USD0,60 USD0,75 USD

V4-Pro i sin billigaste timme kostar fortfarande 1,76 gånger vad V4.1-Flash kostar i sin dyraste timme. Ingen schemaläggningstrick stänger det gapet.

Lägg ihop båda hävstängerna och spridningen vidgas igen: V4-Pro under rusningstid mot V4.1-Flash utanför rusningstid är 7 gånger på identiska token-antal, och bara ett av dessa två beslut styrs av klockan. Det vanliga rådet att flytta batch-arbete till billiga timmar förutsätter att modellen är fast. Det är den sällan, och att nedgradera den betalar sig även när trafiken inte kan schemaläggas om.

Flash vinner på pris varje timme på dygnet, inklusive rusningstid. V4-Pros fördel är endast kapacitet, så den måste förtjäna sin plats genom uppgiftens svårighetsgrad.


Bästa AI-krediter för startups

Ansök direkt via dessa verifierade program.

Varför en V4-Pro Agent-körning kostar mer än tabellen antyder

Output kostar 3 gånger vad cache-miss input kostar på V4-Pro, och de arbetsbelastningar som DeepSeek byggde V4-Pro för – agent-loopar, verktygsanrop, exekvering i flera steg – genererar mest output per arbetsprestation.

En månad av verklig användning: 100 miljoner input-tokens med en cache-träffgrad på 70 % plus 20 miljoner output-tokens, till ovanstående priser:

KonfigurationInputOutputMånadens total
V4-Pro, rusningstid42,68 USD79,20 USD121,88 USD
V4-Pro, utanför rusningstid21,34 USD39,60 USD60,94 USD
V4.1-Flash, rusningstid9,42 USD24,00 USD33,42 USD
V4.1-Flash, utanför rusningstid4,71 USD12,00 USD16,71 USD

Tre saker följer.

Output utgör 65 % av V4-Pros faktura utanför rusningstid. När cachen fungerar och jobb undviker rusningstid, slutar DeepSeek att vara ett input-problem och blir ett problem med svarslängd.

Hela spridningen är 7,3x. Samma tokens, samma leverantör, samma månad. Översta raden till nedersta raden är två beslut.

Cache-rabatten är brantare på Flash. En V4-Pro cache-träff är 30 gånger billigare än en miss; på V4.1-Flash är den 50 gånger. Disciplin med prompt-prefix lönar sig mer på den billiga modellen, tvärtemot vad teamen antar.


Vad DeepSeek har och inte har publicerat

DeepSeek publicerar token-baserad prissättning och lite annat som en köpare vill ha. Det finns ingen angiven gratisnivå för API på den officiella prissidan, inget program för startkrediter och ingen separat publicerad prissättning för förhandsvisningsmodellerna i april.

Varje guide skriven före mitten av augusti beskriver en prismodell som inte längre finns:

DatumVad som levereradesPrissättningsstatus
24 april 2026Förhandsvisning av V4-Pro och V4-FlashInte separat publicerad vid förhandsvisning
31 juli 2026DeepSeek-V4-Flash-0731, stabilRapporterad till 0,14 USD input / 0,28 USD output, platt
13 augusti 2026DeepSeek-V4-Pro-0813, allmänt tillgängligErsatt av nedanstående uppdelning
Mitten av augusti 2026Införande av prissättning för rusningstid och utanför rusningstidNuvarande struktur
Cirka 10 september 2026DeepSeek-V4.1-FlashNuvarande Flash-priser

Detaljerna från förhandsvisningen i april, juli-siffrorna för Flash och det exakta datumet för ändringen rapporteras, inte bekräftas på DeepSeeks aktuella prissida: behandla dem som historik, inte budgetposter. Priserna för V4-Pro och V4.1-Flash ovan kommer direkt från DeepSeek.

Augustiändringen, som rapporterad, flyttade Flash från en platt kostnad på 0,14 USD för cache-miss input till nuvarande 0,15 USD utanför rusningstid och 0,30 USD under rusningstid. Det är inte en prissänkning med en asterisk utan en prisuppdelning: kör utanför rusningstid och du betalar ungefär gamla priset, kör under rusningstid och du betalar ungefär dubbelt.

Angående gratis tillgång: DeepSeek chattapp är gratis. Påståenden om att nya API-konton får gratis krediter rapporteras inkonsekvent och bekräftas inte på den officiella prissidan, så behandla alla siffror du ser någon annanstans som obekräftade. DeepSeek driver inte heller något program för startkrediter, vilket lämnar ingen gratis bana alls. AI Perks spårar 7,7 miljoner USD i krediter hos 194 företag som driver ett sådant.

Hitta leverantörerna som faktiskt ger krediter på getaiperks.com →


Bästa AI-krediter för startups

Ansök direkt via dessa verifierade program.

Där rabatten utanför rusningstid inte gäller

Tidsbaserad prissättning är en mekanism från första part hos DeepSeek. Tredjeparts-värdar och routrar sätter sina egna priser, och ett fast pris som ser billigt ut på pappret kan ligga på DeepSeeks pris under rusningstid dygnet runt.

Baseten rapporteras ha lagt till DeepSeek V4.1 Flash till sina Model APIs den 10 september 2026, med input angiven till 0,30 USD per miljon tokens. Varken den siffran eller motsvarande output-siffra är bekräftad här (output-numret var inte tillförlitligt läsbart när det kontrollerades), så verifiera båda med leverantören innan budgetering. Om man tar det för givet, är 0,30 USD exakt DeepSeeks pris under rusningstid för input och dubbelt så mycket som dess pris utanför rusningstid, debiterat varje timme på dygnet. Basetens nya provkrediter för arbetsytor rapporteras till 30 USD, vilket varken är DeepSeek-specifikt eller nytt.

Affären kan fortfarande vara korrekt: du köper latens, region och enkelhet, och ett fast pris prognostiserar lättare än ett schema. Prissätt det dock ärligt, för ett pris satt till rusningstid betalas aldrig 79 % av veckan som annars skulle faktureras till halva priset. Gratis bana kommer från leverantörer som finansierar den, och den listan finns på getaiperks.com.


Hur man minskar en DeepSeek-V4-Pro-faktura, i ordning efter inverkan

Hävstång 1: Finansiera de dyra nivåerna någon annanstans. DeepSeek ger inga krediter, så använd getaiperks.com för att täcka premium-leverantörerna du dirigerar krävande uppgifter till, och låt DeepSeek hantera volymarbete.

Hävstång 2: Nedgradera varje uppgift som inte behöver flaggskeppet. På arbetsbelastningen ovan är V4-Pro till V4.1-Flash 3,6 gånger billigare med identiska inställningar. Inget annat här kommer i närheten.

Hävstång 3: Granska ditt schema för oavsiktlig användning under rusningstid. Rusningstid är 35 timmar i veckan, så kontrollera att ingen cron-jobb hamnade mellan 01:00 och 04:00 eller 06:00 och 10:00 UTC på en vardag.

Hävstång 4: Stabilisera din prompt-prefix. Cache-träffar kräver en identisk ledande prefix, så lägg det flyktiga innehållet sist. Det är där 30x på V4-Pro och 50x på Flash finns.

Hävstång 5: Angrip svarslängden. Efter de fyra ovanstående utgör output ungefär två tredjedelar av fakturan och är det största kvarvarande.


Bästa AI-krediter för startups

Ansök direkt via dessa verifierade program.

Vanliga frågor

Hur mycket kostar DeepSeek-V4-Pro per miljon tokens?

Cache-miss input kostar 0,66 USD utanför rusningstid och 1,32 USD under rusningstid. Output kostar 1,98 USD utanför rusningstid och 3,96 USD under rusningstid. En cache-träff kostar 0,022 USD utanför rusningstid och 0,044 USD under rusningstid. Rusningstid är 01:00 till 04:00 och 06:00 till 10:00 UTC på vardagar.

Vilka är DeepSeeks rusningstider och hur stor del av veckan är de?

Rusningstid är 01:00 till 04:00 och 06:00 till 10:00 UTC, måndag till fredag. Det är 7 timmar en veckodag, 35 av 168 i en vecka, eller cirka 21 %. Återstående 79 %, inklusive hela helgen, faktureras till hälften av rusningstidspriset.

Är DeepSeek-V4-Pro värt det jämfört med V4.1-Flash?

Endast för arbete som verkligen behöver flaggskeppet. V4-Pro kostar 4,4 gånger mer på cache-miss input, 3,3 gånger mer på output, och cirka 3,6 gånger mer på en blandad månatlig arbetsbelastning. Dirigera efter uppgiftens svårighetsgrad först, optimera sedan schemat.

Ger DeepSeek gratis krediter för V4-Pro?

Nej. DeepSeek chattapp är gratis, men den officiella prissidan anger ingen gratis API-nivå och det finns inget program för startkrediter. Rapporter om gratis krediter för nya API-konton är obekräftade. För verklig gratis bana spårar AI Perks 7,7 miljoner USD hos 194 företag.

Vidarebefordrar tredjeparts-värdar DeepSeek priser utanför rusningstid?

Generellt nej. Tidsbaserad prissättning är en förstapartsmekanism, och värdar sätter sina egna priser. Baseten rapporteras lista DeepSeek V4.1 Flash input till 0,30 USD per miljon, vilket skulle motsvara DeepSeeks pris under rusningstid som debiteras hela dagen, även om det inte är bekräftat här. Verifiera det aktuella priset med värden innan du binder dig.

Vad hände med slutpunktsnamnet deepseek-v4-flash?

DeepSeek-V4.1-Flash pensionerade modellnamnen deepseek-v4-flash och deepseek-v4-flash-vision-exp, och förfrågningar dirigeras nu till den aktuella Flash-modellen till Flash-prissättning. Kod skriven mot de gamla identifierarna behöver uppdateras, så fäst den aktuella modellsträngen snarare än att förlita dig på alias.


Prenumerera på getaiperks.com →

DeepSeek prissätter lågt och finansierar inget. Leverantörerna som finansierar dig finns på getaiperks.com.

AI Perks

AI Perks ger tillgång till exklusiva rabatter, krediter och erbjudanden på AI-verktyg, molntjänster och API:er för att hjälpa startups och utvecklare att spara pengar.

AI Perks Cards

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.