DeepSeek prissättning för kodning 2026: Off-peak och cachekostnader

DeepSeek är den enda stora modellleverantören som prissätter efter tid på dygnet. Topp- och lågtrafikpriser, kostnadseffektivitet för cache-träffar för kodningsagenter och vad som ändrades i V4.

DeepSeekDeepSeek V4LLM PricingAI Coding ToolsFree AI Credits
Author Avatar
Andrew
AI Perks Team
8,765

Quick Answer

DeepSeek-V4-Pro kostar 0,66 USD per miljon cache-missade input-tokens och 1,98 USD per miljon output-tokens under lågtrafik, och exakt dubbelt så mycket under högtrafik. Cachelagrad input sjunker till 0,022 USD per miljon. DeepSeek har inget program för startkrediter, så grundare samlar krediter från de leverantörer som har det på getaiperks.com.

AI Perks

AI Perks ger tillgång till exklusiva rabatter, krediter och erbjudanden på AI-verktyg, molntjänster och API:er för att hjälpa startups och utvecklare att spara pengar.

AI Perks Cards

Vad kostar DeepSeek för kodningsarbete 2026?

DeepSeek-V4-Pro-0813 kostar 0,66 USD per miljon input-tokens med cache-miss utanför rusningstid och 1,98 USD per miljon output-tokens utanför rusningstid, och exakt dubbelt så mycket båda siffrorna under rusningstid. Cachade input sjunker till 0,022 USD per miljon utanför rusningstid, vilket är där de verkliga pengarna finns.

DeepSeek är den enda stora modellleverantören som tar betalt baserat på tid på dygnet. Två multiplikatorer staplas och tillsammans är de hela förklaringen till vad DeepSeek faktiskt kostar: utanför rusningstid halveras räkningen, och en cache-träff är ungefär 30 gånger billigare än en cache-miss.

Den kombinationen är viktigast för kodning. En agent-baserad kodningsloop spelar upp samma kodbaskontext vid varje tur, så det är den enda arbetsbelastningen där höga cache-träfffrekvenser är mer strukturella än slumpmässiga.

DeepSeek själva erbjuder inget startkreditprogram. Leverantörerna som gör det spåras på AI Perks, tillsammans med 7,7 miljoner USD i krediter över 194 företag.


Bästa AI-krediter för startups

Ansök direkt via dessa verifierade program.

Prissättning under rusningstid och utanför rusningstid: Mekaniken som ingen förklarar

DeepSeek:s rusningstid är 01:00 till 04:00 och 06:00 till 10:00 UTC på vardagar. Allt annat, inklusive hela lördagar och söndagar, är utanför rusningstid till halva priset.

Aktuell listpris, per miljon tokens:

ModellInput, cache-träffInput, cache-missOutput
DeepSeek-V4-Pro-0813, utanför rusningstid0,022 USD0,66 USD1,98 USD
DeepSeek-V4-Pro-0813, rusningstid0,044 USD1,32 USD3,96 USD
DeepSeek-V4.1-Flash, utanför rusningstid0,003 USD0,15 USDej publicerat
DeepSeek-V4.1-Flash, rusningstid0,006 USD0,30 USDej publicerat

Två saker följer av dessa tidsfönster som nästan ingen uttalar högt. Båda är härledda aritmetiska beräkningar från det publicerade UTC-schemat, inte citerade siffror.

Rusningstid är bara cirka 21% av veckan. Sju rusningstimmar per vardag är 35 timmar av 168. Strax under 80% av all klocktid är redan utanför rusningstid innan du ändrar något.

En hel amerikansk arbetsdag tangerar aldrig rusningstid. 9:00 till 17:00 Pacific är 16:00 till 24:00 UTC. 9:00 till 17:00 Eastern är 13:00 till 21:00 UTC. Ingen av dessa fönster överlappar ett rusningstidsblock, så team baserade i USA betalar halva priset av misstag. Europeiska morgnar är undantaget: 08:00 till 10:00 UTC är rusningstid, vilket är 9:00 till 11:00 i London och 10:00 till 12:00 i Berlin.

Det finns också en två timmars lucka utanför rusningstid mellan de två rusningstidsblocken, 04:00 till 06:00 UTC, vilket är en gratis parkeringsplats för nattliga CI-jobb och batch-refaktoreringar.


Varför cache-träffar är viktigare för kodning än för chatt

En cache-träff på DeepSeek-V4-Pro kostar 0,022 USD per miljon tokens utanför rusningstid jämfört med 0,66 USD för en miss, en 30x skillnad, och kodningsagenter genererar de högsta naturliga träfffrekvenserna av alla arbetsbelastningar.

Chattrafik är en ström av orelaterade korta prompter, så det mesta av input är nytt. En kodningsagent är motsatsen: den bär samma filträd, samma systemprompt och samma senaste diff genom varje tur i en lång session.

Här är vad de två multiplikatorerna gör med ett identiskt arbetsmoment. Illustrativa volymer, aritmetik härledd från listpriserna ovan:

En agentkörning: 2M input, 200K outputKostnad
Utanför rusningstid, 90% cache-träfffrekvens0,57 USD
Rusningstid, 90% cache-träfffrekvens1,14 USD
Utanför rusningstid, ingen cachning1,72 USD
Rusningstid, ingen cachning3,43 USD

Samma tokens, samma modell, samma output. En 6x spridning på identiskt arbete, helt avgjort av klocktid och cache-disciplin.

Om man pressar det till det extrema vidgas gapet ytterligare: en cachad input-token utanför rusningstid för 0,022 USD per miljon mot en input-token under rusningstid med cache-miss för 1,32 USD per miljon är en 60x spridning på samma modell. Ingen annan leverantör har en sådan hävstång, vilket också är anledningen till att så få handledningar nämner den.

Vid tusen agentkörningar per månad ger samma härledda aritmetik ungefär 570 USD mot ungefär 3 430 USD. För ett team som också betalar för Claude eller GPT för de svåra uppgifterna, täcker AI Perks kreditsidan av den räkningen.


Bästa AI-krediter för startups

Ansök direkt via dessa verifierade program.

Vad som har förändrats i DeepSeek sedan V4 lanserades

Fyra releaser på fem månader flyttade DeepSeek från en fast per-token-pris till en tid-på-dygnet-pris, och de flesta publicerade guider citerar fortfarande de gamla fasta siffrorna.

Sekvensen, med konfidens angiven där det är lämpligt:

  • 24 april 2026: DeepSeek V4-Pro och V4-Flash förhandsvisning. 1M-tokens kontext, upp till 384K output-tokens, omkopplingsbart tänkande och icke-tänkande lägen. (Konfidens: medium.)
  • 31 juli 2026: DeepSeek-V4-Flash-0731, den stabila Flash-releasen. Prissättningen vid den tidpunkten var 0,14 USD per miljon input-tokens med cache-miss och 0,28 USD per miljon output-tokens. (Endast historisk kontext, inte aktuell prissättning.)
  • 13 augusti 2026: DeepSeek-V4-Pro-0813 blir allmänt tillgänglig som flaggskeppsmodellen för resonemang och agenter.
  • 16 augusti 2026: spliten mellan rusningstid och utanför rusningstid anländer och den fasta prissättningen upphör.
  • Omkring 10 september 2026: DeepSeek-V4.1-Flash, live i dokumentationen som "DeepSeek-Flash".

Om du läser en kostnadsjämförelse för DeepSeek som visar ett enda input-pris och ett enda output-pris utan omnämnande av UTC-tider, föregår den 16 augusti 2026 och dess slutsatser är felaktiga i båda riktningarna.


Ändringen av slutpunktsnamn som bryter gammal kod

DeepSeek-V4.1-Flash har tyst pensionerat modellnamnen deepseek-v4-flash och deepseek-v4-flash-vision-exp. Kod som fortfarande skickar dem kommer att misslyckas.

Detta är den typ av ändring som kan ställa till problem för ett team vid en olämplig tidpunkt, eftersom felet uppstår vid körning i den tjänst som kopplar strängen, inte vid byggtid. Äldre handledningar, Stack Overflow-svar och kopierade konfigurationsfiler innehåller fortfarande de pensionerade namnen.

Två praktiska konsekvenser. För det första, kör grep i ditt förråd efter båda strängarna före din nästa driftsättning, inte efteråt. För det andra, betrakta alla DeepSeek-handledningar publicerade före september 2026 som opålitliga vad gäller modellidentifierare såväl som priser.


Bästa AI-krediter för startups

Ansök direkt via dessa verifierade program.

Har DeepSeek en gratisnivå eller startkrediter?

DeepSeek chattapp är gratis att använda. Det finns ingen angiven API-gratisnivå på den officiella prissidan, och DeepSeek kör inget dedikerat startkreditprogram alls.

Var försiktig med de andra och tredje punkterna, eftersom det är här de flesta webbplatser får fel om DeepSeek. Påståenden om att nya API-konton får gratis krediter rapporteras inkonsekvent och är inte bekräftade på den officiella prissidan. Alla som citerar en specifik kreditfigur för nya konton upprepar något som DeepSeek inte har publicerat.

Avsaknaden av ett startprogram är det mer användbara faktumet. Låga per-token-priser är inte samma sak som ett bidrag, och en grundare som bara optimerar för listpris lämnar den större siffran på bordet:

RuttVad det faktiskt är
DeepSeek chattappGratis, ingen API-åtkomst
DeepSeek APIBetalt från första token, ingen angiven gratisnivå
DeepSeek startkrediterFinns inte
Andra stora modellleverantörerMånga kör dedikerade startkreditprogram

DeepSeek är det billigaste sättet att betala. Det är inte ett sätt att inte betala. Det är olika strategier och de starkaste teamen använder båda: DeepSeek för kodningsarbete med hög volym och cachning, beviljade krediter för spetsmodellerna ovanpå. AI Perks spårar vilka leverantörer som för närvarande finansierar den andra halvan.

Tredjeparts-värdar är en delvis lösning. Baseten listar DeepSeek V4.1 Flash input för 0,30 USD per miljon och har en stående rättegångskredit på 30 USD för nya arbetsytor (konfidens: medium, verifiera innan budgetering). OpenRouter, Together och Fireworks hostar också DeepSeek-modeller. Deras priser ändras ofta nog för att det ärliga rådet är att kontrollera dem själv på dagen istället för att lita på någon siffra i ett blogginlägg, inklusive detta.


Hur man minskar DeepSeek-kodningsräkningen

Steg 1: Täck spetsnivån med krediter. Kontrollera vilka leverantörer som för närvarande finansierar den nivån på getaiperks.com, så att DeepSeek bara hanterar volymarbetet.

Steg 2: Kontrollera vilken tidszon dina agenter faktiskt körs i. Om dina CI-, nattliga refaktoreringar eller batch-utvärderingsjobb körs mellan 01:00 och 04:00 eller 06:00 och 10:00 UTC, kommer att flytta dem några timmar att halvera den posten utan kodändringar.

Steg 3: Gör den cachade prefixet stabilt. Allt som ändrar ordning på din systemprompt, injicerar en tidsstämpel eller blandar filkontext förvandlar en token för 0,022 USD till en token för 0,66 USD.

Steg 4: Dela upp modellerna per jobb. V4-Pro för resonemang och agent-loopar, Flash för klassificering, linting och de billiga högfrekventa anropen runt dem.

Steg 5: Granska dina modellsträngar nu. De pensionerade Flash-slutpunktsnamnen är ett planerat driftstopp som väntar på den som driftsätter nästa gång.


Bästa AI-krediter för startups

Ansök direkt via dessa verifierade program.

Vanliga frågor

Hur mycket kostar DeepSeek för kodning?

DeepSeek-V4-Pro-0813 kostar 0,66 USD per miljon input-tokens med cache-miss och 1,98 USD per miljon output-tokens utanför rusningstid. Rusningstid kostar exakt dubbelt så mycket. Cachad input kostar 0,022 USD per miljon utanför rusningstid. Faktiska kodningsräkningar hamnar mellan dessa extremvärden beroende på cache-träfffrekvens och klocktid.

Vilka är DeepSeek:s rusnings- och utanför rusningstid?

Rusningstid är 01:00 till 04:00 och 06:00 till 10:00 UTC på vardagar. Allt annat, inklusive helger, är utanför rusningstid till halva priset. Härlett från dessa fönster, lämnar det ungefär 80% av veckan utanför rusningstid, och en standard amerikansk arbetsdag ligger helt utanför båda rusningsfönstren.

Erbjuder DeepSeek gratis API-krediter?

DeepSeek:s chattapp är gratis, men det finns ingen angiven API-gratisnivå på den officiella prissidan. Rapporter om gratis krediter för nya API-konton är inkonsekventa och obekräftade. DeepSeek kör heller inget startkreditprogram, till skillnad från de flesta stora leverantörer som spåras på AI Perks.

Varför slutade mitt DeepSeek API-anrop att fungera?

DeepSeek-V4.1-Flash pensionerade modellnamnen deepseek-v4-flash och deepseek-v4-flash-vision-exp. All kod, handledning eller konfiguration som fortfarande skickar dessa strängar kommer att misslyckas vid körning. Omdöpningen meddelades inte högt, så äldre exempel och kopierade konfigurationer innehåller fortfarande dem. Sök i ditt förråd efter båda strängarna och uppdatera dem till den nuvarande Flash-identifieraren.

Är DeepSeek billigare än Claude eller GPT för kodning?

På listpris, avsevärt, särskilt med en hög cache-träfffrekvens utanför rusningstid. På total kostnad, jämförelsen ändras när startkrediter är inblandade, eftersom DeepSeek inte ger några och många konkurrenter gör det. Kontrollera vad alternativen kommer att finansiera innan du antar på AI Perks.

Bör jag använda DeepSeek via OpenRouter eller Baseten istället?

Tredjeparts-värdar lägger till routingflexibilitet, fallback och ibland rättegångskredit, men de prissätter oberoende av DeepSeek:s schema för rusningstid och utanför rusningstid. Baseten har en stående rättegångskredit på 30 USD för nya arbetsytor. Verifiera alla hostade per-token-siffror på dagen, eftersom dessa priser ändras ofta.


Prenumerera på getaiperks.com →

DeepSeek är det billigaste sättet att betala. Krediter är sättet att inte betala.

AI Perks

AI Perks ger tillgång till exklusiva rabatter, krediter och erbjudanden på AI-verktyg, molntjänster och API:er för att hjälpa startups och utvecklare att spara pengar.

AI Perks Cards

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.