DeepSeek Kontext-cachelagring 2026: 30x rabatt på indata

DeepSeek tar 30 gånger mindre betalt för cachelagrad input än för en cachemiss och halverar varje pris utanför rusningstid. V4-Pro- och V4.1-Flash-priserna, förklarade ordentligt.

DeepSeekContext CachingLLM PricingAI API CostsAI Perks
Author Avatar
Andrew
AI Perks Team
12,235

Quick Answer

En cacheträff på DeepSeek-V4-Pro kostar 0,022 USD per miljon inmatningstoken utanför rusningstid, jämfört med 0,66 USD för en cachemiss, en rabatt på 30 gånger för samma modell. DeepSeek halverar även alla priser utanför rusningstid, så en cachad token utanför rusningstid blir 60 gånger billigare än en cachemiss under rusningstid. Kredit från leverantörer som har startup-program spåras på getaiperks.com.

AI Perks

AI Perks ger tillgång till exklusiva rabatter, krediter och erbjudanden på AI-verktyg, molntjänster och API:er för att hjälpa startups och utvecklare att spara pengar.

AI Perks Cards

Vad en DeepSeek Cache Hit Faktiskt Kostar

På DeepSeek-V4-Pro kostar en inmatningstoken som serveras från cachen 0,022 USD per miljon utanför rusningstid jämfört med 0,66 USD för en cachemiss. Det är en 30x rabatt för att skicka samma prefix två gånger.

De flesta prissidor anger ett inmatningsnummer och går vidare. DeepSeek har fyra, eftersom två separata multiplikatorer gäller för varje enskilt anrop: om prefixet träffade cachen och vilken tid på dygnet du skickade det.

Modell och fönsterInmatning vid cacheträffInmatning vid cachemissUtmatning
DeepSeek-V4-Pro-0813, utanför rusningstid0,022 USD0,66 USD1,98 USD
DeepSeek-V4-Pro-0813, rusningstid0,044 USD1,32 USD3,96 USD
DeepSeek-V4.1-Flash, utanför rusningstid0,003 USD0,15 USDej verifierat
DeepSeek-V4.1-Flash, rusningstid0,006 USD0,30 USDej verifierat

Alla siffror i USD per miljon tokens, från den officiella API-dokumentationen från september 2026. Utmatningspriserna för V4.1-Flash är inte verifierade här, så kontrollera den officiella sidan innan du budgeterar för den.

Flash-kvoten är ännu större än flaggskeppets: 0,003 USD jämfört med 0,15 USD är en 50x skillnad (härledd från priserna ovan). AI Perks följer den här typen av leverantörsmekanismer tillsammans med de kreditprogram som kompenserar för dem.


Bästa AI-krediter för startups

Ansök direkt via dessa verifierade program.

Rusningstid och Utanför Rusningstid: Den Enda Leverantören som Prissätter per Klockslag

DeepSeek rusningstider är 01:00-04:00 och 06:00-10:00 UTC på vardagar. Allt annat, inklusive hela lördagar och söndagar, debiteras till exakt halva priset.

Ingen annan stor modellleverantör prissätter efter tid på dygnet, vilket gör det till den mest förbisedda hävstången i LLM-kostnadsarbete. Ingen optimeringsguide skriven för OpenAI eller Anthropic har någon anledning att nämna det.

Härlett från dessa tider: rusningstid är 7 timmar om dagen över 5 vardagar, alltså 35 av veckans 168 timmar. Ungefär 79% av kalendern är redan utanför rusningstid, så de flesta team får rabatten av misstag och kan få mer av den medvetet.

Var du befinner dig avgör hur mycket av din arbetsdag som är exponerad:

TeamplatsRusningstider, lokal tidAffärsdags-exponering
US Eastern (UTC-4)21:00-00:00, 02:00-06:00Ingen, hela arbetsdagen är utanför rusningstid
US Pacific (UTC-7)18:00-21:00, 23:00-03:00Ingen
Centraleuropa (UTC+2)03:00-06:00, 08:00-12:00Hela förmiddagen
Indien (UTC+5:30)06:30-09:30, 11:30-15:30Större delen av arbetsdagen
Kina (UTC+8)09:00-12:00, 14:00-18:00Nästan hela

Lokala tider konverteras från de publicerade UTC-tiderna med de angivna förskjutningarna, och sommartid flyttar dem med en timme. Mönstret är ingen slump: rusningstiderna motsvarar den kinesiska arbetsdagen, så ett amerikanskt teams interaktiva trafik hamnar gratis i den billiga halvan av dygnet.


Stapla Båda Rabatter: En 60x Spridning på En Modell

En cachad inmatningstoken utanför rusningstid för 0,022 USD jämfört med en miss i rusningstid för 1,32 USD är en 60x spridning på identisk utmatning från samma modell.

Här är hur det ser ut på en realistisk agentarbetsbelastning: en kontext på 200 000 tokens som skickas om 1 000 gånger om dagen, alltså 200 miljoner inmatningstokens dagligen på V4-Pro.

ScenarioPris per 1MDaglig inmatningskostnad
Rusningstid, varje anrop en cachemiss1,32 USD264,00 USD
Utanför rusningstid, varje anrop en cachemiss0,66 USD132,00 USD
Rusningstid, varje anrop en cacheträff0,044 USD8,80 USD
Utanför rusningstid, varje anrop en cacheträff0,022 USD4,40 USD

Alla fyra rader härleds genom att multiplicera de publicerade priserna med 200. Skillnaden mellan den översta raden och den nedersta är ungefär 260 USD per dag, eller ungefär 95 000 USD per år, på en arbetsbelastning som inte förändras alls.

Två saker följer som de flesta kostnadsbeskrivningar missar:

En cachad flaggskeppmodell är billigare än en okächad liten modell. V4-Pro cachad inmatning till 0,022 USD utanför rusningstid är cirka 7 gånger billigare än V4.1-Flash okächad inmatning till 0,15 USD (härledd). Att nedgradera modellen för att spara pengar är fel drag om det verkliga problemet är en cache som du aldrig har värmt upp.

Utmatning cachas aldrig. För 1,98 USD utanför rusningstid kostar en utmatningstoken ungefär 90 gånger en cachad inmatningstoken (härledd). När cachning fungerar har du inte längre en inmatningsräkning, du har en utmatningsräkning, och varje ytterligare besparing kommer från kortare svar eller begränsade tankebudgetar. Team som finansierar den utmatningsräkningen med leverantörskrediter kan jämföra vad som finns tillgängligt på getaiperks.com.


Bästa AI-krediter för startups

Ansök direkt via dessa verifierade program.

Vad som Har Ändrats Sedan Vår Tidigare DeepSeek Prisguide

Tre saker hände 2026: V4-Pro-0813 nådde allmän tillgänglighet den 13 augusti, prissättning för rusningstid och utanför rusningstid ersatte fasta priser i mitten av augusti, och V4.1-Flash lanserades runt den 10 september.

Vår tidigare DeepSeek prissida anger fasta priser per token utan någon tidsfaktor. Dessa föregår ändringen och bör läsas som historik.

Tidslinjen, med ärligt markerad konfidens:

  • 24 april 2026 (medelhög konfidens): V4-Pro och V4-Flash förhandsvisning, med ett kontextfönster på 1 miljon tokens, upp till 384K utmatningstokens, och växlingsbara tanke- och icke-tankelägen.
  • 31 juli 2026 (medelhög konfidens): DeepSeek-V4-Flash-0731, den stabila Flash-versionen. Senaste kända priset före ändringen var 0,14 USD per miljon cachemiss-inmatning och 0,28 USD per miljon utmatning, båda fasta. Endast historiskt.
  • 13 augusti 2026: DeepSeek-V4-Pro-0813 allmän tillgänglighet, den nuvarande flaggskeppsmodellen för resonemang och agenter.
  • Runt 10 september 2026: DeepSeek-V4.1-Flash, listad i dokumentationen som "DeepSeek-Flash".

Om du arbetar utifrån en handledning eller en kostnadsmodell skriven före augusti 2026, är varje inmatningssiffra i den felaktig i båda riktningarna: för hög för en cacheträff, för låg för en cachemiss under rusningstid.


Ändringen av Slutpunktsnamn som Bryter Gammal Kod

DeepSeek-V4.1-Flash drog tyst tillbaka modellnamnen deepseek-v4-flash och deepseek-v4-flash-vision-exp. Förfrågningar som fortfarande använder dessa strängar kommer att misslyckas.

Detta är den typ av ändring som dyker upp som en produktionsincident snarare än en migrationsbiljett, eftersom modellnamnet oftast ligger i en konfigurationsfil som ingen har öppnat på månader. Äldre kodexempel, SDK-omslag och tredjepartshandledningar refererar fortfarande till de borttagna namnen.

Värt att göra före din nästa driftsättning:

  • Genomsök hela kodbasen efter båda de borttagna strängarna, inklusive infrastrukturkonfiguration och notebooks.
  • Kontrollera eventuella SDK:er eller agentramverk som hårdkodar en standard DeepSeek-modell.
  • Bekräfta visionsvägen separat, eftersom den experimentella visionsslutpunkten också har bytt namn.
  • Kör om din kostnadsmodell efteråt, eftersom ersättningen följer den nya schemat för rusningstid och utanför rusningstid.

Bästa AI-krediter för startups

Ansök direkt via dessa verifierade program.

DeepSeek Gratisnivå och Krediter: Vad Som Verkligen Stämmer

DeepSeek chattapp är gratis att använda. API:et är det inte, och det finns ingen angiven gratisnivå på den officiella prissidan.

Det är här de flesta artiklar har fel. Påståenden om att nya API-konton får gratis krediter cirkulerar brett, rapporteras inkonsekvent och bekräftas inte på den officiella prissidan. Om du behöver en startbalans, anta att du betalar för den.

Viktigare för grundare: DeepSeek driver inget dedikerat start-kreditprogram. Det finns ingen ansökan, ingen stegbaserad nivå, ingen partnerbana. Låga priser per token är hela erbjudandet, vilket är ett verkligt gap om du bygger en kreditstack.

Det gapet är exakt anledningen till att routningsbeslutet spelar roll. Många leverantörer har startprogram, och AI Perks spårar 7,7 miljoner USD i krediter över 194 företag som täcker dem som gör det. Det praktiska mönstret är att dirigera trafik med hög volym och cache-vänlig trafik till DeepSeek för 0,022 USD per miljon och spendera beviljade krediter på de dyrare leverantörerna, där en gratis token är värd mycket mer.


Köpa DeepSeek Från Någon Annan

Tredjeparts-värdar replikerar inte DeepSeek:s schema för rusningstid och utanför rusningstid, vilket innebär att de kan underbjuda det förstapart-API:et under rusningstid och förlora stort mot det utanför rusningstid.

Baseten listar DeepSeek V4.1 Flash-inmatning till 0,30 USD per miljon (medelhög konfidens, verifiera innan du budgeterar för det), och utmatningssiffran kunde inte verifieras på ett tillförlitligt sätt. Baseten erbjuder också en stående 30 USD nyarbetsytans provkredit.

Lägg märke till vad 0,30 USD motsvarar: det är exakt DeepSeek:s eget pris för cachemiss under rusningstid, och dubbla priset utanför rusningstid (härledd). För ett amerikanskt eller europeiskt team vars trafik mestadels hamnar utanför rusningstid ändå, är ett fast tredjepartspris inte uppenbart en besparing.

OpenRouter, Together och Fireworks hostar också DeepSeek-modeller. Vi anger inte deras priser här eftersom vi inte har verifierat dem, och det borde inte heller något annat du läser. Den kvalitativa avvägningen är dock konsekvent:

  • Förstapart-API: den enda platsen där hela stacken av cacheträff och utanför rusningstid gäller, och den billigaste vägen med stor marginal när båda triggas.
  • Tredjeparts-värdar: fasta priser, olika regioner, enhetlig fakturering, och oftast ingen exponering för DeepSeek:s cacheträff-nivå.
  • Aggregatorer: användbara för redundans, till en premie som du bör mäta snarare än anta.

Prissätt din egen trafik mot båda, jämför sedan resultatet med de krediter som finns tillgängliga hos andra leverantörer på getaiperks.com. En gratis token är bättre än en billig.


Bästa AI-krediter för startups

Ansök direkt via dessa verifierade program.

Vanliga Frågor

Hur mycket billigare är en DeepSeek cachehit?

På DeepSeek-V4-Pro är en cachehit 0,022 USD per miljon inmatningstokens utanför rusningstid jämfört med 0,66 USD för en cachemiss, en 30x skillnad. På V4.1-Flash är skillnaden ännu större, 0,003 USD jämfört med 0,15 USD, en 50x skillnad (härledd). Priserna är från den officiella API-dokumentationen från september 2026.

När är DeepSeek rusningstider?

Rusningstid är 01:00-04:00 och 06:00-10:00 UTC endast på vardagar. Allt annat, inklusive båda helgdagarna, debiteras till halva rusningstidspriset. Det blir ungefär 79% av veckan som är utanför rusningstid (härledd), så team baserade i USA får rabatten under hela sin arbetsdag utan att ändra något.

Har DeepSeek en gratis API-nivå?

Ingen gratis API-nivå anges på den officiella prissidan. Konsumentchattappen är gratis, men API:et betalas från den första token. Rapporter om gratis krediter för nya konton är inkonsekventa och obekräftade. Leverantörer som beviljar krediter spåras på getaiperks.com.

Erbjuder DeepSeek startkrediter?

DeepSeek har inget dedikerat start-kreditprogram. Låga priser per token är hela erbjudandet. För grundare som bygger en kreditstack är det ett gap som är värt att fylla någon annanstans: AI Perks täcker 7,7 miljoner USD i krediter över 194 företag från de leverantörer som har program.

Varför slutade mitt DeepSeek API-anrop att fungera?

Den mest sannolika orsaken är modellnamnet. DeepSeek-V4.1-Flash drog tillbaka slutpunktsnamnen deepseek-v4-flash och deepseek-v4-flash-vision-exp, och äldre handledningar och konfigurationsfiler refererar fortfarande till dem. Genomsök ditt arkiv efter båda strängarna, inklusive tredjeparts-SDK:er och notebooks, och kontrollera sedan din kostnadsmodell mot aktuella priser.

Ska jag använda DeepSeek V4-Pro eller V4.1-Flash?

Kör matematiken innan du antar att Flash är billigare. V4-Pro cachad inmatning till 0,022 USD utanför rusningstid är ungefär 7 gånger billigare än Flash okächad inmatning till 0,15 USD (härledd), så en väl-cachad flaggskeppmodell kan helt och hållet slå en okächad liten modell på inmatningsraden. Utmatningsvolym, inte modellstorlek, avgör oftast räkningen.


Prenumerera på getaiperks.com →

Cachea prefixet, skicka utanför rusningstid och låt någon annans krediter täcka resten.

AI Perks

AI Perks ger tillgång till exklusiva rabatter, krediter och erbjudanden på AI-verktyg, molntjänster och API:er för att hjälpa startups och utvecklare att spara pengar.

AI Perks Cards

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.