DeepSeek Priser uden for spidsbelastning: Halvér din API-regning

DeepSeek opkræver halv pris uden for spidsbelastningstimer, kl. 01:00-04:00 og 06:00-10:00 UTC på hverdage. Vinduerne, cache-multiplikatoren, og hvad det virkelig sparer.

DeepSeekDeepSeek PricingOff-Peak PricingLLM API CostsAI Perks
Author Avatar
Andrew
AI Perks Team
10,991

Quick Answer

DeepSeek opkræver halv pris uden for spidsbelastningstider. Spidsbelastning er 01:00 til 04:00 og 06:00 til 10:00 UTC på hverdage, og baseret på disse tidsvinduer ligger omkring 79% af ugen på lavpristaksten. Læg dertil prompt-caching, hvilket er cirka 30 gange billigere end et cache miss på V4-Pro, og denne artikel udleder en 74% reduktion på en prøve-V4-Pro-regning. Kreditprogrammer fra udbydere, der driver en, spores på getaiperks.com.

AI Perks

AI Perks giver adgang til eksklusive rabatter, kreditter og tilbud på AI-værktøjer, cloud-tjenester og API'er for at hjælpe startups og udviklere med at spare penge.

AI Perks Cards

Hvor meget sparer DeepSeek's priser uden for spidsbelastningsperioder?

DeepSeek er den eneste store modeludbyder, der opkræver betaling efter tidspunkt på dagen. Spidsbelastningstider er fra 01:00 til 04:00 og 06:00 til 10:00 UTC på hverdage, og alt uden for disse tidsrum koster præcis det halve.

Det er syv spidsbelastningstimer per hverdag, 35 timer ud af de 168 på en uge. Omkring 79% af kalenderen er allerede uden for spidsbelastning (afledt af de offentliggjorte tidsrum). De fleste teams betaler fuld pris på en brøkdel af deres trafik og bemærker aldrig, at de gør det.

Rabatten er ikke en kampagne eller et niveau for forpligtet brug. Den anvendes automatisk baseret på klokkeslættet, når anmodningen modtages. AI Perks sporer udbydernes priser og kreditprogrammer på tværs af 194 virksomheder, og dette er den enkeltstående mest oversete omkostningsfaktor for nogen af dem.


Top AI-kompetencer til startups

Ansøg direkte gennem disse verificerede programmer.

Hvornår er DeepSeek's spidsbelastningstider i din tidszone?

Spidsbelastningsvinduerne er faste i UTC, så hvor de lander i din arbejdsdag, afhænger helt af, hvor du befinder dig. For nordamerikanske teams er hele arbejdsdagen allerede uden for spidsbelastning.

Konverteret fra de offentliggjorte UTC-vinduer:

PlaceringSpidsbelastningsvindue 1Spidsbelastningsvindue 2
UTC01:00-04:0006:00-10:00
Kina (UTC+8)09:00-12:0014:00-18:00
Indien (UTC+5:30)06:30-09:3011:30-15:30
Centraleuropa (UTC+2)03:00-06:0008:00-12:00
Storbritannien (UTC+1)02:00-05:0007:00-11:00
USA Øst (UTC-4)21:00-00:0002:00-06:00
USA Pacific (UTC-7)18:00-21:0023:00-03:00

Kinas kolonne forklarer hele designet. Begge spidsbelastningsvinduer falder inden for den kinesiske arbejdsdag, morgen og eftermiddag, med frokostpausen placeret uden for spidsbelastning imellem dem. Spidsbelastningspriser er priser for overbelastning på DeepSeek's hjemmemarked.

To praktiske konsekvenser:

Hvis du er i USA, er du sandsynligvis allerede uden for spidsbelastning ved et uheld. Din trafik fra kl. 9-17 falder uden for begge vinduer. Det, der fanger dig, er den natlige cron-job, hvilket er præcis, når spidsbelastningen starter.

Hvis du er i Europa, er din morgen dyr, og din eftermiddag er halv pris. Det lokale vindue fra 08:00 til 12:00 dækker den travleste del af en europæisk arbejdsdag.

Vinduerne er faste i UTC, så lokale tider skifter med sommertid, og en søndag aften i Amerika kan falde inden for mandagens første spidsbelastningsvindue.


Cache-multiplikatoren, der lægges ovenpå

Uden for spidsbelastning halverer din regning. Et cache-hit reducerer inputomkostningerne med ca. 30 gange. De to multipliceres, og tilsammen udgør de næsten hele forskellen i, hvad forskellige teams betaler DeepSeek for identisk arbejde.

Nuværende offentliggjorte priser, i USD pr. million tokens:

ModelToken-typeUden for spidsbelastningSpidsbelastning
DeepSeek-V4-Pro-0813Input, cache-hit$0,022$0,044
DeepSeek-V4-Pro-0813Input, cache-miss$0,66$1,32
DeepSeek-V4-Pro-0813Output$1,98$3,96
DeepSeek-V4.1-FlashInput, cache-hit$0,003$0,006
DeepSeek-V4.1-FlashInput, cache-miss$0,15$0,30

En cachet input-token uden for spidsbelastning på $0,022 mod en peak cache-miss på $1,32 er en 60 gange forskel på den samme model. Intet ved anmodningen ændrede sig undtagen hvornår den blev kørt, og om præfikset allerede var til stede.

Her er, hvordan det ser ud på en reel månedlig arbejdsbyrde på 50 mio. input- og 10 mio. output-tokens på V4-Pro (aritmetik afledt af tabellen ovenfor):

KonfigurationInputOutputMånedlig total
Spidsbelastning, ingen caching$66,00$39,60$105,60
Spidsbelastning, 80% cache-hits$14,96$39,60$54,56
Uden for spidsbelastning, ingen caching$33,00$19,80$52,80
Uden for spidsbelastning, 80% cache-hits$7,48$19,80$27,28

Det er en reduktion på 74% for de samme tokens og den samme model. De midterste to rækker afgør, hvilken faktor der skal trækkes først: at flytte uret alene ($52,80) slår caching alene ($54,56), og det er én linje i cron-konfigurationen snarere end en prompt-refaktorering.

Bemærk derefter detaljen, næsten ingen peger på: ved $27,28 udgør output-tokens $19,80 af regningen, ca. 73%. Når du cache og skifter til uden for spidsbelastning, stopper DeepSeek med at være et input-omkostningsproblem og bliver et problem med output-længde. At trimme verbose svar er derefter mere værd end enhver yderligere prompt-optimering.


Top AI-kompetencer til startups

Ansøg direkte gennem disse verificerede programmer.

Hvad der ændrede sig siden den sidste DeepSeek prisguide

DeepSeek-V4-Pro-0813 blev generelt tilgængelig den 13. august 2026, og tidsbaseret prissætning blev indført den 16. august 2026. Enhver DeepSeek-omkostningsguide skrevet før disse datoer beskriver en prismodel, der ikke længere eksisterer.

Den tidslinje, der betyder noget:

  • 24. april 2026: V4-Pro og V4-Flash preview, med et 1M token kontekstvindue, op til 384K output, og skiftbare tænke- og ikke-tænke-tilstande (pålidelighed: medium).
  • 31. juli 2026: DeepSeek-V4-Flash-0731, den stabile Flash-udgivelse. Sidste kendte pris før ændringen var $0,14 pr. million cache-miss input-tokens og $0,28 pr. million output (pålidelighed: medium, kun historisk).
  • 13. august 2026: V4-Pro-0813 generel tilgængelighed.
  • 16. august 2026: peak og off-peak pricing træder i kraft.
  • Omkring 10. september 2026: DeepSeek-V4.1-Flash, live i dokumenterne som DeepSeek-Flash.

Sammenlign den gamle flade Flash input-pris på $0,14 med den nye $0,15 uden for spidsbelastning og $0,30 ved spidsbelastning. Augustændringen var ikke et prisfald, det var en prissplit. Kør Flash uden for spidsbelastning, og du betaler omtrent det, du altid har gjort. Kør den inden for et spidsbelastningsvindue, og du betaler cirka det dobbelte af den gamle rate. Teams, der aldrig kiggede på uret, accepterede stille og roligt en prisstigning.


Brudændringen i DeepSeek V4.1-Flash

DeepSeek-V4.1-Flash afskaffede endpoint-navnene deepseek-v4-flash og deepseek-v4-flash-vision-exp. Kode skrevet imod dem fejler, og de fleste tutorials, der stadig offentliggøres online, refererer til dem.

Dette skete uden fanfare, hvilket er den værste form for brudændring: tutorials, Stack Overflow-svar og start-repositories, der rangerer godt for DeepSeek-forespørgsler, blev alle skrevet før det og er ikke blevet opdateret. Hvis du fejlfinder en integration, der virkede i sidste måned, skal du tjekke din modelstreng, før du tjekker noget andet.

Lektionen generaliseres: DeepSeek dokumenterer ændringer i API-dokumenterne i stedet for at annoncere dem, så fastgør modelidentifikatorer eksplicit og genlæs prissiden kvartalsvis.


Top AI-kompetencer til startups

Ansøg direkte gennem disse verificerede programmer.

Tilbyder DeepSeek gratis kreditter eller et startup-program?

DeepSeek chat-appen er gratis at bruge. Der er ingen angivet API gratis niveau på den officielle prisside, og DeepSeek kører intet dedikeret startup kreditprogram overhovedet.

Vær forsigtig med, hvad du læser andre steder her. Påstande om, at nye API-konti modtager gratis kreditter, rapporteres inkonsistent og ikke bekræftet på DeepSeek's officielle prisside. Masser af artikler gentager et tal alligevel. Betragt ethvert specifikt tal, du ser, som ubekræftet, indtil du har det direkte fra DeepSeek.

Denne fravær er den egentlige historie for stiftere. Næsten alle større udbydere kører nu en eller anden form for kreditprogram, og DeepSeek gør det ikke. Deres svar på omkostninger er lav listepris plus off-peak og cache-mekanikkerne ovenfor, hvilket er en genuint anderledes strategi, men det betyder, at der ikke er nogen gratis landingsbane at ansøge om.

Den praktiske handling er at betragte DeepSeek som dit billige altid-på niveau og finansiere de dyre niveauer med kreditter fra de udbydere, der kører programmer. AI Perks sporer 7,7 mio. dollars i kreditter på tværs af 194 virksomheder, hvilket er, hvor den landingsbane rent faktisk kommer fra.

Find de programmer, der giver kreditter, på getaiperks.com →

For tredjeparts-hosting lister Baseten DeepSeek V4.1 Flash input til $0,30 pr. million og tilbyder en stående $30 ny-workspace prøvekredit (verificer før budgettering). OpenRouter, Together og Fireworks hoster også DeepSeek-modeller. Deres priser ændrer sig ofte nok til, at routing-beslutningen bør træffes baseret på latenstid, region og pålidelighed, og derefter genprissættes i det øjeblik, du forpligter dig.


Sådan omstrukturerer du en arbejdsbyrde omkring timer uden for spidsbelastning

Trin 1: Finansier dit premium-niveau først. Start på getaiperks.com og indsaml kreditter for de udbydere, du sender tunge opgaver til, så DeepSeek kun håndterer volumenarbejdet.

Trin 2: Flyt alle batchjobs ud af spidsbelastningsvinduerne. Backfills, embeddingskørsler, evalueringsfejninger og natlige opsummeringer har ingen deadline. At flytte et cron-job to timer frem er en 50% rabat for én linje konfiguration.

Trin 3: Stabiliser din prompt-præfiks. Cache-hits afhænger af en identisk ledende præfiks, så placer de flygtige dele af din prompt sidst. Det er her, 30x'en bor.

Trin 4: Mål din faktiske cache-hitrate. De fleste teams antager, at caching virker, og har aldrig tjekket. Afstanden mellem en antaget 80% og en faktisk 30% er det meste af din regning.

Trin 5: Angrib output-længde. Når trin 2 og 3 er udført, dominerer output-tokens. Kortere svar er nu din største resterende faktor.


Top AI-kompetencer til startups

Ansøg direkte gennem disse verificerede programmer.

Ofte stillede spørgsmål

Hvad er DeepSeek's timer uden for spidsbelastning?

Uden for spidsbelastning er alt uden for 01:00 til 04:00 og 06:00 til 10:00 UTC på hverdage, hvilket udgør ca. 79% af ugen, inklusive hele lørdag og søndag. Forespørgsler uden for spidsbelastning koster præcis halvdelen af spidsbelastningsraten for både input- og output-tokens, anvendt automatisk uden behov for konfiguration.

Har DeepSeek en gratis API-niveau?

Nej. DeepSeek chat-appen er gratis at bruge, men der er ingen angivet API gratis niveau på den officielle prisside. Rapporter om gratis kreditter til nye API-konti er inkonsistente og ubekræftede. For faktiske gratis API-landingsbane, se programmerne sporet på AI Perks.

Hvor meget billigere er et DeepSeek cache-hit?

På DeepSeek-V4-Pro-0813 koster et cache-hit $0,022 pr. million input-tokens uden for spidsbelastning mod $0,66 for et cache-miss, hvilket er 30 gange billigere. Mod en peak cache-miss på $1,32 når forskellen 60x på den samme model for den samme anmodning.

Hvorfor stoppede mit DeepSeek API-kald med at virke?

DeepSeek-V4.1-Flash afskaffede endpoint-navnene deepseek-v4-flash og deepseek-v4-flash-vision-exp. Ældre tutorials og kodeprøver refererer stadig til dem og fejler nu. Tjek din model-identifikatorstreng først, da denne ændring blev rullet ud stille, og de fleste offentliggjorte vejledninger ikke er blevet opdateret. Fastgør det aktuelle navn eksplicit i din konfiguration.

Har DeepSeek et startup-kreditprogram?

Nej. DeepSeek kører intet dedikeret startup-kreditprogram, i modsætning til de fleste store modeludbydere. Deres omkostningsstrategi er lav listepris plus rabatterne uden for spidsbelastning og caching i stedet. For udbydere, der tilbyder startup-kreditter, sporer AI Perks 7,7 mio. dollars på tværs af 194 virksomheder.

Skal jeg køre DeepSeek via OpenRouter eller direkte?

Direkte adgang er hvor prissætningen uden for spidsbelastning og caching gælder som offentliggjort. Forhandlere sætter deres egne priser og giver måske ikke tidsbaseret rabat videre. Baseten, OpenRouter, Together og Fireworks hoster alle DeepSeek-modeller, så sammenlign baseret på latenstid og region, og verificer derefter den aktuelle pris, før du forpligter dig.


Abonner på getaiperks.com →

DeepSeek vil ikke give dig kreditter. Masser af andre vil, og de er alle på getaiperks.com.

AI Perks

AI Perks giver adgang til eksklusive rabatter, kreditter og tilbud på AI-værktøjer, cloud-tjenester og API'er for at hjælpe startups og udviklere med at spare penge.

AI Perks Cards

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.