DeepSeek Kontekst-buffring 2026: 30x rabatt på input

DeepSeek tar 30 ganger mindre betalt for cachet input enn for en cache-feil, og halverer enhver pris utenom rushtid. V4-Pro og V4.1-Flash-priser, forklart skikkelig.

DeepSeekContext CachingLLM PricingAI API CostsAI Perks
Author Avatar
Andrew
AI Perks Team
14,897

Quick Answer

En cache-treff på DeepSeek-V4-Pro koster $0,022 per million input-tokens utenom rushtid, mot $0,66 for et cache-miss, en 30x rabatt på samme modell. DeepSeek halverer også alle priser utenom rushtid, så et cached token utenom rushtid er 60x billigere enn et cache-miss i rushtid. Credits fra leverandører som kjører oppstartsprogrammer, spores på getaiperks.com.

AI Perks

AI Perks gir tilgang til eksklusive rabatter, kreditter og tilbud på AI-verktøy, skytjenester og API-er for å hjelpe startups og utviklere med å spare penger.

AI Perks Cards

Hva en DeepSeek Cache Hit Faktisk Koster

På DeepSeek-V4-Pro koster et innputtoken servert fra hurtigbufferen 0,022 dollar per million utenom rushtid mot 0,66 dollar for en hurtigbuffer-feil. Det er 30 ganger rabatt for å sende samme prefiks to ganger.

De fleste prissider oppgir ett innputtnummer og går videre. DeepSeek har fire, fordi to separate multiplikatorer gjelder for hver eneste kall: om prefikset traff hurtigbufferen, og hva tid på dagen du sendte det.

Modell og vinduCache hit innputtCache miss innputtUtputt
DeepSeek-V4-Pro-0813, utenom rushtid$0.022$0.66$1.98
DeepSeek-V4-Pro-0813, rushtid$0.044$1.32$3.96
DeepSeek-V4.1-Flash, utenom rushtid$0.003$0.15ikke verifisert
DeepSeek-V4.1-Flash, rushtid$0.006$0.30ikke verifisert

Alle tall er USD per million tokens, fra de offisielle API-dokumentene per september 2026. V4.1-Flash utputt-priser er ikke verifisert her, så sjekk den offisielle siden før du budsjetterer med den.

Flash-forholdet er enda større enn for flaggskipet: 0,003 dollar mot 0,15 dollar er en 50x gap (utledet fra prisene ovenfor). AI Perks sporer denne typen leverandør-mekanikk sammen med kredittprogrammene som kompenserer for det.


Beste AI-ferdigheter for startups

Søk direkte via disse verifiserte programmene.

Rushtid og Utenom Rushtid: Den Eneste Leverandøren som Tar Betalt etter Klokken

DeepSeek rushtid er 01:00-04:00 og 06:00-10:00 UTC på hverdager. Alt annet, inkludert hele lørdag og søndag, faktureres til nøyaktig halv pris.

Ingen andre store modellleverandører priser etter tid på dagen, noe som gjør det til den mest oversette levempen i LLM-kostnadsarbeid. Ingen optimeringsguide skrevet for OpenAI eller Anthropic har noen grunn til å nevne det.

Utledet fra disse vinduene: rushtid er 7 timer om dagen over 5 hverdager, altså 35 av ukens 168 timer. Omtrent 79 % av kalenderen er allerede utenom rushtid, så de fleste team får rabatten ved et uhell og kan få mer av den med vilje.

Hvor du sitter avgjør hvor mye av arbeidsdagen din som er eksponert:

TeamlokasjonRushtid vinduer, lokal tidArbeidsdags eksponering
US Eastern (UTC-4)21:00-00:00, 02:00-06:00Ingen, hele arbeidsdagen er utenom rushtid
US Pacific (UTC-7)18:00-21:00, 23:00-03:00Ingen
Sentral-Europa (UTC+2)03:00-06:00, 08:00-12:00Hele morgenen
India (UTC+5:30)06:30-09:30, 11:30-15:30Mesteparten av arbeidsdagen
Kina (UTC+8)09:00-12:00, 14:00-18:00Nesten hele

Lokale tider konverteres fra de publiserte UTC-vinduene ved de viste forskyvningene, og sommertid flytter dem med en time. Mønsteret er ikke et uhell: rushtid-vinduene samsvarer med den kinesiske arbeidsdagen, så et amerikansk teams interaktive trafikk havner i den billige halvdelen av klokken gratis.


Stabling av Begge Rabatter: En 60x Spredning på Én Modell

Et bufret innputttoken utenom rushtid til 0,022 dollar mot et rushtids cache miss til 1,32 dollar er en 60x spredning på identisk utputt fra samme modell.

Her er hvordan det ser ut på en realistisk agent-arbeidsmengde: en kontekst på 200 000 tokens sendt på nytt 1 000 ganger om dagen, altså 200 millioner innputt-tokens daglig på V4-Pro.

ScenarioRate per 1MDaglig innputt-kostnad
Rushtid, hver kall en cache miss$1.32$264.00
Utenom rushtid, hver kall en cache miss$0.66$132.00
Rushtid, hver kall en cache hit$0.044$8.80
Utenom rushtid, hver kall en cache hit$0.022$4.40

Alle fire radene er utledet ved å multiplisere de publiserte prisene med 200. Gapet mellom toppraden og bunnraden er omtrent 260 dollar om dagen, eller omtrent 95 000 dollar i året, på en arbeidsmengde som ikke endrer seg i det hele tatt.

To ting følger som de fleste kostnadsanalyser overser:

En bufret flaggskipmodell slår en ubuffret liten modell. V4-Pro bufret innputt til 0,022 dollar utenom rushtid er omtrent 7x billigere enn V4.1-Flash ubuffret innputt til 0,15 dollar (utledet). Å nedgradere modellen for å spare penger er feil trekk hvis det reelle problemet er en hurtigbuffer du aldri har varmet opp.

Utputt blir aldri bufret. Til 1,98 dollar utenom rushtid koster et utputt-token omtrent 90x et bufret innputt-token (utledet). Når bufring fungerer, har du ikke lenger en innputtregning, du har en utputtregning, og enhver ytterligere besparelse kommer fra kortere svar eller begrensede tankebudsjetter. Team som finansierer den utputtregningen med leverandørkreditter kan sammenligne hva som er tilgjengelig på getaiperks.com.


Beste AI-ferdigheter for startups

Søk direkte via disse verifiserte programmene.

Hva Endret Seg Siden Vår Tidligere DeepSeek Prisguide

Tre ting endret seg i 2026: V4-Pro-0813 nådde generell tilgjengelighet 13. august, prisene for rushtid og utenom rushtid erstattet faste priser i midten av august, og V4.1-Flash kom rundt 10. september.

Vår tidligere DeepSeek pris-side oppgir faste priser per token uten tidsbasert komponent. Disse dateres før endringen og bør leses som historie.

Tidslinjen, med konfidens markert ærlig:

  • 24. april 2026 (middels konfidens): V4-Pro og V4-Flash forhåndsvisning, med et kontekstvindu på 1M tokens, opptil 384K utputt-tokens, og byttbare tenke- og ikke-tenkemodus.
  • 31. juli 2026 (middels konfidens): DeepSeek-V4-Flash-0731, den stabile Flash-utgivelsen. Siste kjente pris før endringen var 0,14 dollar per million cache-miss innputt og 0,28 dollar per million utputt, begge faste. Historisk kun.
  • 13. august 2026: DeepSeek-V4-Pro-0813 generell tilgjengelighet, den nåværende flaggskip-modellen for resonnering og agenter.
  • Rundt 10. september 2026: DeepSeek-V4.1-Flash, listet i dokumentasjonen som "DeepSeek-Flash".

Hvis du jobber ut fra en veiledning eller en kostnadsmodell skrevet før august 2026, er hvert innputt-tall i den feil i begge retninger: for høyt for en cache hit, for lavt for en rushtids cache miss.


Endepunkt-navneendringen som Ødelegger Gammel Kode

DeepSeek-V4.1-Flash stilte stille og rolig av modellnavnene deepseek-v4-flash og deepseek-v4-flash-vision-exp. Forespørsler som fortsatt bruker disse strengene vil feile.

Dette er den typen endring som dukker opp som en produksjonshendelse snarere enn en migreringsticket, fordi modellnavnet vanligvis ligger i en konfigurasjonsfil ingen har åpnet på måneder. Eldre kodeprøver, SDK-innpakninger og tredjeparts veiledninger refererer fortsatt til de utgåtte navnene.

Verdt å gjøre før din neste utrulling:

  • Grep hele repositoriet for begge utgåtte strengene, inkludert infrastrukturkonfigurasjon og notatbøker
  • Sjekk eventuelle leverandør-SDK-er eller agent-rammeverk som hardkoder en standard DeepSeek-modell
  • Bekreft visjonsbanen separat, siden det eksperimentelle visjonsendepunktet også ble omdøpt
  • Kjør kostnadsmodellen din på nytt etterpå, fordi erstatningen ligger på den nye tidsplanen for rushtid og utenom rushtid

Beste AI-ferdigheter for startups

Søk direkte via disse verifiserte programmene.

DeepSeek Gratis Nivå og Kreditter: Hva Som Er Faktisk Sant

DeepSeek chat-appen er gratis å bruke. API-et er ikke det, og det er ingen oppgitt gratis nivå på den offisielle prissiden.

Dette er hvor de fleste artikler tar feil. Påstander om at nye API-kontoer mottar gratis kreditter sirkulerer vidt, rapporteres inkonsistent, og er ikke bekreftet på den offisielle prissiden. Hvis du trenger en startbalanse, anta at du betaler for den.

Viktigere for gründere: DeepSeek kjører ingen dedikert startup-kredittprogram. Det finnes ingen søknad, ingen trinnbasert nivå, ingen partnerbane. Billig pris per token er hele tilbudet, noe som er et reelt gap hvis du setter sammen en kreditt-stack.

Det gapet er nøyaktig grunnen til at rutebeslutningen betyr noe. Mange leverandører kjører startup-programmer, og AI Perks sporer 7,7 millioner dollar i kreditter på tvers av 194 selskaper som dekker de som gjør det. Det praktiske mønsteret er å rute trafikk med høy volum og hurtigbuffer-vennlig trafikk til DeepSeek til 0,022 dollar per million og bruke tildelte kreditter på de dyrere leverandørene, der et gratis token er verdt langt mer.


Kjøpe DeepSeek Fra Noen Andre

Tredjeparts verter replikerer ikke DeepSeek's tidsplan for rushtid og utenom rushtid, noe som betyr at de kan underprise førsteparts-API-en under rushtid og tape stort mot den utenom rushtid.

Baseten lister DeepSeek V4.1 Flash innputt til 0,30 dollar per million (middels konfidens, verifiser før du budsjetterer med det), og utputt-tallet ble ikke pålitelig bekreftet. Baseten tilbyr også en stående 30 dollar ny-arbeidsområde prøvekreditt.

Legg merke til hva 0,30 dollar tilsvarer: det er nøyaktig DeepSeek's egen rushtids cache-miss rate, og det dobbelte av utenom rushtids-raten (utledet). For et amerikansk eller europeisk team hvis trafikk mest faller utenom rushtid uansett, er en fast tredjeparts rate ikke åpenbart en besparelse.

OpenRouter, Together og Fireworks hoster også DeepSeek-modeller. Vi siterer ikke prisene deres her fordi vi ikke har verifisert dem, og det bør heller ingenting annet du leser. Den kvalitative avveiningen er imidlertid konsekvent:

  • Førsteparts API: det eneste stedet der hele cache-hit og utenom rushtid-stabelen gjelder, og den billigste veien med stor margin når begge aktiveres
  • Tredjeparts verter: faste priser, forskjellige regioner, enhetlig fakturering, og vanligvis ingen eksponering for DeepSeek's cache-hit-nivå
  • Aggregatorer: nyttig for feiltoleranse, til en premie du bør måle snarere enn å anta

Pris din egen trafikk mot begge, og sammenlign deretter resultatet med kredittene tilgjengelig på andre leverandører på getaiperks.com. Et gratis token slår et billig et.


Beste AI-ferdigheter for startups

Søk direkte via disse verifiserte programmene.

Ofte Stillete Spørsmål

Hvor Mye Billigere Er en DeepSeek Cache Hit?

På DeepSeek-V4-Pro er en cache hit 0,022 dollar per million innputt-tokens utenom rushtid mot 0,66 dollar for en cache miss, en 30x forskjell. På V4.1-Flash er gapet enda større, 0,003 dollar mot 0,15 dollar, en 50x forskjell (utledet). Prisene er fra de offisielle API-dokumentene per september 2026.

Når Er DeepSeek Rushtid?

Rushtid er 01:00-04:00 og 06:00-10:00 UTC kun på hverdager. Alt annet, inkludert begge helgedager, faktureres til halvparten av rushtidsprisen. Det gir omtrent 79 % av uken som utenom rushtid (utledet), så USA-baserte team får rabatten gjennom hele arbeidsdagen uten å endre noe.

Har DeepSeek et Gratis API-nivå?

Ingen gratis API-nivå er oppgitt på den offisielle prissiden. Forbruker-chat-appen er gratis, men API-et betales fra det første tokenet. Rapporter om gratis kreditter for nye kontoer er inkonsistente og ubekreftede. Leverandører som gir kreditter spores på getaiperks.com.

Tilbyr DeepSeek Startup Kreditter?

DeepSeek kjører ingen dedikert startup-kredittprogram. Lav pris per token er hele tilbudet. For gründere som bygger en kreditt-stack, er det et gap verdt å fylle andre steder: AI Perks dekker 7,7 millioner dollar i kreditter på tvers av 194 selskaper fra leverandørene som kjører programmer.

Hvorfor Stoppet Mitt DeepSeek API-kall å Fungerer?

Den mest sannsynlige årsaken er modellnavnet. DeepSeek-V4.1-Flash stilte av endepunktnavnene deepseek-v4-flash og deepseek-v4-flash-vision-exp, og eldre veiledninger og konfigurasjonsfiler refererer fortsatt til dem. Grep repositoriet ditt for begge strengene, inkludert leverandør-SDK-er og notatbøker, og sjekk deretter kostnadsmodellen din mot gjeldende priser.

Bør Jeg Bruke DeepSeek V4-Pro eller V4.1-Flash?

Kjør regnestykket før du antar at Flash er billigere. V4-Pro bufret innputt til 0,022 dollar utenom rushtid er omtrent 7x billigere enn Flash ubuffret innputt til 0,15 dollar (utledet), så et godt bufret flaggskip kan slå en ubuffret liten modell helt på innputtlinjen. Utputt-volum, ikke modellstørrelse, bestemmer vanligvis regningen.


Abonner på getaiperks.com →

Bufre prefikset, send utenom rushtid, og la andres kreditter dekke resten.

AI Perks

AI Perks gir tilgang til eksklusive rabatter, kreditter og tilbud på AI-verktøy, skytjenester og API-er for å hjelpe startups og utviklere med å spare penger.

AI Perks Cards

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.