Var att köra DeepSeek billigast: Direkt vs. värd-API:er

DeepSeek är billigast direkt. Tidsbaserad prissättning och 30x cache-rabatten är förstapartsmekanismer som OpenRouter och Together inte kan återförsälja.

DeepSeekOpenRouterLLM API PricingModel RoutingAI Perks
Author Avatar
Andrew
AI Perks Team
13,422

Quick Answer

Att köra DeepSeek direkt är nästan alltid billigare, eftersom de två rabatterna som gör det billigt, halva priset utanför rusningstid och en cache-träff till ungefär 30 gånger mindre än en miss, är förstapartsmekanismer som återförsäljare fakturerar som en fast taxa. Värdar tjänar sin marginal på routing och regelefterlevnad, inte på pris. Kreditprogram från leverantörerna som driver en spåras på getaiperks.com.

AI Perks

AI Perks ger tillgång till exklusiva rabatter, krediter och erbjudanden på AI-verktyg, molntjänster och API:er för att hjälpa startups och utvecklare att spara pengar.

AI Perks Cards

Är DeepSeek Billigare Direkt eller via en Värd?

Direkt, i nästan alla fall, och anledningen är strukturell snarare än en fråga om påslag. DeepSeeks låga pris kommer från två multiplikatorer som bara finns på förstaparts-API:et: ett halvpris under lågtrafik och ett cache-träff som kostar ungefär 30 gånger mindre än ett cache-miss på V4-Pro. Återförsäljare fakturerar en enda fast taxa per token, så båda multiplikatorerna försvinner vid dörren.

Det är hela routingbeslutet i en enda rad. En värd tar inte ut ett blygsamt premium på samma pris, den tar ut ett fast pris mot en faktura som kunde ha varit en bråkdel av det.

Klyftan är större än någon som routar på en leaderboard skulle gissa. Team som jagar den här typen av enhetsekonomi jagar oftast också gratis krediter, vilket AI Perks spårar över 194 företag och 7,7 miljoner dollar i krediter.


Bästa AI-krediter för startups

Ansök direkt via dessa verifierade program.

De Fyra Priserna som DeepSeek Tar för Samma Token

DeepSeek-V4-Pro har fyra olika ingångspriser beroende på tid på dygnet och om din prompt-prefix har cachelagrats. Ingen annan stor leverantör prissätter på det här sättet.

Högbelastningstider är 01:00 till 04:00 och 06:00 till 10:00 UTC på vardagar. Allt utanför dessa fönster, inklusive hela helgen, är lågtrafik till halv pris.

DeepSeek-V4-Pro-0813Lågtrafik (per miljon)Högbelastning (per miljon)
Ingång, cache-träff$0.022$0.044
Ingång, cache-miss$0.66$1.32
Utgång$1.98$3.96
DeepSeek-V4.1-FlashLågtrafik (per miljon)Högbelastning (per miljon)
Ingång, cache-träff$0.003$0.006
Ingång, cache-miss$0.15$0.30

De två multiplikatorerna staplas. En cachelagrad lågtrafik-ingångstoken till $0.022 mot en högbelastnings-cache-miss för $1.32 är en 60x skillnad på samma modell (härledd från tabellen ovan). På Flash är skillnaden ännu större: $0.003 mot $0.30 är 100x, också härledd.

Högbelastningstider är totalt 7 timmar om dagen över 5 vardagar, så ungefär 79% av veckan faktureras till lågtrafik-taxan som standard (härledd). Du behöver inte göra något smart för att hamna där. Du måste undvika att göra något slarvigt.


Vad som Ändrades i DeepSeek Prissättning i Augusti 2026

Själva prismodellen ändrades den 16 augusti 2026, när en fast taxa per token ersattes av uppdelningen mellan högbelastning och lågtrafik. Alla kostnadsjämförelser skrivna före det datumet beskriver en prislista som inte längre existerar.

Tidslinjen som spelar roll:

  • 24 april 2026: V4-Pro och V4-Flash förhandsgranskning, med 1 miljon token-kontext och omkopplingsbara tänklägen (konfidens: medium).
  • 31 juli 2026: DeepSeek-V4-Flash-0731 lanseras som den stabila Flash-versionen. Sista kända fasta priset var $0.14 per 1 miljon cache-miss-ingångar och $0.28 utgång (konfidens: medium, endast historiskt).
  • 13 augusti 2026: DeepSeek-V4-Pro-0813 blir allmänt tillgänglig.
  • Runt 10 september 2026: DeepSeek-V4.1-Flash lanseras, listad i dokumentationen som DeepSeek-Flash.

Ställ det gamla fasta priset på $0.14 bredvid de nuvarande Flash-priserna och förändringens utformning blir uppenbar. Lågtrafik-cache-miss-ingångar för $0.15 ligger nästan exakt där det gamla fasta priset var, medan högbelastning kostar $0.30, lite mer än dubbelt så mycket (härledd). DeepSeek höjde inte priserna så mycket som de införde en trängselavgift.


Bästa AI-krediter för startups

Ansök direkt via dessa verifierade program.

Vad Tredjeparts Värdar Kostar och Varför de Inte Kan Matcha

En värd köper kapacitet och säljer tokens, så den måste ange ett nummer som täcker dess värsta timme. Det numret ligger över DeepSeeks lågtrafik-taxa och astronomiskt över dess cachelagrade lågtrafik-taxa.

Två saker går sönder vid återförsäljning:

Tid-på-dygnet prissättning överlever inte. En värd som betjänar alla tidszoner kan inte vidarebefordra en UTC-förankrad rabatt utan antingen arbitrage eller en osäljbar prislista.

Cache-tillstånd är per klient. Prefix-cachning lönar sig när samma systemprompt träffar samma backend upprepade gånger. Om du routar den prompten genom en aggregator som lastbalanserar över leverantörer betalar du cache-miss-priser på en prompt du har skickat tusen gånger.

Verifiera alla värdpriser själv innan du binder dig, eftersom publicerade siffror ändras och de flesta jämförelseinlägg anger taxor som gick ut för flera veckor sedan. En siffra sätter klyftan rent. Baseten listar DeepSeek V4.1 Flash-ingång till $0.30 per 1 miljon (konfidens: medium, verifiera innan du citerar), tillsammans med en $30 provkredit för nya arbetsytor. Utgångssiffran bekräftades inte tillförlitligt, så den anges inte här.

RuttTid-på-dygnet prissättningPrefix-cache-rabattVerifierad prissignal
DeepSeek förstaparts, V4-ProJa, 2x svängJa, 30x$0.66 in / $1.98 ut, lågtrafik
DeepSeek förstaparts, V4.1-FlashJa, 2x svängJa, 50x (härledd)$0.15 in, lågtrafik
BasetenEj publiceradEj publicerad$0.30 in, V4.1 Flash
OpenRouter, Together AI, FireworksEj publiceradVarierar per leverantörVerifiera vid källan

I förhållande till Basetens listade $0.30, är DeepSeeks egen lågtrafik-cache-miss-ingång för $0.15 hälften av priset, och dess cachelagrade lågtrafik-ingång för $0.003 är 100x billigare (härledd). Det är inte en återförsäljare som är girig. Det är en fast taxa som möter en fyrsidig taxa.

OpenRouter, Together AI och Fireworks hostar alla DeepSeek-modeller. Deras priser anges inte här eftersom de inte har verifierats, och ett inaktuellt pris i en kostnadsjämförelse är sämre än inget pris.


När Det är Rätt att Betala Värdens Påslag

Rutta via en värd när det du köper inte är tokens. Det finns fyra situationer där premien är rationell.

Inköp blockerar Kina-ändpunkten. Om din säkerhetsgranskning inte godkänner att ringa DeepSeek direkt, är värden inte ett påslag, det är det enda sättet du levererar. Detta är den enskilt vanligaste anledningen till att team routar DeepSeek via en amerikansk leverantör.

Du behöver en faktura och en nyckel för många modeller. En aggregator som växlar från DeepSeek till en Llama- eller Qwen-ändpunkt när något är nere säljer upptid, inte pris.

Din trafik är i högbelastning och cache-kall ändå. En lågvolym interaktiv produkt som betjänar europeiska morgnar hamnar inom högbelastningsfönstret med korta, unika prompter. Den arbetsbelastningen ger upp båda rabatterna, vilket avsevärt minskar förstaparts-fördelen.

Du utvärderar fortfarande. En provkredit som Basetens $30 kostar ingenting och besvarar kvalitetsfrågan innan du kopplar in en andra leverantör. Gratis utvärderingskredit är den billigaste formen av flit, och AI Perks finns för att katalogisera var den är tillgänglig.


Bästa AI-krediter för startups

Ansök direkt via dessa verifierade program.

Ändring av Ändpunktsnamn som Bryter Routing-konfigurationer

DeepSeek-V4.1-Flash har tyst pensionerat modellnamnen deepseek-v4-flash och deepseek-v4-flash-vision-exp. Kodexempel och handledningar skrivna före september 2026 refererar fortfarande till dem, och dessa anrop misslyckas nu.

Detta drabbar hårdast den installation som den här artikeln handlar om. En routerkonfiguration innehåller modellidentifierare för flera leverantörer i en fil, mest stabil i flera år, så ett tyst pensionerat namn dyker upp som ett intermittent fel på en rutt snarare än ett uppenbart avbrott.

Två praktiska konsekvenser:

  • Sök i din kodbas och dina promptmallar efter de gamla namnen innan du felsöker något annat.
  • Värdbaserade modellidentifierare är namngivna annorlunda än DeepSeeks egna, så bekräfta vilken exakt sträng din leverantör exponerar snarare än att anta att förstapartsnamnet fungerar.

DeepSeek Har Inget Startups-kreditprogram. Andra Har.

DeepSeeks chattapp är gratis att använda, det finns ingen angiven API-gratisnivå på den officiella prissidan, och DeepSeek driver inget dedikerat startups-kreditprogram. Påståenden om API-gratis krediter för nya konton cirkulerar flitigt men rapporteras inkonsekvent och har inte bekräftats på den officiella sidan. Behandla dem som obekräftade.

Det är ett genuint gap. En API prissatt så här långt ner är en av de få som inte ger ett startup en dollar i driftmarginal, vilket gör DeepSeek till en kostnadsbotten snarare än ett kreditchans.

Leverantörerna som driver program är de som är värda att ansöka till, och det finns långt fler av dem än de flesta grundare känner till. AI Perks spårar 7,7 miljoner dollar i krediter över 194 företag, vilket är den budgetpost som DeepSeek själv aldrig kommer att täcka.

Se vilka leverantörer som ger krediter på getaiperks.com →


Bästa AI-krediter för startups

Ansök direkt via dessa verifierade program.

Vanliga Frågor och Svar

Är DeepSeek billigare på OpenRouter eller direkt?

Direkt, strukturellt. DeepSeeks lågtrafik-halva pris och dess ungefärliga 30x V4-Pro cache-träff-rabatt är förstaparts-mekanismer som återförsäljare fakturerar som en enda fast taxa. En värd tjänar sitt pris på regelefterlevnad, failover och en faktura över modeller. För rå token-kostnad vinner förstaparts. Krediter från leverantörer som driver program finns på AI Perks.

När är DeepSeek högbelastningstider?

Högbelastning är 01:00 till 04:00 och 06:00 till 10:00 UTC på vardagar. Allt annat, inklusive hela lördag och söndag, faktureras till halv pris. Det lämnar ungefär 79% av veckan till lågtrafik-taxan som standard (härledd), så batch- och köade jobb hamnar nästan alltid där utan någon schemaläggningsinsats.

Hur mycket sparar en DeepSeek cache-träff?

På DeepSeek-V4-Pro kostar en cache-träff $0.022 per miljon ingångstokens under lågtrafik jämfört med $0.66 för en miss, ungefär 30x. På V4.1-Flash är samma jämförelse $0.003 mot $0.15, ungefär 50x (härledd). Stapla cache-rabatten med lågtrafik och skillnaden mot en högbelastnings-miss når 60x på V4-Pro.

Varför slutade mitt DeepSeek-V4-Flash API-anrop att fungera?

DeepSeek-V4.1-Flash pensionerade ändpunktnamnen deepseek-v4-flash och deepseek-v4-flash-vision-exp. Alla handledningar eller kodexempel skrivna före september 2026 använder dem fortfarande och kommer nu att misslyckas. Uppdatera modellidentifieraren och notera att tredjeparts värdar namngir sina egna identifierare annorlunda än DeepSeeks.

Ger DeepSeek gratis API-krediter till nya konton?

DeepSeek chattapp är gratis, men det finns ingen angiven API-gratisnivå på den officiella prissidan, och påståenden om krediter för nya konton rapporteras inkonsekvent och obekräftat. DeepSeek driver inte heller något startups-kreditprogram. Leverantörerna som gör det spåras på AI Perks över 194 företag.

Vad kostar DeepSeek V4-Pro per miljon tokens?

DeepSeek-V4-Pro-0813 kostar $0.66 per miljon cache-miss ingångstokens och $1.98 per miljon utgång under lågtrafik, och dubblas till $1.32 respektive $3.96 under högbelastningstider. Cachelagrad ingång kostar $0.022 under lågtrafik. Denna nivåindelning på en modell är anledningen till att en fast återförsäljaravgift sällan konkurrerar. Kompensera dina andra modellräkningar på AI Perks.


Prenumerera på getaiperks.com →

DeepSeek sätter prisgolvet. Gratis krediter från alla andra täcker resten.

AI Perks

AI Perks ger tillgång till exklusiva rabatter, krediter och erbjudanden på AI-verktyg, molntjänster och API:er för att hjälpa startups och utvecklare att spara pengar.

AI Perks Cards

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.