DeepSeek Context Caching 2026: Ang 30x Bawas sa Input

Mas mura ng 30x ang singil ng DeepSeek para sa naka-cache na input kaysa sa hindi naka-cache, at hinahati nito ang bawat presyo off-peak. Ang mga presyo para sa V4-Pro at V4.1-Flash, ipinaliwanag nang tama.

DeepSeekContext CachingLLM PricingAI API CostsAI Perks
Author Avatar
Andrew
AI Perks Team
12,529

Quick Answer

Ang isang cache hit sa DeepSeek-V4-Pro ay nagkakahalaga ng $0.022 bawat milyong input token na off-peak kumpara sa $0.66 para sa isang cache miss, isang 30x na diskwento sa parehong modelo. Ang DeepSeek ay hinahati rin ang bawat presyo sa labas ng peak hours, kaya ang isang naka-cache na off-peak token ay tumatakbo ng 60x na mas mura kaysa sa isang peak cache miss. Ang mga credits mula sa mga provider na nagpapatakbo ng mga startup program ay sinusubaybayan sa getaiperks.com.

AI Perks

Nagbibigay ang AI Perks ng access sa mga eksklusibong diskwento, kredito, at deal sa mga AI tool, cloud service, at API upang matulungan ang mga startup at developer na makatipid.

AI Perks Cards

Magkano Talaga ang Halaga ng Isang DeepSeek Cache Hit

Sa DeepSeek-V4-Pro, ang isang input token na nakuha mula sa cache ay nagkakahalaga ng $0.022 bawat milyon sa off-peak kumpara sa $0.66 para sa cache miss. Ito ay 30x discount para sa pagpapadala ng parehong prefix nang dalawang beses.

Karamihan sa mga pricing page ay nagbibigay ng isang numero ng input at nagtatapos doon. Ang DeepSeek ay may apat, dahil dalawang magkaibang multiplier ang nalalapat sa bawat tawag: kung ang prefix ay tumama sa cache, at kung anong oras ng araw mo ito ipinadala.

Modelo at WindowInput Cache HitInput Cache MissOutput
DeepSeek-V4-Pro-0813, Off-Peak$0.022$0.66$1.98
DeepSeek-V4-Pro-0813, Peak$0.044$1.32$3.96
DeepSeek-V4.1-Flash, Off-Peak$0.003$0.15Hindi Napatunayan
DeepSeek-V4.1-Flash, Peak$0.006$0.30Hindi Napatunayan

Lahat ng numero ay USD bawat milyon na token, mula sa opisyal na API docs noong Setyembre 2026. Ang presyo ng output ng V4.1-Flash ay hindi napatunayan dito, kaya tingnan ang opisyal na pahina bago mag-budget para dito.

Ang Flash ratio ay mas malaki pa kaysa sa flagship: $0.003 kumpara sa $0.15 ay 50x na agwat (mula sa mga rate sa itaas). Sinusubaybayan ng AI Perks ang ganitong uri ng mekanismo ng provider kasama ang mga credit program na bumabawi dito.


Mga Nangungunang AI Credits para sa mga Startup

Mag-apply nang direkta sa pamamagitan ng mga beripikadong programa na ito.

Peak at Off-Peak: Ang Tanging Vendor na Nagpepresyo ayon sa Oras

Ang peak hours ng DeepSeek ay 01:00-04:00 at 06:00-10:00 UTC tuwing weekdays. Lahat ng iba pa, kabilang ang lahat ng Sabado at Linggo, ay binabayaran sa kalahating presyo.

Walang ibang malaking model vendor na nagpepresyo ayon sa oras ng araw, na siyang pinaka-hindi napapansing lever sa LLM cost work. Walang optimization guide na isinulat para sa OpenAI o Anthropic ang may dahilan para banggitin ito.

Mula sa mga window na iyon: ang peak ay 7 oras sa isang araw sa loob ng 5 weekdays, kaya 35 sa 168 oras ng linggo. Humigit-kumulang 79% ng kalendaryo ay off-peak na, kaya karamihan sa mga team ay nakakakuha ng discount nang hindi sinasadya at maaaring mas marami pa kung sinasadya.

Kung saan ka nakaupo ang nagpapasya kung gaano karami sa iyong workday ang nakalantad:

Lokasyon ng TeamPeak Windows, Lokal na OrasPagkakalantad sa Araw ng Trabaho
US Eastern (UTC-4)21:00-00:00, 02:00-06:00Wala, ang buong araw ng trabaho ay off-peak
US Pacific (UTC-7)18:00-21:00, 23:00-03:00Wala
Gitnang Europa (UTC+2)03:00-06:00, 08:00-12:00Buong umaga
India (UTC+5:30)06:30-09:30, 11:30-15:30Karamihan sa araw ng trabaho
China (UTC+8)09:00-12:00, 14:00-18:00Halos lahat

Ang mga lokal na oras ay kino-convert mula sa mga naka-publish na UTC window sa mga offset na ipinapakita, at ang daylight saving ay nagpapagalaw sa mga ito ng isang oras. Ang pattern ay hindi aksidente: ang mga peak window ay tumutugma sa Chinese working day, kaya ang interactive traffic ng isang US team ay napupunta sa murang kalahati ng orasan nang libre.


Pagsasalansan ng Parehong mga Discount: Isang 60x Spread sa Isang Modelo

Ang isang cached off-peak input token sa $0.022 kumpara sa isang peak cache miss sa $1.32 ay isang 60x spread sa magkaparehong output mula sa parehong modelo.

Narito ang itsura nito sa isang makatotohanang agent workload: isang 200,000-token na konteksto na ipinapadala muli ng 1,000 beses sa isang araw, kaya 200 milyong input token araw-araw sa V4-Pro.

SitwasyonRate bawat 1MAraw-araw na Gastos sa Input
Peak, Bawat Tawag ay Cache Miss$1.32$264.00
Off-Peak, Bawat Tawag ay Cache Miss$0.66$132.00
Peak, Bawat Tawag ay Cache Hit$0.044$8.80
Off-Peak, Bawat Tawag ay Cache Hit$0.022$4.40

Lahat ng apat na hilera ay nakuha sa pamamagitan ng pag-multiply ng mga naka-publish na rate ng 200. Ang agwat sa pagitan ng unang hilera at ng huli ay humigit-kumulang $260 bawat araw, o halos $95,000 bawat taon, sa isang workload na hindi nagbabago.

Dalawang bagay ang sumusunod na karamihan sa mga cost write-up ay hindi napapansin:

Ang isang cached flagship ay nakakatalo sa isang uncached na maliit na modelo. Ang V4-Pro cached input sa $0.022 off-peak ay humigit-kumulang 7x na mas mura kaysa sa V4.1-Flash uncached input sa $0.15 (nakuha). Ang pagpapalit ng modelo upang makatipid ng pera ay maling hakbang kung ang tunay na problema ay isang cache na hindi mo kailanman pinainit.

Ang output ay hindi kailanman nache-cache. Sa $1.98 off-peak, ang isang output token ay nagkakahalaga ng humigit-kumulang 90x ng isang cached input token (nakuha). Kapag gumagana na ang caching, wala ka nang input bill, mayroon kang output bill, at ang bawat karagdagang pagtitipid ay nagmumula sa mas maikling mga tugon o mga nakalimitahang budget sa pag-iisip. Ang mga team na nagpopondo sa output bill na iyon gamit ang mga provider credit ay maaaring ikumpara kung ano ang available sa getaiperks.com.


Mga Nangungunang AI Credits para sa mga Startup

Mag-apply nang direkta sa pamamagitan ng mga beripikadong programa na ito.

Ano ang Nagbago Mula sa Ating Nakaraang DeepSeek Pricing Guide

Tatlong bagay ang nagbago noong 2026: ang V4-Pro-0813 ay naabot ang pangkalahatang availability noong Agosto 13, ang presyo ng peak at off-peak ay pinalitan ang mga flat rate noong kalagitnaan ng Agosto, at ang V4.1-Flash ay dumating noong bandang Setyembre 10.

Ang aming nakaraang DeepSeek pricing page ay nagbibigay ng flat per-token na mga rate nang walang component ng oras ng araw. Ang mga iyon ay bago ang pagbabago at dapat basahin bilang kasaysayan.

Ang timeline, na may kumpiyansa na minarkahan nang tapat:

  • Abril 24, 2026 (katamtamang kumpiyansa): V4-Pro at V4-Flash preview, na may 1M-token na context window, hanggang 384K output token, at switchable thinking at non-thinking modes.
  • Hulyo 31, 2026 (katamtamang kumpiyansa): DeepSeek-V4-Flash-0731, ang stable Flash release. Huling kilalang presyo bago ang pagbabago ay $0.14 bawat milyon na cache-miss input at $0.28 bawat milyon na output, parehong flat. Makasaysayan lamang.
  • Agosto 13, 2026: DeepSeek-V4-Pro-0813 pangkalahatang availability, ang kasalukuyang flagship reasoning at agent model.
  • Bandang Setyembre 10, 2026: DeepSeek-V4.1-Flash, nakalista sa mga docs bilang "DeepSeek-Flash".

Kung gumagamit ka ng tutorial o cost model na isinulat bago ang Agosto 2026, ang bawat input figure dito ay mali sa parehong direksyon: masyadong mataas para sa cache hit, masyadong mababa para sa peak cache miss.


Ang Pagpapalit ng Pangalan ng Endpoint na Sumisira sa Lumang Code

Tahimik na inalis ng DeepSeek-V4.1-Flash ang mga model name na deepseek-v4-flash at deepseek-v4-flash-vision-exp. Ang mga request na gumagamit pa rin ng mga string na ito ay mabibigo.

Ito ang uri ng pagbabago na lumalabas bilang isang production incident sa halip na isang migration ticket, dahil ang model name ay karaniwang nakalagay sa isang config file na walang nagbukas sa loob ng maraming buwan. Ang mga lumang code sample, SDK wrapper, at third-party tutorial ay tumutukoy pa rin sa mga inalis na pangalan.

Sulit gawin bago ang iyong susunod na deploy:

  • Hanapin ang buong repository para sa parehong mga inalis na string, kabilang ang infrastructure config at notebooks
  • Suriin ang anumang naka-bundle na SDK o agent framework na nagha-hardcode ng isang default na DeepSeek model
  • Kumpirmahin nang hiwalay ang vision path, dahil ang experimental vision endpoint ay napalitan din ng pangalan
  • Muling patakbuhin ang iyong cost model pagkatapos, dahil ang kapalit ay nakasalalay sa bagong peak at off-peak schedule

Mga Nangungunang AI Credits para sa mga Startup

Mag-apply nang direkta sa pamamagitan ng mga beripikadong programa na ito.

DeepSeek Free Tier at Credits: Ano ang Tunay na Totoo

Ang DeepSeek chat app ay libre gamitin. Ang API ay hindi, at walang nakasaad na libreng tier sa opisyal na pricing page.

Dito nagkakamali ang karamihan sa mga artikulo. Ang mga claim na ang mga bagong API account ay nakakakuha ng libreng credits ay malawakang kumakalat, hindi pare-pareho ang ulat, at hindi napatunayan sa opisyal na pricing page. Kung kailangan mo ng panimulang balanse, isipin na babayaran mo ito.

Mas mahalaga para sa mga founder: Walang dedikadong startup credit program ang DeepSeek. Walang application, walang stage-based tier, walang partner track. Ang murang presyo per-token ay ang buong alok, na isang totoong agwat kung nagbubuo ka ng isang stack ng credits.

Ang agwat na iyon ang eksaktong dahilan kung bakit mahalaga ang routing decision. Maraming provider ang nagpapatakbo ng startup programs, at sinusubaybayan ng AI Perks ang $7.7M sa mga credits sa 194 na kumpanya na sumasaklaw sa mga ito. Ang praktikal na pattern ay i-route ang mataas na volume, cache-friendly na traffic sa DeepSeek sa $0.022 bawat milyon at gastusin ang mga ibinigay na credits sa mas mahal na mga provider, kung saan ang isang libreng token ay mas mahalaga.


Pagbili ng DeepSeek Mula sa Iba

Ang mga third-party host ay hindi gumagaya sa peak at off-peak schedule ng DeepSeek, na nangangahulugang maaari nilang masubukan ang first-party API sa peak at matalo nang malaki dito sa off-peak.

Ang Baseten ay naglilista ng DeepSeek V4.1 Flash input sa $0.30 bawat milyon (katamtamang kumpiyansa, beripikahin bago mag-budget para dito), at ang output figure ay hindi maaasahang napatunayan. Ang Baseten ay mayroon ding nakatakdang $30 bagong workspace trial credit.

Pansinin kung ano ang katumbas ng $0.30: ito ay eksakto ang sariling peak cache-miss rate ng DeepSeek, at doble ang off-peak rate (nakuha). Para sa isang US o European team na ang traffic ay karaniwang napupunta sa off-peak, ang isang flat third-party rate ay hindi halatang pagtitipid.

Nagho-host din ang OpenRouter, Together, at Fireworks ng mga DeepSeek model. Hindi namin binabanggit ang kanilang mga presyo dito dahil hindi namin ito napatunayan, at hindi rin dapat gawin ng anumang iba pa na iyong mabasa. Gayunpaman, ang qualitative trade-off ay pare-pareho:

  • First-party API: ang tanging lugar kung saan nalalapat ang buong cache-hit at off-peak stack, at ang pinakamurang daan nang malaki kapag parehong gumana
  • Third-party hosts: flat rates, iba't ibang rehiyon, pinag-isang pagsingil, at karaniwang walang pagkakalantad sa cache-hit tier ng DeepSeek
  • Aggregators: kapaki-pakinabang para sa failover, sa isang premium na dapat mong sukatin kaysa ipagpalagay

Presyohan ang iyong sariling traffic laban sa pareho, pagkatapos ay ikumpara ang resulta sa mga credits na available sa ibang mga provider sa getaiperks.com. Ang isang libreng token ay nakakatalo sa isang mura.


Mga Nangungunang AI Credits para sa mga Startup

Mag-apply nang direkta sa pamamagitan ng mga beripikadong programa na ito.

Madalas na Itanong

Gaano kalaki ang natitipid sa isang DeepSeek cache hit?

Sa DeepSeek-V4-Pro, ang isang cache hit ay $0.022 bawat milyon na input token sa off-peak kumpara sa $0.66 para sa isang cache miss, isang 30x na pagkakaiba. Sa V4.1-Flash, ang agwat ay mas malaki pa, $0.003 kumpara sa $0.15, isang 50x na pagkakaiba (nakuha). Ang mga rate ay mula sa opisyal na API docs noong Setyembre 2026.

Kailan ang mga DeepSeek peak hours?

Ang peak ay 01:00-04:00 at 06:00-10:00 UTC tuwing weekdays lamang. Lahat ng iba pa, kabilang ang parehong araw ng weekend, ay naniningil sa kalahati ng peak rate. Iyon ay humigit-kumulang 79% ng linggo ay off-peak (nakuha), kaya ang mga team na nakabase sa US ay nakakakuha ng discount sa buong araw ng kanilang trabaho nang hindi binabago ang anumang bagay.

Mayroon bang DeepSeek free API tier?

Walang libreng API tier na nakasaad sa opisyal na pricing page. Ang consumer chat app ay libre, ngunit ang API ay binabayaran mula sa unang token. Ang mga ulat tungkol sa libreng credits para sa mga bagong account ay hindi pare-pareho at hindi kumpirmado. Ang mga provider na nagbibigay ng credits ay sinusubaybayan sa getaiperks.com.

Nag-aalok ba ang DeepSeek ng mga startup credit?

Walang dedikadong startup credit program ang DeepSeek. Ang mababang presyo per-token ang buong alok. Para sa mga founder na bumubuo ng isang stack ng credits, iyon ay isang agwat na sulit punan sa ibang lugar: ang AI Perks ay sumasaklaw sa $7.7M sa mga credits sa 194 na kumpanya mula sa mga provider na nagpapatakbo ng mga programa.

Bakit huminto sa paggana ang aking DeepSeek API call?

Ang pinakamalamang na sanhi ay ang pangalan ng modelo. Inalis ng DeepSeek-V4.1-Flash ang mga endpoint name na deepseek-v4-flash at deepseek-v4-flash-vision-exp, at ang mga lumang tutorial at config file ay tumutukoy pa rin sa mga ito. Hanapin ang parehong string sa iyong repository, kabilang ang mga naka-bundle na SDK at notebooks, pagkatapos ay muling suriin ang iyong cost model laban sa kasalukuyang mga rate.

Dapat ko bang gamitin ang DeepSeek V4-Pro o V4.1-Flash?

Patakbuhin ang aritmetika bago ipagpalagay na mas mura ang Flash. Ang V4-Pro cached input sa $0.022 off-peak ay humigit-kumulang 7x na mas mura kaysa sa Flash uncached input sa $0.15 (nakuha), kaya ang isang mahusay na cached na flagship ay maaaring talunin ang isang uncached na maliit na modelo sa input line. Ang volume ng output, hindi ang laki ng modelo, ang karaniwang nagpapasya sa bill.


Mag-subscribe sa getaiperks.com →

I-cache ang prefix, ipadala sa off-peak, at hayaan ang credits ng iba na sumagot sa natitira.

AI Perks

Nagbibigay ang AI Perks ng access sa mga eksklusibong diskwento, kredito, at deal sa mga AI tool, cloud service, at API upang matulungan ang mga startup at developer na makatipid.

AI Perks Cards

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.