DeepSeek Context Caching 2026: 30x Rabatu na Wejście

DeepSeek pobiera opłaty 30 razy mniej za buforowane dane wejściowe niż za brak w pamięci podręcznej i zmniejsza każdą cenę o połowę poza szczytem. Stawki V4-Pro i V4.1-Flash, wyjaśnione poprawnie.

DeepSeekContext CachingLLM PricingAI API CostsAI Perks
Author Avatar
Andrew
AI Perks Team
12,306

Quick Answer

Trafienie w pamięci podręcznej dla DeepSeek-V4-Pro kosztuje 0,022 USD za milion tokenów wejściowych poza godzinami szczytu, w porównaniu do 0,66 USD za brak trafienia w pamięci podręcznej, co stanowi zniżkę 30-krotną na ten sam model. DeepSeek obniża również o połowę każdą cenę poza godzinami szczytu, więc token w pamięci podręcznej poza godzinami szczytu jest 60 razy tańszy niż brak trafienia w pamięci podręcznej w godzinach szczytu. Kredyty od dostawców, którzy prowadzą programy dla startupów, są śledzone na stronie getaiperks.com.

AI Perks

AI Perks zapewnia dostęp do ekskluzywnych zniżek, kredytów i ofert na narzędzia AI, usługi chmurowe i API, aby pomóc startupom i programistom zaoszczędzić pieniądze.

AI Perks Cards

Ile faktycznie kosztuje trafienie do pamięci podręcznej DeepSeek

W przypadku DeepSeek-V4-Pro, token wejściowy pobrany z pamięci podręcznej kosztuje 0,022 USD za milion poza godzinami szczytu w porównaniu do 0,66 USD za brak trafienia do pamięci podręcznej. To 30-krotna zniżka za dwukrotne wysłanie tego samego prefiksu.

Większość stron z cennikiem podaje jedną liczbę wejściową i przechodzi dalej. DeepSeek ma cztery, ponieważ do każdego wywołania stosuje się dwa oddzielne mnożniki: czy prefiks trafił do pamięci podręcznej i o jakiej porze dnia go wysłałeś.

Model i oknoWejście do pamięci podręcznejWejście bez trafienia do pamięci podręcznejWyjście
DeepSeek-V4-Pro-0813, poza godzinami szczytu0,022 USD0,66 USD1,98 USD
DeepSeek-V4-Pro-0813, godziny szczytu0,044 USD1,32 USD3,96 USD
DeepSeek-V4.1-Flash, poza godzinami szczytu0,003 USD0,15 USDniezweryfikowane
DeepSeek-V4.1-Flash, godziny szczytu0,006 USD0,30 USDniezweryfikowane

Wszystkie kwoty w USD za milion tokenów, pochodzące z oficjalnej dokumentacji API z września 2026 r. Ceny wyjściowe V4.1-Flash nie zostały tutaj zweryfikowane, dlatego przed rozpoczęciem budżetowania sprawdź oficjalną stronę.

Współczynnik Flash jest jeszcze szerszy niż w przypadku flagowego modelu: 0,003 USD w porównaniu do 0,15 USD to 50-krotna różnica (wyliczona z powyższych stawek). AI Perks śledzi tego rodzaju mechanizmy dostawców wraz z programami kredytowymi, które je kompensują.


Najlepsze Kredyty AI dla Startupów

Aplikuj bezpośrednio przez te zweryfikowane programy.

Godziny szczytu i poza szczytem: Jedyny dostawca naliczający opłaty według zegara

Godziny szczytu DeepSeek to 01:00-04:00 i 06:00-10:00 UTC w dni powszednie. Wszystko inne, w tym cała sobota i niedziela, rozliczane jest dokładnie za połowę ceny.

Żaden inny główny dostawca modeli nie ustala cen według pory dnia, co czyni go najbardziej pomijanym elementem w pracy nad kosztami LLM. Żaden przewodnik optymalizacyjny napisany dla OpenAI lub Anthropic nie ma powodu, aby o tym wspominać.

Wynikające z tych okien czasowych: godziny szczytu to 7 godzin dziennie przez 5 dni powszednich, czyli 35 z 168 godzin w tygodniu. Około 79% tygodnia jest już poza godzinami szczytu, więc większość zespołów otrzymuje zniżkę przez przypadek i mogłaby uzyskać jej więcej celowo.

Twoja lokalizacja decyduje o tym, jak duża część dnia pracy jest narażona:

Lokalizacja zespołuOkna godzin szczytu, czas lokalnyNarażenie w dni robocze
Wschodnie USA (UTC-4)21:00-00:00, 02:00-06:00Brak, cały dzień roboczy jest poza godzinami szczytu
Pacyfik USA (UTC-7)18:00-21:00, 23:00-03:00Brak
Europa Środkowa (UTC+2)03:00-06:00, 08:00-12:00Cały poranek
Indie (UTC+5:30)06:30-09:30, 11:30-15:30Większość dnia roboczego
Chiny (UTC+8)09:00-12:00, 14:00-18:00Prawie cały

Czasy lokalne są przeliczane z opublikowanych okien UTC z pokazanymi przesunięciami, a zmiana czasu letniego przesuwa je o godzinę. Układ nie jest przypadkowy: okna godzin szczytu odpowiadają chińskiemu dniu roboczemu, więc interaktywny ruch zespołu z USA trafia za darmo do tańszej połowy cyklu.


Połączenie obu zniżek: 60-krotna różnica na jednym modelu

Pobrany z pamięci podręcznej token wejściowy poza godzinami szczytu za 0,022 USD w porównaniu do pobranej z pamięci podręcznej w godzinach szczytu za 1,32 USD to 60-krotna różnica przy identycznym wyjściu z tego samego modelu.

Oto jak to wygląda w realistycznym obciążeniu agenta: kontekst 200 000 tokenów wysyłany 1000 razy dziennie, czyli 200 milionów tokenów wejściowych dziennie na V4-Pro.

ScenariuszStawka za 1MDzienny koszt wejścia
Godziny szczytu, każde wywołanie bez trafienia do pamięci podręcznej1,32 USD264,00 USD
Poza godzinami szczytu, każde wywołanie bez trafienia do pamięci podręcznej0,66 USD132,00 USD
Godziny szczytu, każde trafienie do pamięci podręcznej0,044 USD8,80 USD
Poza godzinami szczytu, każde trafienie do pamięci podręcznej0,022 USD4,40 USD

Wszystkie cztery wiersze wynikają z pomnożenia opublikowanych stawek przez 200. Różnica między pierwszym a ostatnim wierszem wynosi około 260 USD dziennie, czyli około 95 000 USD rocznie, przy obciążeniu, które w ogóle się nie zmienia.

Dwie rzeczy wynikające z tego, których większość analiz kosztów pomija:

Model flagowy z pamięcią podręczną jest tańszy niż mały model bez pamięci podręcznej. Wejście V4-Pro z pamięcią podręczną za 0,022 USD poza godzinami szczytu jest około 7 razy tańsze niż wejście V4.1-Flash bez pamięci podręcznej za 0,15 USD (wyliczone). Obniżenie modelu w celu oszczędzenia pieniędzy jest złym posunięciem, jeśli rzeczywistym problemem jest pamięć podręczna, której nigdy nie wypełniono.

Wyjście nigdy nie jest buforowane. Przy cenie 1,98 USD poza godzinami szczytu, token wyjściowy kosztuje około 90 razy więcej niż buforowany token wejściowy (wyliczone). Gdy buforowanie działa, nie masz już rachunku za wejście, masz rachunek za wyjście, a każde dalsze oszczędności pochodzą z krótszych odpowiedzi lub ograniczonego budżetu na myślenie. Zespoły finansujące ten rachunek za wyjście za pomocą kredytów od dostawcy mogą porównać dostępne opcje na getaiperks.com.


Najlepsze Kredyty AI dla Startupów

Aplikuj bezpośrednio przez te zweryfikowane programy.

Co się zmieniło od naszego poprzedniego przewodnika po cenach DeepSeek

Trzy rzeczy zmieniły się w 2026 roku: V4-Pro-0813 osiągnął ogólną dostępność 13 sierpnia, ceny w godzinach szczytu i poza szczytem zastąpiły płaskie stawki w połowie sierpnia, a V4.1-Flash pojawił się około 10 września.

Nasza poprzednia strona z cennikiem DeepSeek podaje płaskie stawki za token bez komponentu pory dnia. Te daty poprzedzają zmianę i należy je traktować jako historię.

Harmonogram, z zaznaczoną uczciwie pewnością:

  • 24 kwietnia 2026 r. (średnia pewność): Wersje zapoznawcze V4-Pro i V4-Flash, z oknem kontekstu 1 mln tokenów, do 384 tys. tokenów wyjściowych oraz przełączanymi trybami myślenia i braku myślenia.
  • 31 lipca 2026 r. (średnia pewność): DeepSeek-V4-Flash-0731, stabilna wersja Flash. Ostatnia znana cena przed zmianą wynosiła 0,14 USD za milion wejść bez trafienia do pamięci podręcznej i 0,28 USD za milion wyjść, obie płaskie. Tylko historyczne.
  • 13 sierpnia 2026 r. : Ogólna dostępność DeepSeek-V4-Pro-0813, obecnego flagowego modelu rozumowania i agentów.
  • Około 10 września 2026 r. : DeepSeek-V4.1-Flash, wymieniony w dokumentacji jako "DeepSeek-Flash".

Jeśli korzystasz z samouczka lub modelu kosztowego napisanego przed sierpniem 2026 r., każda podana w nim liczba wejściowa jest błędna w obu kierunkach: zbyt wysoka dla trafienia do pamięci podręcznej, zbyt niska dla trafienia do pamięci podręcznej w godzinach szczytu.


Zmiana nazwy punktu końcowego, która psuje stary kod

DeepSeek-V4.1-Flash wycofał nazwy modeli deepseek-v4-flash i deepseek-v4-flash-vision-exp. Żądania nadal używające tych ciągów znaków będą zakończone niepowodzeniem.

Jest to rodzaj zmiany, która pojawia się jako incydent produkcyjny, a nie jako zgłoszenie migracyjne, ponieważ nazwa modelu zazwyczaj znajduje się w pliku konfiguracyjnym, którego nikt nie otwierał od miesięcy. Starsze przykłady kodu, biblioteki SDK i samouczki stron trzecich nadal odwołują się do wycofanych nazw.

Warto zrobić przed następnym wdrożeniem:

  • Przeszukaj cały repozytorium pod kątem obu wycofanych ciągów znaków, w tym konfiguracji infrastruktury i notebooków
  • Sprawdź wszelkie biblioteki SDK lub frameworki agentów, które mają zakodowane na stałe domyślny model DeepSeek
  • Potwierdź ścieżkę wizyjną osobno, ponieważ eksperymentalny punkt końcowy wizyjny również został przemianowany
  • Ponownie uruchom swój model kosztów, ponieważ zamiennik znajduje się w nowym harmonogramie godzin szczytu i poza szczytem

Najlepsze Kredyty AI dla Startupów

Aplikuj bezpośrednio przez te zweryfikowane programy.

Bezpłatny poziom i kredyty DeepSeek: Co jest naprawdę prawdą

Aplikacja czatu DeepSeek jest bezpłatna. API nie jest, a na oficjalnej stronie z cennikiem nie ma podanego bezpłatnego poziomu.

Tutaj większość artykułów się myli. Twierdzenia o otrzymaniu bezpłatnych kredytów przez nowe konta API krążą szeroko, są niespójnie zgłaszane i nie są potwierdzone na oficjalnej stronie z cennikiem. Jeśli potrzebujesz początkowego salda, zakładaj, że za nie płacisz.

Co ważniejsze dla założycieli: DeepSeek nie prowadzi dedykowanego programu kredytowego dla startupów. Nie ma wniosku, nie ma przedziału opartego na etapach, nie ma ścieżki partnerskiej. Tanie ceny za token to cała oferta, co stanowi realną lukę, jeśli składasz stos kredytów.

Ta luka jest dokładnie powodem, dla którego decyzja o routingu ma znaczenie. Wielu dostawców prowadzi programy dla startupów, a AI Perks śledzi 7,7 mln USD w kredytach w 194 firmach, obejmujących te, które je prowadzą. Praktycznym wzorcem jest kierowanie ruchu o dużej objętości, przyjaznego dla pamięci podręcznej, do DeepSeek za 0,022 USD za milion i wydawanie przyznanych kredytów na droższych dostawców, gdzie darmowy token jest wart znacznie więcej.


Kupowanie DeepSeek od kogoś innego

Hosty stron trzecich nie odzwierciedlają harmonogramu godzin szczytu i poza szczytem DeepSeek, co oznacza, że mogą podcinać ceny pierwszemu dostawcy API w godzinach szczytu i mocno przegrywać z nim poza szczytem.

Baseten wymienia wejście DeepSeek V4.1 Flash na poziomie 0,30 USD za milion (średnia pewność, zweryfikuj przed budżetowaniem) i cena wyjścia nie została wiarygodnie potwierdzona. Baseten oferuje również stały kredyt próbny na nowe przestrzenie robocze w wysokości 30 USD.

Zwróć uwagę, ile wynosi 0,30 USD: to dokładnie własna stawka DeepSeek za brak trafienia do pamięci podręcznej w godzinach szczytu i dwukrotność stawki poza szczytem (wyliczone). W przypadku zespołu z USA lub Europy, którego ruch i tak głównie trafia poza godzinami szczytu, płaska stawka strony trzeciej nie jest oczywistą oszczędnością.

OpenRouter, Together i Fireworks również hostują modele DeepSeek. Nie cytujemy tutaj ich cen, ponieważ ich nie zweryfikowaliśmy, i nikt inny nie powinien tego robić. Jakościowa wymiana jest jednak spójna:

  • API pierwszego dostawcy: jedyne miejsce, w którym obowiązuje pełny stos trafień do pamięci podręcznej i poza szczytem, oraz najtańsza ścieżka o dużej marży, gdy oba działają
  • Hosty stron trzecich: płaskie stawki, różne regiony, jednolite rozliczenia i zazwyczaj brak ekspozycji na poziom trafień do pamięci podręcznej DeepSeek
  • Agregatory: przydatne do zapewnienia redundancji, za premię, którą należy zmierzyć, a nie zakładać

Wycen swoje własne zapytania w obu przypadkach, a następnie porównaj wynik z kredytami dostępnymi u innych dostawców na getaiperks.com. Darmowy token jest lepszy niż tani.


Najlepsze Kredyty AI dla Startupów

Aplikuj bezpośrednio przez te zweryfikowane programy.

Często zadawane pytania

Jak dużo tańsze jest trafienie do pamięci podręcznej DeepSeek?

W DeepSeek-V4-Pro, trafienie do pamięci podręcznej kosztuje 0,022 USD za milion tokenów wejściowych poza godzinami szczytu w porównaniu do 0,66 USD za brak trafienia do pamięci podręcznej, co stanowi różnicę 30x. W przypadku V4.1-Flash luka jest jeszcze większa, 0,003 USD w porównaniu do 0,15 USD, różnica 50x (wyliczone). Stawki pochodzą z oficjalnej dokumentacji API z września 2026 r.

Kiedy są godziny szczytu DeepSeek?

Godziny szczytu to 01:00-04:00 i 06:00-10:00 UTC tylko w dni powszednie. Wszystko inne, w tym oba dni weekendowe, jest rozliczane po połowie stawki szczytowej. Oznacza to, że około 79% tygodnia to godziny poza szczytem (wyliczone), więc zespoły z USA otrzymują zniżkę przez cały swój dzień roboczy bez niczego zmieniania.

Czy DeepSeek ma bezpłatny poziom API?

Na oficjalnej stronie z cennikiem nie ma podanego bezpłatnego poziomu API. Aplikacja czatu konsumenckiego jest bezpłatna, ale API jest płatne od pierwszego tokena. Doniesienia o bezpłatnych kredytach dla nowych kont są niespójne i niepotwierdzone. Dostawcy, którzy przyznają kredyty, są śledzeni na getaiperks.com.

Czy DeepSeek oferuje kredyty dla startupów?

DeepSeek nie prowadzi dedykowanego programu kredytowego dla startupów. Niskie ceny za token to cała oferta. Dla założycieli tworzących stos kredytów, jest to luka, którą warto wypełnić gdzie indziej: AI Perks obejmuje 7,7 mln USD w kredytach w 194 firmach od dostawców, którzy prowadzą programy.

Dlaczego moje wywołanie API DeepSeek przestało działać?

Najbardziej prawdopodobną przyczyną jest nazwa modelu. DeepSeek-V4.1-Flash wycofał nazwy punktów końcowych deepseek-v4-flash i deepseek-v4-flash-vision-exp, a starsze samouczki i pliki konfiguracyjne nadal się do nich odwołują. Przeszukaj swoje repozytorium pod kątem obu ciągów znaków, w tym dostarczonych bibliotek SDK i notebooków, a następnie ponownie sprawdź swój model kosztów w odniesieniu do bieżących stawek.

Czy powinienem używać DeepSeek V4-Pro czy V4.1-Flash?

Przeprowadź obliczenia, zanim założysz, że Flash jest tańszy. Wejście V4-Pro z pamięcią podręczną za 0,022 USD poza godzinami szczytu jest około 7 razy tańsze niż wejście Flash bez pamięci podręcznej za 0,15 USD (wyliczone), więc dobrze buforowany model flagowy może całkowicie pokonać niebuforowany mały model pod względem kosztów wejścia. Objętość wyjściowa, a nie rozmiar modelu, zazwyczaj decyduje o rachunku.


Zapisz się na getaiperks.com →

Buforuj prefiks, wysyłaj poza godzinami szczytu i pozwól, aby kredyty kogoś innego pokryły resztę.

AI Perks

AI Perks zapewnia dostęp do ekskluzywnych zniżek, kredytów i ofert na narzędzia AI, usługi chmurowe i API, aby pomóc startupom i programistom zaoszczędzić pieniądze.

AI Perks Cards

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.