Was kostet die DeepSeek API im Jahr 2026?
DeepSeek-V4-Pro-0813 kostet 0,66 $ pro Million Eingabetokens bei einem Cache-Miss und 1,98 $ pro Million Ausgabetokens außerhalb der Spitzenzeiten, und während der Spitzenzeiten genau das Doppelte. DeepSeek ist der einzige große Modell-Anbieter, der einen anderen Preis berechnet, je nachdem, zu welcher Tageszeit Sie die Anfrage senden.
Zwei Multiplikatoren entscheiden über Ihre gesamte DeepSeek-Rechnung: die Uhrzeit und ob die Eingabe den Cache getroffen hat. Jede andere Preisfrage zu DeepSeek ist eine Folge dieser beiden Faktoren.
| Modell und Fenster | Eingabe, Cache-Treffer | Eingabe, Cache-Miss | Ausgabe |
|---|---|---|---|
| V4-Pro-0813, außerhalb der Spitzenzeiten | 0,022 $ | 0,66 $ | 1,98 $ |
| V4-Pro-0813, Spitzenzeiten | 0,044 $ | 1,32 $ | 3,96 $ |
| V4.1-Flash, außerhalb der Spitzenzeiten | 0,003 $ | 0,15 $ | DeepSeek hat dies nicht veröffentlicht |
| V4.1-Flash, Spitzenzeiten | 0,006 $ | 0,30 $ | DeepSeek hat dies nicht veröffentlicht |
Alle Angaben sind USD pro Million Token, entnommen aus der eigenen API-Dokumentation von DeepSeek im September 2026. DeepSeek bepreist aggressiv und ist auch der einzige große Anbieter ohne Angebote für Start-ups, eine Lücke, die AI Perks zu füllen sich zum Ziel gesetzt hat.

Wie die Spitzenzeit- und Nebenzeit-Preisgestaltung von DeepSeek funktioniert
Spitzenzeiten sind wochentags von 01:00 bis 04:00 Uhr und von 06:00 bis 10:00 Uhr UTC. Jede andere Stunde, einschließlich des gesamten Samstags und Sonntags, ist Nebenzeit und kostet nur die Hälfte.
Das sind sieben Spitzenstunden pro Tag an fünf Tagen, also 35 Stunden von den 168 Stunden in der Woche. Abgeleitet von den veröffentlichten Fenstern sind 79 % der Woche Nebenzeit. Der teure Satz ist die schmale Ausnahme, nicht die Regel, was das Gegenteil davon ist, wie die meisten Leute die Ankündigung lesen.
Rechnen Sie die Fenster um und das Design wird offensichtlich. 01:00 bis 04:00 Uhr UTC ist 09:00 bis 12:00 Uhr in Peking, und 06:00 bis 10:00 Uhr UTC ist 14:00 bis 18:00 Uhr. Die Spitzenpreisgestaltung von DeepSeek ist der chinesische Arbeitstag, wobei die Mittagspause als Nebenzeit berechnet wird. Niemand stellt es so dar, und dies ist die einzige Tatsache, die Ihnen sagt, ob die Aufteilung Sie betrifft.
Für ein Team, das die Amerikas bedient, ist dies fast ein kostenloser Rabatt. Ein Arbeitstag von 09:00 bis 18:00 Uhr in der US-Ostküste erstreckt sich von etwa 13:00 bis 22:00 Uhr UTC, was vollständig in die Nebenzeit fällt. Wenn Ihr Datenverkehr den Geschäftszeiten der USA folgt, verwenden Sie bereits den niedrigeren Satz und haben nichts getan, um ihn zu verdienen.
Die Teams, die tatsächlich Spitzenzeiten zahlen, sind diejenigen, die den asiatischen Tagesverkehr bedienen, sowie alle, die nächtliche Batch-Jobs ausführen, die zufällig in das Zeitfenster von 06:00 bis 10:00 Uhr UTC fallen. Verschieben Sie diesen Batch außerhalb des Fensters von 06:00 bis 10:00 Uhr UTC, in die Lücke von 04:00 bis 06:00 Uhr oder auf nach 10:00 Uhr, und seine Rechnung halbiert sich ohne Codeänderung.
Warum ein Cache-Treffer die Uhr schlägt
Bei V4-Pro kosten gecachte Eingaben 0,022 $ pro Million Token gegenüber 0,66 $ für einen Cache-Miss. Das ist ein 30-facher Rabatt im Vergleich zu einem 2-fachen Rabatt für die Zeitplanung. Nebenzeit halbiert Ihre Rechnung. Caching teilt sie durch dreißig.
Stacken Sie beide, und die Spanne bei einem Modell wird extrem. Ein Spitzenzeit-Cache-Miss für 1,32 $ im Vergleich zu einem Nebenzeit-Cache-Treffer für 0,022 $ ist ein 60-facher Unterschied für dasselbe Token auf demselben Modell. Bei V4.1-Flash ist die Spanne noch größer: 0,30 $ Spitzenzeit-Cache-Miss gegenüber 0,003 $ Nebenzeit-Cache-Treffer entspricht dem 100-fachen. Beide Verhältnisse ergeben sich aus den veröffentlichten Tarifen.
Hier ist, was das bei einer realistischen Agenten-Auslastung von 10 Mio. Eingabe- und 2 Mio. Ausgabetoken pro Tag bedeutet, abgeleitet von den oben genannten Tarifen:
| Tägliche Kostenzeile | Spitzenzeiten, ohne Caching | Nebenzeiten, 90 % Cache-Treffer |
|---|---|---|
| 10 Mio. Eingabetoken | 13,20 $ | 0,86 $ |
| 2 Mio. Ausgabetoken | 7,92 $ | 3,96 $ |
| Gesamt pro Tag | 21,12 $ | 4,82 $ |
| Gesamt pro 30 Tagen | 633,60 $ | 144,54 $ |
Das Interessante ist nicht die 4,4-fache Ersparnis. Es ist die Form der zweiten Spalte: Sobald die Eingabe gecached ist, sind die Ausgaben 82 % der Rechnung. Ausgabetoken erhalten auf keiner Ebene einen Caching-Rabatt. Nach einer bestimmten Caching-Qualität ist der einzige verbleibende Hebel für die DeepSeek-Ausgaben, wann Ihre Anfragen eintreffen. Teams, die das Caching stark optimieren und dann aufhören, lassen den zweiten Multiplikator unberührt.
Wenn die Modellkosten der Posten sind, den Sie abschaffen und nicht nur reduzieren möchten, sind Gutschriften von den Anbietern, die sie ausstellen, der schnellere Weg, und AI Perks verfolgt 7,7 Millionen Dollar an Gutschriften bei 194 Unternehmen.

Was hat sich an der DeepSeek-Preisgestaltung in diesem Jahr geändert?
Die Änderung vom August 2026 war keine Preissenkung. Es war eine Preisaufteilung. Jeder DeepSeek-Leitfaden, der vor dem 16. August 2026 veröffentlicht wurde, einschließlich der früheren DeepSeek-Preisgestaltungsseite auf dieser Website, gibt einen einzigen Festpreis pro Modell an, und diese Modellkosten von DeepSeek beschreiben die Rechnung nicht mehr.
| Datum | Veröffentlichung | Preiseffekt |
|---|---|---|
| 24. April 2026 | Vorschau auf V4-Pro und V4-Flash | 1 Mio. Token Kontext, bis zu 384K Ausgabe, umschaltbare Denkmodi |
| 31. Juli 2026 | DeepSeek-V4-Flash-0731 | Festpreis: 0,14 $ Cache-Miss-Eingabe, 0,28 $ Ausgabe |
| 13. August 2026 | V4-Pro-0813 von DeepSeek allgemein verfügbar | Flaggschiff-Argumentations- und Agentenmodell |
| 16. August 2026 | Einführung der Aufteilung zwischen Spitzen- und Nebenzeit | Tageszeit wird zum Preismultiplikator |
| ca. 10. September 2026 | DeepSeek-V4.1-Flash | Neue Eingaberaten, ältere Endpunktnamen eingezogen |
Vergleichen Sie die Flash-Zeile davor und danach. Der alte Festpreis betrug 0,14 $ pro Million Cache-Miss-Eingabetoken. Der neue Nebenzeit-Tarif beträgt 0,15 $ und der Spitzenzeit-Tarif 0,30 $. Die Nebenzeit lag ungefähr dort, wo der Festpreis bereits lag, während die Spitzenzeit mehr als doppelt so hoch ist (abgeleitet). Wenn Ihr Datenverkehr sich auf die asiatischen Geschäftszeiten konzentriert, ist Ihre Flash-Rechnung im August gestiegen, obwohl sich keine Schlagzeilenzahl verschlechtert hat.
Die April-Vorschau-Zahlen und die Juli-Festpreise sind hier historische Kontexte mit mittlerer Zuverlässigkeit, keine aktuellen Preise. Bepreisen Sie alles, was Sie tatsächlich versenden, anhand der Live-Dokumente.
Die Endpunktnamen, die DeepSeek leise eingezogen hat
DeepSeek-V4.1-Flash hat die Modellnamen deepseek-v4-flash und deepseek-v4-flash-vision-exp entfernt. Jede Anfrage, die noch eine dieser Zeichenfolgen sendet, wird fehlschlagen.
Dies ist die Änderung, die Teams einen Nachmittag kostet, da sie nicht in einer Preistabelle aufgeführt ist und nicht anmutig abbaut. Der Aufruf wird entweder einem aktuellen Modellnamen zugeordnet oder erzeugt einen Fehler.
Die meisten Tutorials, Stack Overflow-Antworten und Starter-Repos, die vor September 2026 veröffentlicht wurden, hartcodieren immer noch die eingezogenen Namen. Wenn eine DeepSeek-Integration, die im August funktionierte, im September nicht mehr funktionierte und nichts anderes geändert wurde, überprüfen Sie den Modellidentifikator, bevor Sie etwas anderes überprüfen.

Bietet DeepSeek kostenlose API-Gutschriften oder Start-up-Gutschriften an?
Die DeepSeek-Chat-App ist kostenlos nutzbar. Die API hat keine angegebene kostenlose Stufe auf der offiziellen Preisseite von DeepSeek, und DeepSeek betreibt überhaupt kein spezielles Start-up-Gutschriftenprogramm.
Seien Sie vorsichtig mit der Zweitversion davon. Mehrere Websites geben an, dass neue DeepSeek-API-Konten kostenlose Startguthaben erhalten. Diese Behauptung wird inkonsistent berichtet und ist auf der offiziellen Preisseite von DeepSeek nicht bestätigt, behandeln Sie sie also als nicht verifiziert und nicht als Budget. Die ehrliche Antwort ist, dass DeepSeek mit dem Listenpreis konkurriert, nicht mit Geschenken.
Drittanbieter-Hosts sind die andere Route. Baseten listet DeepSeek V4.1 Flash Input für 0,30 $ pro Million auf und bietet ein dauerhaftes Testguthaben von 30 $ für neue Arbeitsbereiche, was dem kostenlosen DeepSeek-Kapazitätsangebot mit einer echten Zahl am nächsten kommt. OpenRouter, Together und Fireworks hosten ebenfalls DeepSeek-Modelle; ihre Tarife ändern sich oft genug, dass Sie sie selbst lesen sollten, anstatt einer Zahl in einem Artikel zu vertrauen. Das Routing über einen Host glättet auch die Spitzen- und Nebenzeit-Frage, da der Host seine eigene Preisliste festlegt.
Das hinterlässt eine echte Lücke für Gründer. DeepSeek gehört zu den günstigsten Möglichkeiten, Inferenzen im Jahr 2026 durchzuführen, und ist der einzige große Modell-Anbieter, der Ihr erstes Jahr nicht finanziert. Fast jeder andere Anbieter auf Ihrer Auswahlliste tut dies, weshalb der praktische Stack DeepSeek zum Listenpreis für Volumenarbeiten plus finanzierte Gutschriften überall sonst ist. AI Perks verfolgt, welche dieser Programme derzeit geöffnet sind.
Häufig gestellte Fragen
Was sind die Spitzenzeiten von DeepSeek?
Spitzenzeiten sind wochentags von 01:00 bis 04:00 Uhr und von 06:00 bis 10:00 Uhr UTC. Alles außerhalb dieser Fenster, einschließlich des gesamten Wochenendes, ist Nebenzeit und kostet die Hälfte. Das ergibt 35 Spitzenstunden in einer 168-Stunden-Woche, also zahlen Sie ungefähr 79 % der Zeit den niedrigeren Satz.
Wie viel kostet die DeepSeek API pro Million Token?
DeepSeek-V4-Pro-0813 kostet 0,66 $ pro Million Eingabetoken bei einem Cache-Miss und 1,98 $ pro Million Ausgabetoken außerhalb der Spitzenzeiten. Die Spitzenpreise sind genau doppelt so hoch: 1,32 $ und 3,96 $. Gecachte Eingaben sinken außerhalb der Spitzenzeiten auf 0,022 $. Kostenlose Gutschriften für die Anbieter, die sie ausstellen, werden unter AI Perks verfolgt.
Hat DeepSeek eine kostenlose API-Stufe?
Die DeepSeek-Chat-App ist kostenlos nutzbar. Die API hat keine angegebene kostenlose Stufe auf der offiziellen Preisseite von DeepSeek. Behauptungen, dass neue API-Konten kostenlose Startguthaben erhalten, werden inkonsistent berichtet und nicht offiziell bestätigt. Bauen Sie also kein Budget darauf auf. Verifizierte Gutschriftenprogramme anderer Anbieter sind unter AI Perks aufgeführt.
Bietet DeepSeek Start-up-Gutschriften an?
Nein. DeepSeek betreibt kein spezielles Start-up-Gutschriftenprogramm, was es unter den großen Modell-Anbietern ungewöhnlich macht. Baseten, das DeepSeek-Modelle hostet, bietet ein dauerhaftes Testguthaben von 30 $ für neue Arbeitsbereiche an. Für die Anbieter, die Gründerprogramme anbieten, verfolgt AI Perks 7,7 Millionen Dollar an Gutschriften bei 194 Unternehmen unter getaiperks.com.
Warum hat mein DeepSeek API-Aufruf aufgehört zu funktionieren?
Höchstwahrscheinlich der Modellname. DeepSeek-V4.1-Flash hat die Endpunktnamen deepseek-v4-flash und deepseek-v4-flash-vision-exp eingezogen, und jede Anfrage, die noch eine dieser Zeichenfolgen sendet, wird fehlschlagen. Ältere Tutorials und Codebeispiele wurden vor der Änderung geschrieben und nie aktualisiert. Tauschen Sie den Modellidentifikator gegen einen aktuellen aus, und der Aufruf funktioniert wieder.
Ist DeepSeek im Jahr 2026 immer noch die günstigste API?
Zum Listenpreis ist die Nebenzeit-Gecachte-Eingabe für 0,022 $ pro Million für fast jeden schwer zu schlagen. Aber die Aufteilung im August bedeutet, dass ein direkter Vergleich mit anderen Anbietern nicht mehr aussagekräftig ist: Ihr effektiver DeepSeek-Satz hängt davon ab, wann Ihr Datenverkehr eintrifft und wie gut Sie cachen. Vergleichen Sie mit Ihrem eigenen Verkehrsmuster, nicht mit einer Tabelle.
Abonnieren Sie unter getaiperks.com →
DeepSeek berechnet nach der Uhrzeit. Alle anderen geben Ihnen einfach die Gutschriften.