Was kostet die DeepSeek API im September 2026?
DeepSeek-V4-Pro-0813 kostet 0,66 $ pro Million Cache-Miss-Input-Tokens und 1,98 $ pro Million Output-Tokens außerhalb der Spitzenzeiten und exakt das Doppelte davon zu Spitzenzeiten. DeepSeek ist der einzige große Modell-Anbieter, der nach Tageszeit abrechnet, weshalb jede einzelne "DeepSeek API-Preis"-Angabe, die Sie lesen, mindestens einen Teil der Woche falsch ist.
Aktuell veröffentlichte Preise in USD pro Million Tokens:
| Modell | Input, Cache Hit | Input, Cache Miss | Output |
|---|---|---|---|
| DeepSeek-V4-Pro-0813, außerhalb der Spitzenzeiten | 0,022 $ | 0,66 $ | 1,98 $ |
| DeepSeek-V4-Pro-0813, Spitzenzeiten | 0,044 $ | 1,32 $ | 3,96 $ |
| DeepSeek-V4.1-Flash, außerhalb der Spitzenzeiten | 0,003 $ | 0,15 $ | Nicht bestätigt |
| DeepSeek-V4.1-Flash, Spitzenzeiten | 0,006 $ | 0,30 $ | Nicht bestätigt |
Die Preise für Flash-Output werden als unbestätigt markiert und nicht geschätzt, da die veröffentlichte Seite von DeepSeek dies nicht bestätigt hat. Überprüfen Sie dies selbst, bevor Sie Ihr Budget dafür festlegen.
Das sind die eigenen Tarife von DeepSeek. DeepSeek bietet kein Startguthabenprogramm an, was es unter den führenden Anbietern zur Ausnahme macht: AI Perks erfasst 7,7 Millionen US-Dollar an Guthaben über 194 Unternehmen und DeepSeek gehört nicht dazu.

Spitzenzeiten und außerhalb der Spitzenzeiten: DeepSeek rechnet nach der Uhr ab
Die Spitzenzeiten sind werktags von 01:00-04:00 und 06:00-10:00 UTC. Alles andere, einschließlich des gesamten Wochenendes, gilt als außerhalb der Spitzenzeiten zum halben Preis.
Das sind sieben Spitzenstunden pro Werktag, 35 pro Woche. Abgeleitet von diesen Fenstern wird etwa 79 % der Woche zum Tarif außerhalb der Spitzenzeiten abgerechnet (133 von 168 Stunden).
Wenn man die Fenster auf die Pekinger Zeit umrechnet, wird die Logik offensichtlich. 01:00-04:00 UTC entspricht 09:00-12:00 Ortszeit und 06:00-10:00 UTC entspricht 14:00-18:00 Uhr. Das Spitzenzeitfenster von DeepSeek ist der chinesische Arbeitstag mit einer aus der Mitte herausgeschnittenen Mittagspause, was eine abgeleitete Arithmetik auf den angegebenen UTC-Fenstern ist und keine Behauptung, die DeepSeek aufstellt.
Für ein Team außerhalb Asiens, das sich in der Nähe von kostenlosem Geld befindet. Basierend auf den angegebenen Fenstern und den Verschiebungen im September 2026, hier ist, wie viel eines lokalen 09:00-18:00 Uhr-Arbeitstages in das Spitzenzeitfenster fällt:
| Standort des Teams | Lokale Zeit 09:00-18:00 Uhr, in UTC | Arbeitszeit zum Spitzenpreis |
|---|---|---|
| US Pazifik (UTC-7) | 16:00-01:00 | 0 von 9 |
| US Ostküste (UTC-4) | 13:00-22:00 | 0 von 9 |
| UK (UTC+1) | 08:00-17:00 | 2 von 9 |
| Mitteleuropa (UTC+2) | 07:00-16:00 | 3 von 9 |
| Indien (UTC+5:30) | 03:30-12:30 | 4,5 von 9 |
| China (UTC+8) | 01:00-10:00 | 7 von 9 |
Ein US-Team, das interaktiven Verkehr während der Geschäftszeiten bedient, zahlt niemals den Spitzenpreis von DeepSeek. Ein europäisches Team zahlt ihn für ein Drittel des Tages und kann Batch-Arbeiten aus dem Zeitfenster 06:00-10:00 UTC verlagern, um ihn vollständig zu vermeiden, ohne zusätzliche Ingenieurskosten.
Cache-Treffer sind der andere Multiplikator, und sie stapeln sich
Ein Cache-Treffer auf DeepSeek-V4-Pro kostet 0,022 $ pro Million Input-Tokens im Vergleich zu 0,66 $ für einen Miss, also exakt 30x günstiger (abgeleitet). Wenn man das mit den Zeiten außerhalb der Spitzenzeiten kombiniert, erreicht die Spanne zwischen dem besten und dem schlechtesten Input-Preis für dasselbe Modell 60x.
Vergleichen Sie 0,022 $ pro Million für einen gecachten Token außerhalb der Spitzenzeiten mit 1,32 $ pro Million für einen Cache-Miss zu Spitzenzeiten. Gleiches Modell, gleicher Token, 60x Unterschied.
Hier ist, was die beiden Multiplikatoren mit einer echten Rechnung machen. Nehmen wir 50 Mio. Input-Tokens und 10 Mio. Output-Tokens pro Monat für V4-Pro, wobei jede Zahl aus den obigen Preisen abgeleitet ist:
| Szenario | Input | Output | Monatlicher Gesamtbetrag |
|---|---|---|---|
| Spitzenzeiten, Cache-Miss | 66,00 $ | 39,60 $ | 105,60 $ |
| Spitzenzeiten, Cache-Treffer | 2,20 $ | 39,60 $ | 41,80 $ |
| Außerhalb der Spitzenzeiten, Cache-Miss | 33,00 $ | 19,80 $ | 52,80 $ |
| Außerhalb der Spitzenzeiten, Cache-Treffer | 1,10 $ | 19,80 $ | 20,90 $ |
Identische Arbeit, eine Spanne von 5x, und die einzigen beiden Variablen sind, wann Sie die Anfrage senden und ob Ihr Prompt-Präfix stabil ist.
Eine weitere Schlussfolgerung aus dieser Tabelle. Sobald Ihr Input gecacht ist, machen die Ausgaben etwa 95 % der Rechnung aus (19,80 $ von 20,90 $). Die Cache-Optimierung hat eine Obergrenze, und darüber hinaus ist der einzige verbleibende Hebel die Generierung von weniger Output-Tokens.

Was hat sich bei DeepSeek V4 seit dem letzten Preisleitfaden geändert?
Jeder DeepSeek-Leitfaden, der einen einzigen Pauschalpreis für Input zitiert, wurde vor dem 16. August 2026 verfasst und ist nun in beide Richtungen falsch: zu hoch für außerhalb der Spitzenzeiten, zu niedrig für Spitzenzeiten.
| Datum | Veröffentlichung | Was hat sich geändert |
|---|---|---|
| 24. April 2026 | V4-Pro und V4-Flash Vorschau | 1M-Token-Kontext, bis zu 384K Ausgabe, umschaltbare Denk- und Nicht-Denk-Modi (Konfidenz: mittel) |
| 31. Juli 2026 | DeepSeek-V4-Flash-0731 | Stabile Flash-Linie zu einem Pauschalpreis von 0,14 $ für Cache-Miss-Input, 0,28 $ für Ausgabe (historisch, jetzt abgelöst) |
| 13. August 2026 | DeepSeek-V4-Pro-0813 | Allgemeine Verfügbarkeit des Flaggschiff-Modells für Logik und Agenten |
| Ca. 10. September 2026 | DeepSeek-V4.1-Flash | Aktuelle Flash-Generation, live in den Dokumenten als "DeepSeek-Flash" |
Der Vergleich von Flash von Juli bis September ist die klarste Illustration. 0,14 $ pro Million Cache-Miss-Input-Tokens wurden zu 0,15 $ außerhalb der Spitzenzeiten und 0,30 $ zu Spitzenzeiten. Außerhalb der Spitzenzeiten ist der Preis ungefähr der alte, zu Spitzenzeiten ist er mehr als doppelt so hoch (abgeleitet). Verkehr, der im Spitzenzeitfenster landet, wurde um 114 % teurer (abgeleitet: 0,30 $ gegenüber 0,14 $), während die Schlagzeile "günstig" blieb.
Die Umbenennung des Endpunkts, die alten DeepSeek-Code bricht
DeepSeek-V4.1-Flash hat die Modellnamen deepseek-v4-flash und deepseek-v4-flash-vision-exp leise eingestellt. Code und Tutorials, die sich noch darauf beziehen, werden fehlschlagen.
Dies ist der häufigste Grund, warum eine DeepSeek-Integration, die im August funktionierte, im September nicht mehr funktioniert. Es handelt sich nicht um eine schrittweise Warnung vor der Einstellung, sondern um eine Modellkennung, die nicht mehr aufgelöst wird.
Daraus ergeben sich zwei Regeln:
Fixieren Sie den Modellnamen an einem Ort. Wenn der String in sechs Dateien erscheint, ist eine Umbenennung sechs Bearbeitungen und ein Produktionsvorfall.
Betrachten Sie jedes Tutorial, das älter als einen Monat ist, als ein Namensrisiko. Diese einzelne Veröffentlichung hat zwei Bezeichner gleichzeitig stillgelegt, ohne eine Frist für die Warnung. Kopieren Sie die Architektur aus einem alten Leitfaden und überprüfen Sie dann den Modellstring anhand der aktuellen Dokumentation.

Gibt es eine kostenlose Stufe oder Startguthaben für die DeepSeek API?
Die DeepSeek Chat-App ist kostenlos. Die API hat auf der offiziellen Preisgestaltungsseite keine angegebene kostenlose Stufe, und DeepSeek führt kein spezielles Startguthabenprogramm durch.
Hier liegen die meisten DeepSeek-Artikel falsch. Behauptungen, dass neue API-Konten kostenlose Guthaben erhalten, werden inkonsistent berichtet und auf der offiziellen Preisgestaltungsseite von DeepSeek nicht bestätigt. Behandeln Sie dies als unbestätigt und nicht als einen Plan, auf den Sie Ihr Budget abstimmen können.
Das fehlende Startprogramm ist die größere Lücke. Fast jeder andere führende Anbieter, einschließlich Anthropic, OpenAI, Google und der großen Clouds, bietet eine Form von Guthabenprogramm für Unternehmen in der Frühphase an. DeepSeek tut dies nicht, was bedeutet, dass das günstigste Modell auf dem Markt auch dasjenige ist, das Sie nicht kostenlos erhalten können.
Das kehrt die übliche Empfehlung um. Nutzen Sie kostenlose Guthaben dort, wo sie existieren, und zahlen Sie die bereits niedrigen Tarife von DeepSeek dort, wo sie nicht existieren. AI Perks verfolgt 7,7 Millionen US-Dollar an Guthaben über 194 Unternehmen, die die Anbieter abdecken, die ein Programm anbieten.
Die Hebel, die eine DeepSeek-Rechnung tatsächlich beeinflussen
Preisen Sie Ihre eigene Arbeitslast zuerst. Multiplizieren Sie Ihre erwarteten monatlichen Input- und Output-Tokens durch die vier oben genannten Szenarien. Wenn die Spanne gering ist, sind die Timing-Mechanismen von DeepSeek für Sie nicht relevant und jeder Anbieter ist geeignet.
Prüfen Sie, wo Ihr Datenverkehr in UTC landet. Interaktiver Verkehr aus den USA befindet sich bereits außerhalb der Spitzenzeiten. Europäische und asiatische Teams können diesen Teil der Rechnung halbieren, indem sie Batch-Jobs aus den Zeiten 01:00-04:00 und 06:00-10:00 UTC verlagern.
Stabilisieren Sie Ihr Prompt-Präfix. Cache-Treffer sind bei V4-Pro etwa 30x günstiger als Misses. Ein System-Prompt, der bei jedem Aufruf geändert wird, zum Beispiel weil er einen Zeitstempel interpoliert, verwirft dies.
Fixieren Sie den Modellstring und überprüfen Sie ihn anhand der aktuellen Dokumentation, da deepseek-v4-flash nicht mehr existiert.
Decken Sie den Rest des Stacks mit Guthaben ab. DeepSeek wird Ihnen keines geben, aber die meisten Ihrer anderen Anbieter schon. Beginnen Sie unter getaiperks.com.
Bei Hosting durch Dritte: OpenRouter, Together, Fireworks und Baseten bedienen alle DeepSeek-Modelle. Der Kompromiss ist strukturell und keine Frage von Cents, da Aggregatoren einen Pauschalpreis berechnen. Das Routing über einen von ihnen bedeutet normalerweise den Verzicht auf den Rabatt außerhalb der Spitzenzeiten im Austausch für Zuverlässigkeit, eine einzige Rechnung und einen Fallback, wenn der eigene Endpunkt von DeepSeek langsam ist. Baseten listet DeepSeek V4.1 Flash Input für 0,30 $ pro Million und bietet ein stehendes Startguthaben von 30 $ für neue Arbeitsbereiche an, beides hier unbestätigt, also bestätigen Sie dies vor der Budgetierung. Beachten Sie, dass 0,30 $ genau dem Spitzenpreis von DeepSeek entsprechen, sodass ein Pauschalpreis auf diesem Niveau nur dann von Vorteil ist, wenn Ihr Datenverkehr ohnehin Spitzenverkehr gewesen wäre.

Häufig gestellte Fragen
Was kostet die DeepSeek API?
DeepSeek-V4-Pro-0813 kostet 0,66 $ pro Million Cache-Miss-Input-Tokens und 1,98 $ pro Million Output-Tokens außerhalb der Spitzenzeiten. Zu Spitzenzeiten, werktags von 01:00-04:00 und 06:00-10:00 UTC, kostet es genau das Doppelte. Gecachter Input liegt bei 0,022 $ pro Million. Guthaben für den Rest Ihres Stacks werden unter getaiperks.com erfasst.
Wann sind die Spitzenzeiten von DeepSeek?
Spitzenzeiten sind werktags von 01:00-04:00 und 06:00-10:00 UTC. Alles andere, einschließlich des gesamten Wochenendes, gilt als außerhalb der Spitzenzeiten zum halben Preis. Abgeleitet von diesen Fenstern werden etwa 79 % der Woche zum günstigeren Tarif abgerechnet, und die Fenster entsprechen dem chinesischen Arbeitstag beiderseits der Mittagspause.
Hat die DeepSeek API eine kostenlose Stufe?
Auf der offiziellen Preisgestaltungsseite von DeepSeek ist keine API-Gratisstufe aufgeführt. Die DeepSeek Chat-App ist kostenlos nutzbar, aber das ist ein separates Produkt. Behauptungen über kostenloses API-Guthaben für Neukunden werden inkonsistent berichtet und sind nicht bestätigt. Für bestätigte Guthaben siehe getaiperks.com.
Bietet DeepSeek Startguthaben an?
DeepSeek führt kein spezielles Startguthabenprogramm durch, was unter den führenden Modell-Anbietern ungewöhnlich ist. Der praktikable Ansatz ist, kostenlose Guthaben von den Anbietern zu nutzen, die eines anbieten, und die niedrigen Tarife von DeepSeek für alles andere zu zahlen. AI Perks erfasst 7,7 Millionen US-Dollar über 194 Unternehmen.
Warum hat mein DeepSeek API-Aufruf aufgehört zu funktionieren?
Die wahrscheinlichste Ursache ist der Modellname. DeepSeek-V4.1-Flash hat die Bezeichner deepseek-v4-flash und deepseek-v4-flash-vision-exp eingestellt, sodass Code oder Tutorials, die vor September 2026 geschrieben wurden und sich darauf beziehen, mit einer nicht mehr auflösbaren Modellkennung fehlschlagen werden. Überprüfen Sie den Modellstring anhand der aktuellen Dokumentation, bevor Sie etwas anderes debuggen.
Ist DeepSeek direkt günstiger als über OpenRouter oder Baseten?
Außerhalb der Spitzenzeiten in der Regel ja, da Aggregatoren einen Pauschalpreis berechnen und keinen Zeitrabatt weitergeben können. Baseten listet V4.1 Flash Input für 0,30 $ pro Million, was dem Spitzenpreis von DeepSeek entspricht. Aggregatoren punkten bei Zuverlässigkeit und Routing, nicht beim Preis außerhalb der Spitzenzeiten.
Abonnieren Sie auf getaiperks.com →
Das günstigste Modell auf dem Markt ist das, das niemand verschenkt. Planen Sie entsprechend.