DeepSeek Off-Peak Preise: Halbiere deine API-Rechnung

DeepSeek berechnet außerhalb der Spitzenzeiten, 01:00-04:00 und 06:00-10:00 UTC an Wochentagen, den halben Preis. Die Fenster, der Cache-Multiplikator und was es wirklich spart.

DeepSeekDeepSeek PricingOff-Peak PricingLLM API CostsAI Perks
Author Avatar
Andrew
AI Perks Team
11,617

Quick Answer

DeepSeek berechnet außerhalb der Spitzenzeiten den halben Preis. Spitzenzeiten sind Wochentags von 01:00 bis 04:00 Uhr und von 06:00 bis 10:00 Uhr UTC. Basierend auf diesen Zeitfenstern liegt etwa 79 % der Woche im Nebenzeittarif. Kombiniert mit Prompt-Caching, das etwa 30-mal günstiger ist als ein Cache-Miss bei V4-Pro, ergibt sich in diesem Artikel eine Reduzierung von 74 % auf eine Beispielrechnung für V4-Pro. Kreditprogramme von Anbietern, die solche anbieten, werden auf getaiperks.com verfolgt.

Wie viel spart man mit DeepSeek Off-Peak-Preisen?

DeepSeek ist der einzige große Modell-Anbieter, der nach Tageszeit abrechnet. Spitzenzeiten sind wochentags von 01:00 bis 04:00 und von 06:00 bis 10:00 UTC. Alles außerhalb dieser Fenster kostet genau die Hälfte.

Das sind sieben Spitzenstunden pro Wochentag, also 35 Stunden von den 168 Stunden pro Woche. Etwa 79 % des Kalenders sind bereits Off-Peak (basierend auf den veröffentlichten Fenstern). Die meisten Teams zahlen den vollen Preis für einen Bruchteil ihres Datenverkehrs und bemerken nie, dass sie es tun.

Der Rabatt ist keine Aktion und keine gestaffelte Nutzung. Er wird automatisch basierend auf der Uhrzeit angewendet, wenn die Anfrage eintrifft. AI Perks verfolgt die Preise und Kreditprogramme von Anbietern bei 194 Unternehmen, und dies ist der am meisten übersehene Kostenhebel von allen.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Wann sind DeepSeek Spitzenzeiten in Ihrer Zeitzone?

Die Spitzenzeitfenster sind in UTC festgelegt, daher hängt es vollständig davon ab, wo Sie sich befinden, wann sie in Ihrem Arbeitstag liegen. Für nordamerikanische Teams ist der gesamte Geschäftstag bereits Off-Peak.

Umgerechnet aus den veröffentlichten UTC-Fenstern:

StandortSpitzenzeitfenster 1Spitzenzeitfenster 2
UTC01:00-04:0006:00-10:00
China (UTC+8)09:00-12:0014:00-18:00
Indien (UTC+5:30)06:30-09:3011:30-15:30
Mitteleuropa (UTC+2)03:00-06:0008:00-12:00
UK (UTC+1)02:00-05:0007:00-11:00
US East Coast (UTC-4)21:00-00:0002:00-06:00
US West Coast (UTC-7)18:00-21:0023:00-03:00

Die Spalte China erklärt das gesamte Design. Beide Spitzenzeitfenster fallen in den chinesischen Arbeitstag, morgens und nachmittags, mit der Mittagspause dazwischen als Off-Peak. Spitzenpreise sind Stoßzeitpreise für DeepSeeks Heimatmarkt.

Zwei praktische Konsequenzen:

Wenn Sie sich in den USA befinden, sind Sie wahrscheinlich bereits versehentlich Off-Peak. Ihr 9-to-5-Verkehr liegt außerhalb beider Fenster. Was Sie erwischt, ist der nächtliche Cron-Job, der genau dann beginnt, wenn die Spitzenzeit beginnt.

Wenn Sie sich in Europa befinden, ist Ihr Morgen teuer und Ihr Nachmittag kostet die Hälfte. Das lokale Fenster von 08:00 bis 12:00 Uhr deckt den geschäftigsten Teil eines europäischen Arbeitstages ab.

Die Fenster sind in UTC festgelegt, daher verschieben sich die lokalen Zeiten mit der Sommerzeit, und ein Sonntagabend in Amerika kann in das erste Spitzenzeitfenster des Montags fallen.


Der Cache-Multiplikator, der zusätzlich zählt

Off-Peak halbiert Ihre Rechnung. Ein Cache-Treffer reduziert die Input-Kosten um etwa das 30-fache. Beides multipliziert sich und erklärt zusammen fast die gesamte Spanne dessen, was verschiedene Teams DeepSeek für identische Arbeit zahlen.

Aktuelle veröffentlichte Preise in USD pro Million Tokens:

ModellToken-TypOff-PeakPeak
DeepSeek-V4-Pro-0813Input, Cache-Treffer$0.022$0.044
DeepSeek-V4-Pro-0813Input, Cache- Fehltreffer$0.66$1.32
DeepSeek-V4-Pro-0813Output$1.98$3.96
DeepSeek-V4.1-FlashInput, Cache-Treffer$0.003$0.006
DeepSeek-V4.1-FlashInput, Cache-Fehltreffer$0.15$0.30

Ein gecachter Off-Peak-Input-Token für $0.022 im Vergleich zu einem Peak-Cache-Fehltreffer für $1.32 ist eine 60-fache Spanne für dasselbe Modell. Nichts an der Anfrage hat sich geändert, außer wann sie lief und ob das Präfix bereits vorhanden war.

Hier sehen Sie, wie das bei einer tatsächlichen monatlichen Auslastung von 50 Mio. Input- und 10 Mio. Output-Tokens für V4-Pro aussieht (Arithmetik abgeleitet aus der obigen Tabelle):

KonfigurationInputOutputMonatliche Gesamtsumme
Peak, keine Caching$66.00$39.60$105.60
Peak, 80% Cache-Treffer$14.96$39.60$54.56
Off-Peak, keine Caching$33.00$19.80$52.80
Off-Peak, 80% Cache-Treffer$7.48$19.80$27.28

Das ist eine Reduzierung um 74 % für dieselben Tokens und dasselbe Modell. Die beiden mittleren Zeilen entscheiden, welchen Hebel man zuerst betätigt: Allein die Zeitverschiebung ($52.80) übertrifft das Caching allein ($54.56), und es ist eine Zeile Cron-Konfiguration anstelle einer Prompt-Refaktorierung.

Beachten Sie dann das Detail, das fast niemand erwähnt: Bei 27,28 $ machen die Output-Tokens 19,80 $ der Rechnung aus, etwa 73 %. Sobald Sie cachen und auf Off-Peak umstellen, ist DeepSeek kein Input-Kostenproblem mehr, sondern ein Problem der Output-Länge. Das Kürzen ausführlicher Antworten ist dann mehr wert als jede weitere Prompt-Optimierung.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Was hat sich seit dem letzten DeepSeek Preisleitfaden geändert

DeepSeek-V4-Pro-0813 erreichte am 13. August 2026 die allgemeine Verfügbarkeit, und die Preise nach Tageszeit traten am 16. August 2026 in Kraft. Jeder DeepSeek-Kostenleitfaden, der vor diesen Daten verfasst wurde, beschreibt ein Preismodell, das nicht mehr existiert.

Die entscheidende Zeitachse:

  • 24. April 2026: V4-Pro und V4-Flash Vorschau, mit einem 1-Mio.-Token-Kontextfenster, bis zu 384K Output und umschaltbaren Denk- und Nicht-Denk-Modi (Zuversicht: mittel).
  • 31. Juli 2026: DeepSeek-V4-Flash-0731, die stabile Flash-Version. Die letzten bekannten Preise vor der Änderung waren 0,14 $ pro Million Cache-Miss-Input-Tokens und 0,28 $ pro Million Output (Zuversicht: mittel, nur historische Daten).
  • 13. August 2026: V4-Pro-0813 allgemeine Verfügbarkeit.
  • 16. August 2026: Spitzen- und Off-Peak-Preise treten in Kraft.
  • Ca. 10. September 2026: DeepSeek-V4.1-Flash, live in den Dokumenten als DeepSeek-Flash.

Vergleichen Sie den alten Flat-Flash-Input-Preis von 0,14 $ mit den neuen 0,15 $ Off-Peak und 0,30 $ Peak. Die Änderung im August war keine Preissenkung, sondern eine Preissplittung. Wenn Sie Flash Off-Peak ausführen, zahlen Sie ungefähr das, was Sie immer bezahlt haben. Führen Sie ihn in einem Spitzenzeitfenster aus, und Sie zahlen etwa das Doppelte des alten Satzes. Teams, die nie auf die Uhr geschaut haben, haben stillschweigend eine Preiserhöhung hinnehmen müssen.


Die Breaking Change in DeepSeek V4.1-Flash

DeepSeek-V4.1-Flash hat die Endpunktnamen deepseek-v4-flash und deepseek-v4-flash-vision-exp eingestellt. Dagegen geschriebener Code schlägt fehl, und die meisten noch online veröffentlichten Tutorials beziehen sich auf sie.

Dies geschah ohne viel Aufhebens, was die schlimmste Art einer Breaking Change ist: Die Tutorials, Stack Overflow-Antworten und Starter-Repos, die bei DeepSeek-Abfragen gut ranken, wurden alle vor der Umstellung geschrieben und nicht aktualisiert. Wenn Sie eine Integration debuggen, die letzten Monat funktioniert hat, überprüfen Sie Ihre Modellzeichenkette, bevor Sie etwas anderes überprüfen.

Die Lektion ist verallgemeinerbar: DeepSeek dokumentiert Änderungen in den API-Dokumenten anstatt sie anzukündigen. Pinnen Sie daher Modellbezeichner explizit und lesen Sie die Preisseite vierteljährlich erneut.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Bietet DeepSeek kostenlose Credits oder ein Startup-Programm an?

Die DeepSeek-Chat-App ist kostenlos nutzbar. Auf der offiziellen Preisseite gibt es keine angegebene kostenlose API-Stufe, und DeepSeek bietet überhaupt kein dediziertes Startup-Kreditprogramm an.

Seien Sie vorsichtig mit dem, was Sie sonst noch lesen. Behauptungen, dass neue API-Konten kostenlose Credits erhalten, werden inkonsistent berichtet und nicht auf der offiziellen DeepSeek-Preisseite bestätigt. Viele Artikel wiederholen trotzdem eine Zahl. Behandeln Sie jede spezifische Zahl, die Sie sehen, als unbestätigt, bis Sie sie von DeepSeek direkt haben.

Dieses Fehlen ist die eigentliche Geschichte für Gründer. Fast jeder große Anbieter bietet jetzt irgendeine Form von Kreditprogramm an, und DeepSeek nicht. Seine Antwort auf die Kosten sind niedrige Listenpreise plus die oben genannten Off-Peak- und Cache-Mechanismen, was eine wirklich andere Strategie ist, aber es bedeutet, dass es keinen kostenlosen Start gibt, den man beantragen kann.

Der praktische Schritt ist, DeepSeek als Ihre günstige Always-on-Stufe zu behandeln und die teuren Stufen mit Credits von den Anbietern zu finanzieren, die Programme anbieten. AI Perks verfolgt 7,7 Mio. $ an Credits bei 194 Unternehmen, von denen dieser Start tatsächlich kommt.

Finden Sie die Programme, die Credits geben, unter getaiperks.com →

Für das Hosting durch Dritte listet Baseten DeepSeek V4.1 Flash Input für 0,30 $ pro Million auf und bietet eine einmalige Testgutschrift von 30 $ für neue Arbeitsbereiche an (vor der Budgetierung prüfen). OpenRouter, Together und Fireworks hosten ebenfalls DeepSeek-Modelle. Ihre Preise ändern sich oft genug, dass die Routing-Entscheidung auf Latenz, Region und Zuverlässigkeit basieren sollte, und dann zum Zeitpunkt der Verpflichtung neu bewertet werden sollte.


Wie man eine Workload um Off-Peak-Zeiten herum umstrukturiert

Schritt 1: Finanzieren Sie zuerst Ihre Premium-Stufe. Starten Sie unter getaiperks.com und sammeln Sie Credits für die Anbieter, an die Sie schwierige Aufgaben leiten, damit DeepSeek nur die Volumenarbeit trägt.

Schritt 2: Verschieben Sie jeden Batch-Job außerhalb der Spitzenzeitfenster. Backfills, Embedding-Läufe, Auswertungsläufe und nächtliche Zusammenfassungen haben keine Frist. Das Verschieben eines Cron-Jobs um zwei Stunden ist ein Rabatt von 50 % für eine Zeile Konfiguration.

Schritt 3: Stabilisieren Sie Ihr Prompt-Präfix. Cache-Treffer hängen von einem identischen führenden Präfix ab, also legen Sie die volatilen Teile Ihres Prompts ans Ende. Hier liegt der 30-fache Wert.

Schritt 4: Messen Sie Ihre tatsächliche Cache-Hit-Rate. Die meisten Teams gehen davon aus, dass das Caching funktioniert, und haben es nie überprüft. Die Lücke zwischen einem angenommenen 80 % und einem tatsächlichen 30 % macht den größten Teil Ihrer Rechnung aus.

Schritt 5: Greifen Sie die Output-Länge an. Sobald die Schritte 2 und 3 erledigt sind, dominieren die Output-Tokens. Kürzere Antworten sind nun Ihr größter verbleibender Hebel.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Häufig gestellte Fragen

Was sind die Off-Peak-Zeiten von DeepSeek?

Off-Peak ist alles außerhalb von 01:00 bis 04:00 und 06:00 bis 10:00 UTC an Wochentagen, was etwa 79 % der Woche einschließlich aller Samstage und Sonntage ergibt. Off-Peak-Anfragen kosten genau die Hälfte des Spitzenpreises für Input- und Output-Tokens, automatisch angewendet ohne Konfiguration.

Hat DeepSeek eine kostenlose API-Stufe?

Nein. Die DeepSeek-Chat-App ist kostenlos nutzbar, aber auf der offiziellen Preisseite gibt es keine angegebene kostenlose API-Stufe. Berichte über kostenlose Credits für neue API-Konten sind inkonsistent und unbestätigt. Für tatsächliche kostenlose API-Runway siehe die bei AI Perks verfolgten Programme.

Wie viel günstiger ist ein DeepSeek-Cache-Treffer?

Auf DeepSeek-V4-Pro-0813 kostet ein Cache-Treffer 0,022 $ pro Million Input-Tokens Off-Peak im Vergleich zu 0,66 $ für einen Cache-Fehltreffer, was 30x günstiger ist. Gegenüber einem Peak-Cache-Fehltreffer von 1,32 $ erreicht die Spanne auf demselben Modell für dieselbe Anfrage 60x.

Warum hat mein DeepSeek API-Aufruf aufgehört zu funktionieren?

DeepSeek-V4.1-Flash hat die Endpunktnamen deepseek-v4-flash und deepseek-v4-flash-vision-exp eingestellt. Ältere Tutorials und Codebeispiele verweisen immer noch auf sie und schlagen nun fehl. Überprüfen Sie zuerst Ihre Modellkennzeichnung, da diese Änderung leise erfolgt ist und die meisten veröffentlichten Anleitungen nicht aktualisiert wurden. Pinnen Sie den aktuellen Namen explizit in Ihrer Konfiguration.

Hat DeepSeek ein Startup-Kreditprogramm?

Nein. DeepSeek bietet kein dediziertes Startup-Kreditprogramm an, im Gegensatz zu den meisten großen Modell-Anbietern. Seine Kostenstrategie ist ein niedriger Listenpreis plus die Off-Peak- und Caching-Rabatte stattdessen. Für Anbieter, die Startup-Credits anbieten, verfolgt AI Perks 7,7 Mio. $ bei 194 Unternehmen.

Sollte ich DeepSeek über OpenRouter oder direkt ausführen?

Direkter Zugriff ist dort, wo die Off-Peak- und Cache-Preise wie veröffentlicht gelten. Wiederverkäufer legen ihre eigenen Preise fest und geben den Rabatt nach Tageszeit möglicherweise nicht weiter. Baseten, OpenRouter, Together und Fireworks hosten alle DeepSeek-Modelle. Vergleichen Sie daher Latenz und Region und überprüfen Sie den aktuellen Preis, bevor Sie sich festlegen.


Abonnieren Sie auf getaiperks.com →

DeepSeek gibt Ihnen keine Credits. Viele andere tun es, und sie sind alle unter getaiperks.com.

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.