DeepSeek Hat Keinen Einzigen Preis Pro Token
DeepSeek-V4-Pro hat vier Eingabepreise, nicht nur einen: $0,022, $0,044, $0,66 und $1,32 pro Million Tokens. Welchen Preis Sie zahlen, hängt von der Tageszeit und davon ab, ob der Prompt den Cache getroffen hat. Das ist eine 60-fache Spanne für dasselbe Modell, denselben Prompt und denselben Tag.
Jede "DeepSeek vs ChatGPT"-Tabelle, die eine Zahl pro Modell ausgibt, vergleicht eine Zahl, die nicht existiert. DeepSeek ist der einzige große Modell-Anbieter, der nach Tageszeit abrechnet. Spitzenzeiten sind Montag bis Freitag von 01:00 bis 04:00 Uhr und von 06:00 bis 10:00 Uhr UTC, und alles außerhalb dieser Zeitfenster, einschließlich Wochenenden, wird zum halben Preis abgerechnet.
Hier sind die veröffentlichten Listenpreise pro Million Tokens, beide Hälften eingeschlossen.
| Modell | Cache-Treffer Eingabe | Frische Eingabe | Ausgabe |
|---|---|---|---|
| DeepSeek-V4-Pro, Nebensaison | $0,022 | $0,66 | $1,98 |
| DeepSeek-V4-Pro, Hauptsaison | $0,044 | $1,32 | $3,96 |
| DeepSeek-Flash, Nebensaison | $0,003 | $0,15 | nicht veröffentlicht |
| DeepSeek-Flash, Hauptsaison | $0,006 | $0,30 | nicht veröffentlicht |
Die letzte Spalte ist keine Auslassung unsererseits. DeepSeek veröffentlicht die Ein- und Ausgaberaten für Cache-Hits und -Misses für die V4.1 Flash-Reihe, aber keine Ausgaberate, sodass jeder Leitfaden, der eine Flash-Ausgaberate angibt, etwas zitiert, das DeepSeek nicht angegeben hat. Wir werden es nicht wiederholen, und Ihr Budget-Tabellenkalkulationsprogramm sollte es auch nicht tun.
Die gleiche Disziplin gilt in die andere Richtung. Wir veröffentlichen keine OpenAI-Listenpreise, die wir nicht auf der OpenAI-Preisseite überprüft haben, da sich diese Raten ändern und eine veraltete Zahl in einer Vergleichstabelle schlechter ist als keine Zahl. Lesen Sie diesen Beitrag für die Struktur der DeepSeek-Abrechnung, und ermitteln Sie dann die ChatGPT-Preise aus der Quelle. AI Perks verfolgt die dritte Variable, Credits, die kein Listenpreis enthält.

Wer Tatsächlich DeepSeeks Spitzenpreise Zahlt
Spitzenpreise decken sieben Stunden pro Werktag ab, oder 35 von 168 Stunden der Woche, sodass etwa 79 % der gesamten Uhrzeit zum halben Preis abgerechnet werden (abgeleitet). Nebensaison ist kein Rabattfenster. Es ist der normale Satz für den größten Teil der Welt.
Umgerechnet auf UTC+8 laufen die Spitzenzeitfenster von 09:00 bis 12:00 Uhr und von 14:00 bis 18:00 Uhr, wobei die Lücke über die Mittagspause fällt. Das ist die Form eines Arbeitstages im Heimatmarkt von DeepSeek. DeepSeek hat dies nicht als Grund angegeben, daher behandeln Sie die Übereinstimmung als Beobachtung und nicht als Tatsache, aber sie sagt genau voraus, wer mehr zahlt.
| Teamstandort | Arbeitstag in UTC | Stunden in der Spitzenzeit |
|---|---|---|
| San Francisco (UTC-7) | 16:00 bis 00:00 | 0 von 8 |
| New York (UTC-4) | 13:00 bis 21:00 | 0 von 8 |
| London (UTC+1) | 08:00 bis 16:00 | 2 von 8 |
| Berlin (UTC+2) | 07:00 bis 15:00 | 3 von 8 |
| Bengaluru (UTC+5:30) | 03:30 bis 11:30 | 4,5 von 8 |
| Shenzhen (UTC+8) | 01:00 bis 09:00 | 6 von 8 |
Ein US-Team, das während der Geschäftszeiten interaktiven Traffic betreibt, berührt niemals den Spitzenpreis. Ein europäisches Team zahlt ihn für die ersten zwei oder drei Stunden jedes Morgens, was ein konkretes Argument dafür ist, Batch- und Auswertungsaufträge nach dem Mittagessen statt vor dem Standup zu planen.
Der Cache-Treffer Ist Wichtiger Als Die Uhr
Wenn Sie eine Workload aus der Spitzenzeit in die Nebensaison verlagern, halbiert sich die Rechnung. Wenn sie im Cache landet, wird sie um das 30-fache reduziert. Auf DeepSeek-V4-Pro kostet ein gecachter Eingabetoken pro Million Nebensaison $0,022, während ein frischer $0,66 kostet, genau das 30-fache (abgeleitet). Der Hebel der Nebensaison ist das 2-fache wert. Die meisten Teams optimieren den 2-fachen Hebel und ignorieren den 30-fachen.
Zwei abgeleitete Vergleiche machen die Reihenfolge offensichtlich:
- Ein gecacheter Token auf dem Flaggschiff V4-Pro Nebensaison ($0,022) ist 6,8x günstiger als ein frischer Token auf dem Budget-Flash-Modell Nebensaison ($0,15). Caching schlägt Downgrading.
- Selbst ein gecachter V4-Pro-Token zum Spitzenpreis ($0,044) ist 3,4x günstiger als ein frischer Flash-Token Nebensaison. Caching schlägt Downgrading und das Warten auf günstige Stunden kombiniert.
Wenn die Cache-Hit-Rate von 50 % auf 90 % bei V4-Pro erhöht wird, sinken die gemischten Eingabekosten von $0,341 auf $0,0858 pro Million Tokens, eine 4,0-fache Reduzierung (abgeleitet), die keine Terminplanung erreichen kann.
Drei praktische Konsequenzen:
Präfix-Stabilität schlägt Prompt-Kürze. Ein langer System-Prompt, der sich nie ändert, ist günstiger als ein kurzer, den Sie pro Anfrage neu schreiben, da nur das stabile Präfix gecacht wird.
Setzen Sie den variablen Teil zuletzt. Alles, was vor dem abgerufenen Kontext eingefügt wird, macht den Cache für alles danach ungültig.
Cache-Tiefe ist eine Preisentscheidung, keine technische. DeepSeek bepreist einen V4-Pro-Cache-Hit mit 3,3 % eines frischen Tokens und einen Flash-Hit mit 2,0 % (beides abgeleitet). Anbieter, die Cache-Hits zu einem flacheren Bruchteil der frischen Eingabe bepreisen, geben Ihnen viel weniger zur Optimierung. Dieses Verhältnis, nicht der Schlagzeilenpreis, ist das, was bei Anbietern verglichen werden sollte.

Was Eine Reale Aufgabe Tatsächlich Kostet
Nehmen Sie einen realistischen Retrieval-Augmented Agentenaufruf: 40.000 Eingabetoken mit einer Cache-Hit-Rate von 80 %, plus 2.000 Ausgabentoken. Alle untenstehenden Zahlen sind von den oben veröffentlichten Raten abgeleitet.
| Szenario | Eingabekosten | Ausgabekosten | Gesamt |
|---|---|---|---|
| V4-Pro, Nebensaison | $0,00598 | $0,00396 | $0,00994 |
| V4-Pro, Hauptsaison | $0,01197 | $0,00792 | $0,01989 |
| Flash, Nebensaison | $0,00130 | nicht veröffentlicht | nicht bezifferbar |
| Flash, Hauptsaison | $0,00259 | nicht veröffentlicht | nicht bezifferbar |
Zwei Dinge ergeben sich daraus. Erstens kosten V4-Pro-Eingaben bei dieser Aufgabe 4,6x mehr als Flash-Eingaben (abgeleitet), was eine weitaus geringere Lücke ist, als die Modellstufen vermuten lassen, da der 80%ige Cache-Hit bei beiden den Großteil der Arbeit leistet. Zweitens ist die Gesamtaufgabe für Flash aus veröffentlichten Daten nicht berechenbar. Wenn ein Vergleichsartikel Ihnen eine Zahl gibt, fragen Sie, woher die Ausgaberate stammt.
Wo Der Günstige Ruf Zusammenbricht
Wenn DeepSeek über einen Drittanbieter-Host geleitet wird, wird die Aufteilung zwischen Spitzen- und Nebensaison in einen einzigen Pauschalpreis umgewandelt, sodass Sie 100 % der Zeit etwas nahe am Spitzenpreis zahlen. Baseten listet beispielsweise DeepSeek V4.1 Flash-Eingaben zu $0,30 pro Million auf, was identisch mit DeepSeeks eigenem Spitzen-Cache-Miss-Satz ist und doppelt so hoch wie der Nebensaison-Satz von $0,15 (Basetens veröffentlichte Zahl, die vor der Budgetierung darauf überprüft werden sollte; sein Ausgaberatesatz wurde nicht zuverlässig bestätigt). Baseten bietet ein dauerhaftes Testguthaben von $30 für neue Arbeitsbereiche an.
OpenRouter, Together und Fireworks hosten ebenfalls DeepSeek-Modelle. Ihre Tarife sind ihre eigenen und ändern sich, daher verifizieren Sie jeden selbst, anstatt einer Zahl in einem Blogbeitrag, einschließlich diesem, zu vertrauen. Der qualitative Kompromiss ist stabil: Sie gewinnen Routing-Komfort, Ausfallsicherheit und eine einzige Rechnung und verzichten dauerhaft auf den 50 % Nebensaison-Rabatt. Für Traffic, der hauptsächlich außerhalb der Spitzenzeiten läuft, ist dieser Kompromiss negativ.

Was Sich Seit Den Älteren DeepSeek Preisleitfäden Geändert Hat
Jeder DeepSeek-Leitfaden, der vor dem 16. August 2026 geschrieben wurde, zitiert einen einzigen Pauschalpreis. Dieser Preis existiert nicht mehr. Wenn ein Artikel eine Zahl pro Modell ohne Erwähnung von Spitzenzeiten angibt, stammt er aus der Zeit vor der aktuellen Struktur.
- 24. April 2026: DeepSeek V4-Pro und V4-Flash werden in der Vorschau mit einem Kontextfenster von 1 Mio. Tokens, bis zu 384.000 Ausgabetoken und umschaltbaren Denk- und Nicht-Denk-Modi ausgeliefert.
- 31. Juli 2026: DeepSeek-V4-Flash-0731 wird zur stabilen Flash-Version. Die damalige Preisgestaltung war ein Pauschalpreis von $0,14 pro Million Cache-Miss-Eingaben und $0,28 pro Million Ausgaben, ohne Zeitkomponente. Das ist Geschichte, kein Satz, den Sie heute kaufen können.
- 13. August 2026: DeepSeek-V4-Pro-0813 erreicht die allgemeine Verfügbarkeit als Flaggschiff-Modell für logisches Denken und Agenten.
- 16. August 2026: Spitzen- und Nebensaisonpreise werden eingeführt.
- Um den 10. September 2026: DeepSeek-V4.1-Flash kommt auf den Markt, in der Dokumentation einfach als DeepSeek-Flash aufgeführt.
Eine wichtige Änderung verdient eine eigene Notiz, da sie stillschweigend funktionierenden Code zum Absturz bringt. DeepSeek-V4.1-Flash hat die Endpunktnamen deepseek-v4-flash und deepseek-v4-flash-vision-exp ausgemustert. Tutorials, Forenantworten und kopierte Codebeispiele verweisen immer noch auf diese Strings und werden gegen die Live-API fehlschlagen. Überprüfen Sie den aktuellen Modellbezeichner in der eigenen Dokumentation von DeepSeek anstelle einer Codebeispiel, da die Benennung in fünf Monaten bereits zweimal geändert wurde.
DeepSeek Hat Kein Startguthaben-Programm
Die DeepSeek Chat-App ist kostenlos. Die API ist es nicht, und DeepSeek gibt keine kostenlose Stufe auf seiner offiziellen Preisseite an. Behauptungen über kostenlose API-Credits für neue DeepSeek-Konten kursieren weit verbreitet, werden inkonsistent gemeldet und nicht auf der offiziellen Seite bestätigt. Behandeln Sie sie als unbestätigt.
Wichtiger für Gründer: DeepSeek hat kein spezielles Startguthaben-Programm. Keine Zuschüsse, keine stagespezifische Zuteilung, keine subventionierte Stufe. Sie laden ein Guthaben auf und geben es aus. Günstig pro Token, keine Subvention.
Das ist der einzige Ort, an dem der Kostenvorteil umgekehrt wird. Ein Anbieter, der pro Token ein Vielfaches mehr verlangt, aber einem jungen Unternehmen fünfstellige Beträge an Credits gewährt, ist im ersten Jahr günstiger als ein günstiger Anbieter ohne Subvention. Die Kosten pro Token sind nur dann die richtige Metrik, wenn jemand tatsächlich Bargeld bezahlt.
Die meisten Anbieter, mit denen DeepSeek konkurriert, führen Kreditprogramme durch. AI Perks verfolgt 7,7 Mio. $ an Credits über 194 Unternehmen, was die gesamte Ebene ist, die Listenpreisvergleiche übersehen.
Der praktische Stack: gutgeschriebene Kapazität von den Anbietern, die sie gewähren, DeepSeek-Flash Nebensaison als bezahlter Standard, aggressives Präfix-Caching für alles, was zu Spitzenzeiten läuft, und ein verifizierter Fallback für die Stunden, die Sie nicht verschieben können. Beginnen Sie mit den Credits, da diese der einzige Teil der Rechnung sind, der auf Null gehen kann. Siehe, was derzeit verfügbar ist.

Häufig Gestellte Fragen
Ist DeepSeek Günstiger Als ChatGPT?
Diese Frage hat allein auf DeepSeeks Seite vier Antworten. Die frische Eingabe von DeepSeek-V4-Pro kostet $0,66 pro Million Nebensaison und $1,32 bei Spitzenzeiten, und ein gecachter Token kostet $0,022 Nebensaison. Vergleichen Sie Ihren eigenen Traffic mit den aktuellen veröffentlichten Tarifen von OpenAI und gewichten Sie jeden DeepSeek-Tarif mit dem Anteil der Anrufe, die tatsächlich darauf landen. Die Antwort hängt von Ihrer Uhrzeit und Ihrer Cache-Hit-Rate ab, nicht vom Anbieter.
Was Sind DeepSeeks Spitzenzeiten?
Spitzenzeiten sind Montag bis Freitag von 01:00 bis 04:00 Uhr und von 06:00 bis 10:00 Uhr UTC. Alles andere, einschließlich Wochenenden, wird zum halben Spitzenpreis abgerechnet. Das macht etwa 79 % der Woche zur Nebensaison. Teams in US-Zeitzonen berühren während der normalen Geschäftszeiten überhaupt selten Spitzenpreise.
Bietet DeepSeek Kostenlose API-Credits Oder Ein Startprogramm An?
Nein. Die DeepSeek Chat-App ist kostenlos nutzbar, aber auf der offiziellen Preisseite ist keine kostenlose API-Stufe angegeben, und Berichte über Anmelde-Credits sind inkonsistent und unbestätigt. DeepSeek betreibt auch kein Startguthaben-Programm, im Gegensatz zu vielen der bei AI Perks verfolgten Anbietern.
Warum Ist Mein DeepSeek API-Aufruf Fehlgeschlagen?
DeepSeek-V4.1-Flash hat die Modellbezeichner deepseek-v4-flash und deepseek-v4-flash-vision-exp stillschweigend und ohne Übergangszeit ausgemustert. Ältere Tutorials und kopierte Beispiele verweisen immer noch darauf und werden fehlschlagen. Holen Sie sich den aktuellen Bezeichner aus der Live-Dokumentation von DeepSeek, bevor Sie etwas anderes debuggen.
Was Kostet DeepSeek-Flash Für Ausgabentoken?
DeepSeek hat dies nicht veröffentlicht. Die V4.1 Flash-Reihe listet nur Cache-Hit- und Cache-Miss-Eingaberaten auf. Jede Gesamtkosten-pro-Aufgabe-Zahl, die Sie für Flash sehen, basiert auf einer angenommenen Ausgaberate, behandeln Sie sie also als Schätzung und nicht als Preis.
Ist Es Günstiger, DeepSeek Über Einen Drittanbieter-Host Zu Betreiben?
Normalerweise nicht, wenn Ihr Traffic außerhalb der Spitzenzeiten läuft. Hosts berechnen einen Pauschalpreis ohne Spitzen- und Nebensaison-Aufteilung, sodass Sie den 50 % Nebensaison-Rabatt dauerhaft im Austausch gegen Routing-Komfort und Ausfallsicherheit aufgeben. Überprüfen Sie den aktuellen Tarif jedes Hosts selbst, bevor Sie wechseln, da die Margen variieren und sich häufig ändern.
Wie Viel Sparen Kostenlose KI-Credits Einem Startup Tatsächlich?
Genug, um den Vergleich umzukehren. Ein Anbieter, der pro Token ein Vielfaches mehr verlangt, aber fünfstellige Beträge an Credits gewährt, ist im ersten Jahr günstiger als ein günstiger Anbieter ohne Subvention. AI Perks verfolgt 7,7 Mio. $ an Credits über 194 Unternehmen, was die Ebene ist, die Listenpreisvergleiche vollständig ignorieren.
Abonnieren Sie wöchentliche Credit-Drops
Preis pro Token ist die einfache Zahl. Preis pro Aufgabe, nach Abzug der Credits, ist die Zahl, die auf der Kreditkarte erscheint.