Was kostet DeepSeek für Coding-Arbeiten im Jahr 2026?
DeepSeek-V4-Pro-0813 kostet außerhalb der Spitzenzeiten 0,66 $ pro Million Cache-Miss-Input-Token und 1,98 $ pro Million Output-Token. Während der Spitzenzeiten verdoppeln sich beide Beträge. Cache-Hits bei Eingaben sinken außerhalb der Spitzenzeiten auf 0,022 $ pro Million, was den eigentlichen Kostentreiber darstellt.
DeepSeek ist der einzige große Modell-Anbieter, der nach Tageszeit abrechnet. Zwei Multiplikatoren stapeln sich und erzählen zusammen die ganze Geschichte darüber, was DeepSeek tatsächlich kostet: Außerhalb der Spitzenzeiten halbiert sich die Rechnung, und ein Cache-Hit ist etwa 30x günstiger als ein Cache-Miss.
Diese Kombination ist für Coding besonders wichtig. Eine agentenbasierte Coding-Schleife spielt bei jedem Durchlauf denselben Repository-Kontext erneut ab. Daher ist dies die einzige Workload, bei der hohe Cache-Hit-Raten eher strukturell als glücklich bedingt sind.
DeepSeek selbst bietet kein Startguthaben-Programm an. Anbieter, die dies tun, werden bei AI Perks verfolgt, zusammen mit 194 Unternehmen mit Gutschriften im Wert von 7,7 Millionen US-Dollar.

Spitzen- und Nicht-Spitzenzeiten-Preise: Die Mechanik, die niemand erklärt
Die Spitzenzeiten von DeepSeek sind Wochentags von 01:00 bis 04:00 Uhr und von 06:00 bis 10:00 Uhr UTC. Alles andere, einschließlich des gesamten Samstags und Sonntags, gilt als Nicht-Spitzenzeit zum halben Preis.
Aktuelle Listenpreise pro Million Token:
| Modell | Input, Cache-Hit | Input, Cache-Miss | Output |
|---|---|---|---|
| DeepSeek-V4-Pro-0813, außerhalb der Spitzenzeiten | 0,022 $ | 0,66 $ | 1,98 $ |
| DeepSeek-V4-Pro-0813, Spitzenzeiten | 0,044 $ | 1,32 $ | 3,96 $ |
| DeepSeek-V4.1-Flash, außerhalb der Spitzenzeiten | 0,003 $ | 0,15 $ | nicht veröffentlicht |
| DeepSeek-V4.1-Flash, Spitzenzeiten | 0,006 $ | 0,30 $ | nicht veröffentlicht |
Aus diesen Zeitfenstern ergeben sich zwei Punkte, die fast niemand laut ausspricht. Beide sind abgeleitete Berechnungen aus dem veröffentlichten UTC-Zeitplan und keine zitierten Werte.
Die Spitzenzeiten machen nur etwa 21 % der Woche aus. Sieben Spitzenstunden pro Wochentag sind 35 Stunden von 168. Knapp 80 % der gesamten Uhrzeit fallen bereits in die Nicht-Spitzenzeiten, bevor Sie etwas ändern.
Ein voller US-Arbeitstag berührt niemals die Spitzenzeiten. 9 Uhr bis 17 Uhr Pazifikzeit ist 16:00 bis 24:00 Uhr UTC. 9 Uhr bis 17 Uhr Ostküstenzeit ist 13:00 bis 21:00 Uhr UTC. Keines der Zeitfenster überschneidet sich mit einem Spitzenblock, sodass Teams mit Sitz in den USA versehentlich die Hälfte des Preises zahlen. Europäische Morgenstunden sind die Ausnahme: 08:00 bis 10:00 Uhr UTC ist Spitzenzeit, was 9 bis 11 Uhr in London und 10 bis 12 Uhr in Berlin entspricht.
Es gibt auch eine zweistündige Lücke außerhalb der Spitzenzeiten zwischen den beiden Spitzenblöcken, von 04:00 bis 06:00 Uhr UTC, was ein kostenloser Parkplatz für nächtliche CI-Jobs und Batch-Refactorings ist.
Warum Cache-Hits für Coding wichtiger sind als für Chat
Ein Cache-Hit bei DeepSeek-V4-Pro kostet außerhalb der Spitzenzeiten 0,022 $ pro Million Token gegenüber 0,66 $ für einen Miss, ein Unterschied von 30x, und Coding-Agenten erzeugen die höchsten natürlichen Hit-Raten aller Workloads.
Chat-Verkehr ist ein Strom von nicht zusammenhängenden kurzen Prompts, daher sind die meisten Eingaben neu. Ein Coding-Agent ist das Gegenteil: Er behält den gleichen Dateibaum, den gleichen System-Prompt und denselben aktuellen Diff während jeder Runde einer langen Sitzung bei.
Hier ist, was die beiden Multiplikatoren mit einem identischen Arbeitsaufwand machen. Illustrative Volumina, Arithmetik abgeleitet von den obigen Listenpreisen:
| Ein Agentenlauf: 2 Mio. Input, 200.000 Output | Kosten |
|---|---|
| Außerhalb der Spitzenzeiten, 90 % Cache-Hit-Rate | 0,57 $ |
| Spitzenzeiten, 90 % Cache-Hit-Rate | 1,14 $ |
| Außerhalb der Spitzenzeiten, kein Caching | 1,72 $ |
| Spitzenzeiten, kein Caching | 3,43 $ |
Gleiche Token, gleiches Modell, gleiche Ausgabe. Eine Spanne von 6x bei identischer Arbeit, die ausschließlich von der Uhrzeit und der Cache-Disziplin abhängt.
Wenn man es auf die Spitze treibt, vergrößert sich die Spanne weiter: ein gecachter Input-Token außerhalb der Spitzenzeiten für 0,022 $ pro Million gegenüber einem Peak-Cache-Miss-Token für 1,32 $ pro Million ergibt eine 60x Spanne für dasselbe Modell. Kein anderer Anbieter hat einen solchen Hebel, weshalb auch so wenige Tutorials ihn erwähnen.
Bei tausend Agentenläufen pro Monat ergeben sich aus derselben abgeleiteten Arithmetik grob 570 $ gegenüber grob 3.430 $. Für ein Team, das auch für Claude oder GPT für die anspruchsvollen Aufgaben bezahlt, deckt AI Perks die Gutschriftsseite dieser Rechnung ab.

Was hat sich bei DeepSeek seit der Einführung von V4 geändert?
Vier Veröffentlichungen in fünf Monaten haben DeepSeek von einem flachen Preis pro Token zu einem Preis nach Tageszeit gebracht, und die meisten veröffentlichten Anleitungen zitieren immer noch die alten flachen Zahlen.
Die Sequenz, mit angegebener Konfidenz, wo sie angebracht ist:
- 24. April 2026: DeepSeek V4-Pro und V4-Flash Vorschau. 1 Mio. Token Kontext, bis zu 384.000 Output-Token, umschaltbare Denk- und Nicht-Denk-Modi. (Konfidenz: mittel.)
- 31. Juli 2026: DeepSeek-V4-Flash-0731, die stabile Flash-Version. Die Preise betrugen damals 0,14 $ pro Million Cache-Miss-Input und 0,28 $ pro Million Output. (Nur historischer Kontext, keine aktuellen Preise.)
- 13. August 2026: DeepSeek-V4-Pro-0813 erreicht allgemeine Verfügbarkeit als führendes Modell für Schlussfolgerungen und Agenten.
- 16. August 2026: Die Aufteilung in Spitzen- und Nicht-Spitzenzeiten tritt in Kraft und die flachen Preise enden.
- Etwa 10. September 2026: DeepSeek-V4.1-Flash, live in der Dokumentation als "DeepSeek-Flash".
Wenn Sie einen Kostenvergleich von DeepSeek lesen, der einen einzigen Eingabepreis und einen einzigen Ausgabepreis ohne Erwähnung von UTC-Stunden anzeigt, stammt er vom 16. August 2026 oder früher, und seine Schlussfolgerungen sind in beide Richtungen falsch.
Die Endpunkt-Umbenennung, die alten Code bricht
DeepSeek-V4.1-Flash hat die Modellnamen deepseek-v4-flash und deepseek-v4-flash-vision-exp stillschweigend ausgemustert. Code, der diese immer noch übergibt, wird fehlschlagen.
Dies ist die Art von Änderung, die ein Team zu einer ungünstigen Stunde ausbremst, da der Fehler zur Laufzeit in jedem Dienst auftritt, der den String festlegt, nicht zur Build-Zeit. Ältere Tutorials, Stack Overflow-Antworten und kopierte Konfigurationsdateien enthalten immer noch die ausgemusterten Namen.
Zwei praktische Konsequenzen. Erstens, durchsuchen Sie Ihr Repository vor Ihrem nächsten Deployment nach beiden Zeichenketten, nicht danach. Zweitens, behandeln Sie jedes DeepSeek-Tutorial, das vor September 2026 veröffentlicht wurde, als unzuverlässig in Bezug auf Modell-Identifikatoren und Preise.

Hat DeepSeek eine kostenlose Stufe oder Startguthaben?
Die DeepSeek-Chat-App ist kostenlos nutzbar. Auf der offiziellen Preisgestaltungsseite gibt es keine angegebene kostenlose API-Stufe, und DeepSeek bietet überhaupt kein spezielles Startguthaben-Programm an.
Seien Sie vorsichtig mit den zweiten und dritten Punkten, da die meisten Websites hier DeepSeek falsch darstellen. Behauptungen, dass neue API-Konten kostenlose Gutschriften erhalten, sind inkonsistent gemeldet und nicht auf der offiziellen Preisgestaltungsseite bestätigt. Jeder, der eine spezifische Gutschriftsfigur für neue Konten nennt, wiederholt etwas, das DeepSeek nicht veröffentlicht hat.
Das Fehlen eines Startprogramms ist die nützlichere Tatsache. Günstige Preise pro Token sind nicht dasselbe wie ein Zuschuss, und ein Gründer, der nur auf den Listenpreis optimiert, lässt die größere Zahl auf dem Tisch liegen:
| Route | Was es tatsächlich ist |
|---|---|
| DeepSeek Chat-App | Kostenlos, kein API-Zugang |
| DeepSeek API | Bezahlt ab dem ersten Token, keine angegebene kostenlose Stufe |
| DeepSeek Startguthaben | Existiert nicht |
| Andere große Modell-Anbieter | Viele bieten spezielle Startguthaben-Programme an |
DeepSeek ist der günstigste Weg zu bezahlen. Es ist kein Weg, nicht zu bezahlen. Das sind unterschiedliche Strategien, und die stärksten Teams verfolgen beide: DeepSeek für volumengesteuerte, gecachte Coding-Arbeiten, zu denen noch gutgeschriebene Credits für die Spitzenmodelle hinzukommen. AI Perks verfolgt, welche Anbieter die zweite Hälfte derzeit finanzieren.
Drittanbieter-Hosts sind eine Teillösung. Baseten listet DeepSeek V4.1 Flash Input für 0,30 $ pro Million und bietet ein stehendes Testguthaben von 30 $ für neue Arbeitsbereiche (Konfidenz: mittel, vor der Budgetierung überprüfen). OpenRouter, Together und Fireworks hosten ebenfalls DeepSeek-Modelle. Ihre Preise ändern sich oft genug, sodass der ehrliche Rat lautet, sie am Tag selbst zu überprüfen, anstatt sich auf Zahlen in einem Blogbeitrag zu verlassen, einschließlich dieses.
So senken Sie Ihre DeepSeek Coding-Rechnung
Schritt 1: Decken Sie die Spitzenmodelle mit Gutschriften ab. Prüfen Sie unter getaiperks.com, welche Anbieter diese Stufe derzeit finanzieren, damit DeepSeek nur die Volumenarbeit übernimmt.
Schritt 2: Prüfen Sie, in welcher Zeitzone Ihre Agenten tatsächlich laufen. Wenn Ihre CI-Jobs, nächtlichen Refactorings oder Batch-Evaluierungsjobs zwischen 01:00 und 04:00 Uhr oder 06:00 und 10:00 Uhr UTC laufen, halbiert das Verschieben um wenige Stunden diesen Posten ohne Codeänderung.
Schritt 3: Machen Sie das gecachte Präfix stabil. Alles, was Ihre System-Prompt neu ordnet, einen Zeitstempel einfügt oder den Datei-Kontext mischt, verwandelt ein Token für 0,022 $ in ein Token für 0,66 $.
Schritt 4: Teilen Sie die Modelle nach Job auf. V4-Pro für Schlussfolgerungen und Agenten-Schleifen, Flash für Klassifizierung, Linting und die günstigen Hochfrequenz-Aufrufe drumherum.
Schritt 5: Auditing Sie Ihre Modell-Strings jetzt. Die ausgemusterten Flash-Endpunktnamen sind eine geplante Ausfallzeit, die auf den nächsten Deployment wartet.

Häufig gestellte Fragen
Wie viel kostet DeepSeek für Coding?
DeepSeek-V4-Pro-0813 kostet außerhalb der Spitzenzeiten 0,66 $ pro Million Cache-Miss-Input-Token und 1,98 $ pro Million Output-Token. Spitzenzeiten kosten genau das Doppelte. Cached Input kostet außerhalb der Spitzenzeiten 0,022 $ pro Million. Tatsächliche Coding-Rechnungen liegen zwischen diesen Extremen, abhängig von der Cache-Hit-Rate und der Uhrzeit.
Was sind die Spitzen- und Nicht-Spitzenzeiten von DeepSeek?
Die Spitzenzeiten sind Wochentags von 01:00 bis 04:00 Uhr und von 06:00 bis 10:00 Uhr UTC. Alles andere, einschließlich Wochenenden, gilt als Nicht-Spitzenzeit zum halben Preis. Daraus abgeleitet sind etwa 80 % der Woche außerhalb der Spitzenzeiten, und ein normaler US-Arbeitstag liegt vollständig außerhalb beider Spitzenfenster.
Bietet DeepSeek kostenlose API-Gutschriften an?
Die Chat-App von DeepSeek ist kostenlos, aber auf der offiziellen Preisgestaltungsseite gibt es keine angegebene kostenlose API-Stufe. Berichte über kostenlose Gutschriften für neue API-Konten sind inkonsistent und unbestätigt. DeepSeek bietet auch kein Startguthaben-Programm an, im Gegensatz zu den meisten großen Anbietern, die bei AI Perks verfolgt werden.
Warum hat mein DeepSeek API-Aufruf aufgehört zu funktionieren?
DeepSeek-V4.1-Flash hat die Modellnamen deepseek-v4-flash und deepseek-v4-flash-vision-exp ausgemustert. Jeder Code, jedes Tutorial oder jede Konfiguration, die diese Strings noch übergibt, wird zur Laufzeit fehlschlagen. Die Umbenennung wurde nicht laut angekündigt, sodass ältere Beispiele und kopierte Konfigurationen sie immer noch enthalten. Suchen Sie in Ihrem Repository nach beiden Zeichenketten und aktualisieren Sie sie auf den aktuellen Flash-Identifier.
Ist DeepSeek für Coding billiger als Claude oder GPT?
Im Listenpreis erheblich, besonders bei einer hohen Cache-Hit-Rate außerhalb der Spitzenzeiten. In den Gesamtkosten ändert sich der Vergleich, sobald Startguthaben ins Spiel kommen, da DeepSeek keine gewährt und viele Konkurrenten dies tun. Prüfen Sie unter AI Perks, was die Alternativen finanzieren, bevor Sie etwas annehmen.
Sollte ich DeepSeek stattdessen über OpenRouter oder Baseten nutzen?
Drittanbieter-Hosts bieten Routing-Flexibilität, Fallback und manchmal Testguthaben, aber sie bepreisen unabhängig vom Spitzen- und Nicht-Spitzenzeitplan von DeepSeek. Baseten bietet ein stehendes Testguthaben von 30 $ für neue Arbeitsbereiche. Verifizieren Sie jede gehostete Per-Token-Zahl am Tag, da diese Preise häufig wechseln.
Abonnieren Sie unter getaiperks.com →
DeepSeek ist der günstigste Weg zu bezahlen. Gutschriften sind der Weg, nicht zu bezahlen.