DeepSeek V4.1 Flash-Preise und eingestellte V4 API-Endpunkte

DeepSeek V4.1 Flash Preise, die Aufteilung in Spitzen- und Nebenzeiten, Cache-Treffer im Vergleich zu Fehlern und die Endpunktnamen deepseek-v4-flash, die jetzt fehlschlagen.

DeepSeekDeepSeek V4LLM PricingAI APIAI Perks
Author Avatar
Andrew
AI Perks Team
13,471

Quick Answer

DeepSeek V4.1 Flash kostet 0,15 $ pro Million Cache-Miss-Eingabe-Token außerhalb der Spitzenzeiten und 0,30 $ zu Spitzenzeiten, wobei zwischengespeicherte Eingaben 0,003 $ außerhalb der Spitzenzeiten kosten. DeepSeek ist der einzige große Anbieter, der nach Tageszeit abrechnet, und bietet kein Startguthabenprogramm an, im Gegensatz zu den 194 Unternehmen, die auf getaiperks.com erfasst sind.

Was kostet DeepSeek V4.1 Flash pro Million Token

DeepSeek V4.1 Flash kostet 0,15 $ pro Million Cache-Miss-Eingabetoken außerhalb der Spitzenzeiten und 0,30 $ zu den Spitzenzeiten. Ein zwischengespeicherter Eingabetoken kostet außerhalb der Spitzenzeiten 0,003 $, was 50x unter der eigenen Cache-Miss-Rate von Flash liegt (abgeleitet).

Flash kam um den 10. September 2026 und erscheint in der offiziellen Dokumentation als DeepSeek-Flash. Das Flaggschiff DeepSeek-V4-Pro-0813 ist seit dem 13. August 2026 allgemein verfügbar.

Jede Abbildung unten sind USD pro Million Token, entnommen von api-docs.deepseek.com und im September 2026 bestätigt.

Modell und FensterEingabe, Cache-TrefferEingabe, Cache-FehlerAusgabe
DeepSeek-V4-Pro-0813, außerhalb der Spitzenzeiten0,022 $0,66 $1,98 $
DeepSeek-V4-Pro-0813, Spitzenzeiten0,044 $1,32 $3,96 $
DeepSeek-V4.1-Flash, außerhalb der Spitzenzeiten0,003 $0,15 $Nicht veröffentlicht
DeepSeek-V4.1-Flash, Spitzenzeiten0,006 $0,30 $Nicht veröffentlicht

DeepSeek hat keinen veröffentlichten Ausgabepreis für V4.1 Flash, der auf der offiziellen Seite bestätigt werden kann. Wenn Sie einen anderen Preis sehen, behandeln Sie ihn als unbestätigt, bis er in der offiziellen Tabelle erscheint.

DeepSeek ist auf eine zweite Weise ungewöhnlich, die für Gründer wichtiger ist als die Zahl pro Token: Es gibt überhaupt kein Startup-Kreditprogramm. Diese Lücke wird unten behandelt, und deshalb verfolgt AI Perks die Anbieter, die eines anbieten.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Warum DeepSeek zwei verschiedene Preise für denselben Token verlangt

DeepSeek ist der einzige große Modelllieferant, der nach Tageszeit abrechnet. Spitzenzeiten sind wochentags von 01:00 bis 04:00 und 06:00 bis 10:00 UTC, und alles außerhalb dieser Fenster kostet genau die Hälfte.

Lesen Sie diese Fensterliste zweimal, denn es gibt eine Lücke in der Mitte. Der Zeitraum von 04:00 bis 06:00 UTC liegt zwischen den beiden Spitzenblöcken und wird zum Preis außerhalb der Spitzenzeiten abgerechnet. Es ist keine durchgehende neunstündige Spitzenzeit.

Abgeleitet aus den veröffentlichten Fenstern: Spitzenzeiten decken sieben Stunden pro Tag ab, nur an Wochentagen, was 35 Stunden von 168 Stunden pro Woche entspricht. Ungefähr 79 Prozent des Kalenders sind bereits außerhalb der Spitzenzeiten.

Das stellt das Problem neu dar. Sie versuchen nicht, das günstige Fenster zu finden, Sie versuchen, das teure zu vermeiden. Drei Workloads, bei denen dies fast kostenlos möglich ist:

  • Nächtliche Batch-Jobs. Ein um 08:00 UTC geplanter Job fällt in die Spitzenzeit. Ihn auf 12:00 UTC zu verschieben, halbiert die Rechnung und ändert nichts anderes.
  • Evaluierungs- und Regressionsläufe. Diese haben keine wartenden Benutzer, daher gehören sie standardmäßig außerhalb der Spitzenblöcke.
  • Embedding- und Re-Indizierungsdurchläufe. Große einmalige Eingabe-Bursts sind das am stärksten spitzenempfindliche, was die meisten Teams ausführen.

Interaktiver Verkehr ist der Teil, den Sie nicht verschieben können, und er sollte in jeder von Ihnen erstellten Prognose zu Spitzenpreisen berechnet werden.


Der Cache-Treffer ist der größere Multiplikator

Bei DeepSeek-V4-Pro kostet ein zwischengespeicherter Eingabetoken 0,022 $ pro Million gegenüber 0,66 $ für einen Fehler. Das ist ein 30-facher Unterschied (abgeleitet aus der obigen Tabelle) und übertrifft den 2-fachen Wert, den Sie durch Zeitmessung erhalten.

Die beiden Multiplikatoren stapeln sich, und dieses Stapeln ist die ganze Geschichte des Kostenprofils von DeepSeek. Ein Spitzen-Cache-Miss-Eingabetoken zu 1,32 $ gegenüber einem Off-Peak-Cache-Hit-Token zu 0,022 $ ist eine 60-fache Spanne für dasselbe Modell (abgeleitet).

Bei V4.1 Flash ist das Cache-Verhältnis noch breiter: 0,15 $ für einen Fehler gegenüber 0,003 $ für einen Treffer sind 50x (abgeleitet).

Das bedeutet in der Praxis, dass die Prompt-Struktur die Modellwahl schlägt. Der Wechsel von V4-Pro zu Flash reduziert die Eingabe bei Cache-Fehlern um das 4,4-fache (abgeleitet, 0,66 $ gegenüber 0,15 $). Wenn Ihr Cache bei V4-Pro trifft, reduziert sich die Kosten um das 30-fache. Das günstigere Modell ist der kleinere Hebel.

Cache-Treffer stammen von einem stabilen Präfix, daher sind die praktischen Regeln langweilig und effektiv: Halten Sie den System-Prompt bei Aufrufen byte-identisch, platzieren Sie Tool-Definitionen und abgerufenen Kontext vor benutzerspezifischen Inhalten und interpolieren Sie niemals einen Zeitstempel oder eine Sitzungs-ID am oberen Rand eines Prompts.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Die Endpunktnamen, die DeepSeek V4.1 Flash eingestellt hat

DeepSeek-V4.1-Flash hat die Modellnamen deepseek-v4-flash und deepseek-v4-flash-vision-exp eingestellt. Code, der immer noch einen dieser Strings sendet, wird fehlschlagen.

Eingestellter ModellnameStatus
deepseek-v4-flashMit V4.1 Flash eingestellt
deepseek-v4-flash-vision-expMit V4.1 Flash eingestellt

Dies war eine stille Änderung und keine Schlagzeilen-Abkündigung, und genau das macht sie teuer. Der Modell-String ist normalerweise die am wenigsten überprüfte Zeile in einer KI-Integration: Er befindet sich in einer Umgebungsvariable, einer Konfigurationsdatei, einer Terraform-Vorlage oder einem vendored SDK-Wrapper, und niemand fasst ihn zwischen Veröffentlichungen an.

Das größere Problem ist der lange Schwanz des Inhalts. Tutorials, YouTube-Walkthroughs, Forenantworten und generierte Code-Beispiele, die vor September 2026 geschrieben wurden, verweisen immer noch auf die alten Namen, und keiner von ihnen wird korrigiert. Ein Assistent, der von diesen Seiten gelernt hat, wird weiterhin dazu raten.

Wenn Sie DeepSeek in der Produktion betreiben, durchsuchen Sie Ihr Repository nach beiden Strings und überprüfen Sie dann separat Ihre Infrastrukturkonfiguration und jeden Geheimnisverwalter. Ein Modellname, der vor sechs Monaten in einer Bereitstellungsvariable festgelegt wurde, wird nicht in einer Codesuche angezeigt.


Was hat sich seit dem früheren DeepSeek-Preisleitfaden geändert?

Drei Dinge haben Teile jeder DeepSeek-Preisgestaltung vor Mitte August 2026 ungültig gemacht: die Aufteilung in Spitzen- und Nebenzeiten, die Aufteilung in V4-Pro und Flash sowie die eingestellten Endpunktnamen.

DatumVeröffentlichung oder ÄnderungVertrauen
24. April 2026V4-Pro und V4-Flash Vorschau: 1 Mio. Token Kontext, bis zu 384K Ausgabe, umschaltbare Denk- und Nicht-Denk-ModiMittel
31. Juli 2026DeepSeek-V4-Flash-0731, stabile Veröffentlichung der Flash-LinieMittel
13. August 2026DeepSeek-V4-Pro-0813 allgemeine VerfügbarkeitHoch
16. August 2026Einführung der Preise für Spitzen- und NebenzeitenMittel
Um den 10. September 2026DeepSeek-V4.1-Flash, alte Flash-Endpunktnamen eingestelltHoch

Die historische Zahl, die es wert ist zu wissen, sind die letzten bekannten Flash-Preise vor der Änderung vom 16. August: 0,14 $ pro Million Cache-Miss-Eingaben und 0,28 $ pro Million Ausgaben. Das ist die Zahl, die die meisten Drittanbieter-Vergleichstabellen immer noch zeigen. Es ist kein aktueller Preis, und er liegt vor dem Spitzenmultiplikator, so dass jede darauf basierende Prognose für einen spitzenlastigen Workload um etwa das 2-fache unterbewertet ist (abgeleitet: 0,14 $ gegenüber dem aktuellen Spitzen-Cache-Miss-Satz von 0,30 $ ist 2,1x).

Ein einzelner flacher Eingabepreis für DeepSeek ist jetzt bedeutungslos ohne zwei Qualifizierer: welche Seite des Caches und welche Seite der Uhr.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

DeepSeek hat keine kostenlose API-Stufe und kein Startup-Kreditprogramm

Die DeepSeek-Chat-App ist kostenlos nutzbar. Die API ist es nicht, und auf der offiziellen Preisgestaltungsseite gibt es keine angegebene kostenlose Stufe. DeepSeek bietet auch kein spezielles Startup-Kreditprogramm an.

Behauptungen, dass neue API-Konten kostenlose Credits erhalten, zirkulieren weit verbreitet und werden inkonsistent berichtet. Sie sind nicht auf der offiziellen Preisgestaltungsseite bestätigt, also planen Sie Ihren ersten Monatsaufwand so, als ob sie nicht existieren würden.

Drittanbieter-Hosts sind eine teilweise Umgehungsmöglichkeit, mit der üblichen Einschränkung, dass ihre Preise und Bedingungen ihre eigenen sind. Baseten listet DeepSeek V4.1 Flash Input mit 0,30 $ pro Million auf und bietet einen stehenden 30 $ Trial-Credit für neue Arbeitsbereiche (beides vor der Budgetierung dagegen überprüfen). OpenRouter, Together und Fireworks hosten ebenfalls DeepSeek-Modelle, und die Wahl zwischen ihnen hängt normalerweise vom Routing, der Region und den Ratenlimits ab und nicht vom Spitzenpreis.

Die eigentliche Lücke für Gründer ist struktureller Natur. Die meisten Modell- und Infrastruktur-Anbieter, auf denen ein Startup läuft, bieten eine Form von Kreditprogramm an, und die aktuellen Beträge und Konditionen für jedes einzelne werden von AI Perks verfolgt. DeepSeek bietet keine an, was bedeutet, dass DeepSeek die einzige Zeile Ihrer KI-Rechnung ist, die Sie immer bar bezahlen.

Das ist das Argument dafür, es als günstige Standardstufe innerhalb eines Stacks zu behandeln, anstatt als den gesamten Stack. Leiten Sie den volumenstarken, cache-freundlichen, außerhalb der Spitzenzeiten anfallenden Workload an DeepSeek weiter und leiten Sie die Arbeit, die Frontier-Reasoning benötigt, an einen Anbieter weiter, dessen Rechnung jemand anderes bezahlt. AI Perks verfolgt 7,7 Mio. $ an Credits über 194 Unternehmen, was die zweite Hälfte ausmacht.

Sehen Sie, welche Anbieter Kreditprogramme anbieten unter getaiperks.com →


Häufig gestellte Fragen

Wie viel kostet DeepSeek V4.1 Flash?

DeepSeek V4.1 Flash kostet 0,15 $ pro Million Cache-Miss-Eingabetoken außerhalb der Spitzenzeiten und 0,30 $ zu den Spitzenzeiten. Zwischengespeicherte Eingaben kosten außerhalb der Spitzenzeiten 0,003 $ und zu den Spitzenzeiten 0,006 $. DeepSeek hat keinen bestätigbaren Ausgabepreis für Flash veröffentlicht, behandeln Sie daher jede anderswo gefundene Ausgabezahl als unbestätigt.

Was sind die Spitzen- und Nebenzeiten von DeepSeek?

Spitzenzeiten sind wochentags von 01:00 bis 04:00 und 06:00 bis 10:00 UTC. Alles andere, einschließlich der Lücke von 04:00 bis 06:00 UTC zwischen den beiden Blöcken und der gesamten Wochenendverkehr, ist außerhalb der Spitzenzeiten zum halben Preis. Abgeleitet aus diesen Fenstern sind bereits etwa 79 Prozent der Woche außerhalb der Spitzenzeiten.

Warum schlägt mein DeepSeek-V4-Flash-API-Aufruf plötzlich fehl?

DeepSeek-V4.1-Flash hat die Modellnamen deepseek-v4-flash und deepseek-v4-flash-vision-exp eingestellt. Jeder Code, jedes Tutorial oder jede Konfiguration, die diese Strings immer noch sendet, wird fehlschlagen. Überprüfen Sie Ihre Umgebungsvariablen und Ihre Bereitstellungskonfiguration sowie Ihren Quellcode, da Modellnamen oft außerhalb des Repositories liegen. Die Änderung erfolgte leise um den 10. September 2026.

Gibt DeepSeek neuen Konten kostenlose API-Credits?

Auf der offiziellen Preisgestaltungsseite von DeepSeek gibt es keine angegebene kostenlose API-Stufe. Berichte über Credits für neue Konten sind inkonsistent und unbestätigt, also planen Sie so, als ob keine existieren. Die Chat-App ist kostenlos. Für Anbieter, die Kreditprogramme veröffentlichen, siehe AI Perks.

Hat DeepSeek ein Startup-Kreditprogramm?

Nein. DeepSeek bietet kein spezielles Startup-Kreditprogramm an, was es zu einer der wenigen großen Modell-APIs macht, für die Sie immer bar bezahlen. Die meisten anderen Anbieter bieten eines an, und AI Perks verfolgt 7,7 Mio. $ an Credits über 194 Unternehmen, die diese abdecken.

Ist DeepSeek V4-Pro oder V4.1 Flash günstiger?

Flash ist bei allen veröffentlichten Vergleichen günstiger: 0,15 $ gegenüber 0,66 $ pro Million Cache-Miss-Eingabetoken außerhalb der Spitzenzeiten, eine Lücke von 4,4x (abgeleitet). Aber die Korrektur Ihres Prompt-Cachings bei V4-Pro ist ein 30-facher Hebel, daher ist die Prompt-Struktur wichtiger als die Modellwahl. Keines von beiden hat ein Kreditprogramm im Hintergrund, und das ist der Teil, den AI Perks für die Anbieter verfolgt, die eines haben.


Abonnieren Sie unter getaiperks.com →

DeepSeek ist die günstigste Zeile Ihrer KI-Rechnung. Holen Sie sich die anderen Zeilen abgedeckt unter getaiperks.com.

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.