Ist DeepSeek für Agenten-Workloads günstiger als Claude?
DeepSeek-V4-Pro kostet 0,66 $ pro Million eingehender neuer Tokens und 1,98 $ pro Million ausgehender Tokens außerhalb der Spitzenzeiten, verglichen mit 2,00 $ und 10,00 $ für Claude Sonnet 5. Bei der Ausgabe, dem Bereich, der bei Agenten-Schleifen am meisten ins Gewicht fällt, ist das ungefähr 5x günstiger.
Der Schlagzeilenpreis ist nicht das Interessante. DeepSeek ist der einzige große Anbieter, der nach Tageszeit abrechnet, und fast niemand erklärt, wie sich das mit dem Prompt-Caching auswirkt. Wenn beides falsch gemacht wird, kosten dieselben Tokens beim selben Modell das 60-fache dessen, was sie kosten sollten.
AI Perks verfolgt 7,7 Millionen US-Dollar an Guthaben bei 194 Unternehmen. Diese Seite behandelt, was Guthaben nicht tun: die zugrunde liegende Abrechnung pro Token.

Die Mechanik, die niemand erklärt: DeepSeek rechnet nach Tageszeit ab
Die Spitzenzeiten von DeepSeek sind werktags von 01:00-04:00 und 06:00-10:00 UTC. Alles außerhalb dieser beiden Zeitfenster ist außerhalb der Spitzenzeiten und kostet genau die Hälfte.
| DeepSeek-V4-Pro-0813 | Außerhalb der Spitzenzeiten | Spitzenzeiten |
|---|---|---|
| Eingabe, Cache-Treffer | 0,022 $ / 1 Mio. | 0,044 $ / 1 Mio. |
| Eingabe, Cache-Fehlversuch | 0,66 $ / 1 Mio. | 1,32 $ / 1 Mio. |
| Ausgabe | 1,98 $ / 1 Mio. | 3,96 $ / 1 Mio. |
Diese Zeitfenster, die auf der Preisgestaltungsseite nicht detailliert aufgeführt sind, haben drei Konsequenzen.
Spitzenzeiten machen nur etwa 21 % der Woche aus. Sieben Stunden pro Tag an fünf Wochentagen ergeben 35 Stunden von 168 (abgeleitet). Ein halber Preis ist der Standardzustand der DeepSeek-API, kein Rabatt, den Sie aushandeln.
Die Spitzenzeitfenster sind die chinesische Arbeitszeit. 01:00 bis 10:00 UTC entspricht 09:00 bis 18:00 UTC+8 (abgeleitet). DeepSeek bepreist seine eigene Inlandsnachfragekurve, weshalb die Fenster von überall sonst willkürlich erscheinen.
Ein Team an der US-Westküste ist bereits außerhalb der Spitzenzeiten. Ein Arbeitstag von 09:00 bis 18:00 Uhr Pazifikzeit entspricht 16:00 bis 01:00 Uhr UTC, was außerhalb beider Fenster liegt (abgeleitet). Ein europäisches Team, das von 09:00 bis 17:00 Uhr arbeitet, verbringt seinen gesamten Vormittag innerhalb des zweiten Spitzenzeitfensters und zahlt doppelt.
Für Batch-Jobs, Auswertungen, nächtliche Neuindizierungen und alles, was in der Warteschlange steht, ist die Terminplanung kostenloses Geld. Eine Verlagerung eines Jobs aus dem Zeitraum 06:00-10:00 UTC halbiert die Rechnung ohne Codeänderung.
Cache-Treffer stapeln sich mit der Zeit außerhalb der Spitzenzeiten für eine 60-fache Spanne
Ein Cache-Treffer bei der Eingabe von DeepSeek-V4-Pro kostet außerhalb der Spitzenzeiten 0,022 $ pro Million Tokens. Ein Cache-Fehlversuch zur Spitzenzeit kostet 1,32 $. Dasselbe Modell, dieselben Tokens, 60-fache Preisdifferenz.
Zwei Multiplikatoren stapeln sich und zusammen ergeben sie die gesamte Kostenstory von DeepSeek. Ein Cache-Treffer ist bei V4-Pro etwa 30x günstiger als ein Cache-Fehlversuch. Die Zeit außerhalb der Spitzenzeiten ist 2x günstiger als die Spitzenzeit.
Hier schlagen Agenten-Schleifen am stärksten zu. Ein Agent sendet bei jeder Runde eine wachsende Abschrift erneut, sodass bei Runde zwanzig die Eingabe größtenteils wiederholter Kontext ist. Mit Cache ist das erneute Senden fast kostenlos. Unterbrechen Sie das Präfix mit einem Zeitstempel oder einer neu geordneten Tool-Liste, und jede Runde zahlt Cache-Fehlversuch-Preise, zweimal während der Spitzenzeiten.
DeepSeek-V4.1-Flash liegt eine Stufe darunter und ist noch günstiger: 0,003 $ pro Million gecachter Eingabe-Tokens außerhalb der Spitzenzeiten, 0,15 $ pro Million bei einem Cache-Fehlversuch. DeepSeek hat keine Ausgaberate für Flash veröffentlicht, daher sollten Sie nicht gegen eine woanders genannte Zahl kalkulieren, ohne sie zu überprüfen.

DeepSeek vs. Claude: Was ein Agentenmonat tatsächlich kostet
Bei einem Workload von 50 Mio. Eingabe-Tokens mit einer Cache-Trefferquote von 90 % und 5 Mio. Ausgabe-Tokens liegen die Kosten für DeepSeek-V4-Pro, das ausschließlich außerhalb der Spitzenzeiten läuft, bei etwa 14 $, für Claude Sonnet 5 bei etwa 69 $ und für Claude Opus 5 bei etwa 173 $.
| Modell | Gecachte Eingabe | Neue Eingabe | Ausgabe | Monatsgesamt |
|---|---|---|---|---|
| DeepSeek-V4-Pro, außerhalb der Spitzenzeiten | 0,99 $ | 3,30 $ | 9,90 $ | 14,19 $ |
| DeepSeek-V4-Pro, reine Spitzenzeiten | 1,98 $ | 6,60 $ | 19,80 $ | 28,38 $ |
| Claude Sonnet 5 | 9,00 $ | 10,00 $ | 50,00 $ | 69,00 $ |
| Claude Opus 5 | 22,50 $ | 25,00 $ | 125,00 $ | 172,50 $ |
Alle vier Zeilen ergeben sich aus veröffentlichten Listenpreisen. Claude Cache-Lesevorgänge werden mit etwa einem Zehntel des Basis-Eingaberates geschätzt, und Zuschläge für das Schreiben von Caches sind ausgeschlossen, daher sind die Claude-Zeilen konservativ und nicht exakt. Claude Haiku 4.5 zu 1,00 $ und 5,00 $ pro Million liegt zwischen den DeepSeek- und Sonnet-Zeilen.
Die Spanne ist real, aber kleiner als die "10x günstiger"-Aussage, die kursiert. Sobald das Caching für beide Anbieter aktiviert ist, kostet ein gut aufgebauter Agent auf Sonnet 5 etwa das 5-fache eines DeepSeek-Agenten, nicht das 20-fache. Schlecht aufgebaut, kostet jeder von ihnen weit mehr, als die Tabelle angibt.
Was sich in DeepSeeks Aufstellung für 2026 geändert hat
Alles, was vor dem 16. August 2026 über DeepSeek geschrieben wurde, zitiert einen Pauschalpreis, der nicht mehr existiert. Die Aufteilung nach Spitzen- und Nicht-Spitzenzeiten ersetzte die Einpreisabrechnung, sodass ältere Vergleiche ein nicht mehr existierendes Modell beschreiben.
Die wissenswerte Abfolge:
- 24. April 2026: V4-Pro und V4-Flash Vorschau mit einem Kontextfenster von 1 Mio. Tokens, bis zu 384K Ausgabe und umschaltbaren Denk- und Nicht-Denk-Modi (mittlere Zuverlässigkeit).
- 31. Juli 2026: DeepSeek-V4-Flash-0731 stabilisiert die Flash-Linie. Der letzte bekannte Preis vor der Änderung lag bei 0,14 $ pro Million Cache-Fehlversuchs-Eingabe und 0,28 $ pro Million Ausgabe. Nur historische Daten.
- 13. August 2026: DeepSeek-V4-Pro-0813 erreicht die allgemeine Verfügbarkeit als Flaggschiff-Modell für Logik und Agenten.
- Um den 10. September 2026: DeepSeek-V4.1-Flash wird ausgeliefert, in der Dokumentation als DeepSeek-Flash aufgeführt.
V4.1-Flash hat auch leise die Endpunktnamen deepseek-v4-flash und deepseek-v4-flash-vision-exp ausgemustert. Tutorials und kopierte Codebeispiele verweisen immer noch auf sie und werden fehlschlagen. Wenn eine DeepSeek-Integration im September ohne Bereitstellung unterbrochen wurde, ist diese Umbenennung das Erste, was Sie überprüfen sollten.

Wo Claude für Agenten- und Coding-Aufgaben immer noch punktet
Der Preis pro Token ist eine Eingabe für die Entscheidung, und für Agentenarbeit ist er nicht die einzige, die die Rechnung beeinflusst.
Anthropic bietet einen eigenen Rabatt von 50 % über die Batch-API, die Latenz gegen halben Preis eintauscht. Das ist das direkte Gegenstück zu DeepSeeks Zeitfenstern außerhalb der Spitzenzeiten: Ein Anbieter rabattiert Geduld, der andere die Zeitplanung. Ein Team, das Arbeit in die Warteschlange stellen kann, spart bei beiden Anbietern 50 %.
Der Rest des Arguments für Claude liegt in der Oberfläche und nicht in den Tokens: Kontrollen, die die Denktiefe gegen Ausgaben tauschen, serverseitige Tools, Kontextbearbeitung und -komprimierung für lange Schleifen sowie ein Tool-Aufrufvertrag, auf den Agenten-Frameworks zuerst abzielen. Nichts davon erscheint in einer Preistabelle, und all das verändert die Anzahl der Runden, die eine Aufgabe benötigt.
Die ehrliche Rahmung ist die Weiterleitung, nicht die Loyalität. Hochvolumige Klassifizierungs-, Zusammenfassungs- und Massentransformationsaufgaben gehen außerhalb der Spitzenzeiten zu DeepSeek. Langfristige Agentenläufe, bei denen eine fehlgeschlagene Flugbahn mehr kostet als die Tokens, bleiben bei Claude. Die meisten Stacks im Jahr 2026 laufen mit beiden, weshalb Kredite von einem Anbieter Experimente beim anderen subventionieren. AI Perks macht diesen zweiten Teil kostenlos.
Keiner der Anbieter verschenkt Agenten-Workloads
Die DeepSeek Chat-App ist kostenlos. Die DeepSeek-API ist es nicht, und auf der offiziellen Preisübersicht gibt es keine angegebene kostenlose Stufe.
Die meisten Vergleichsartikel liegen hier falsch. Behauptungen, dass neue DeepSeek-Konten kostenlose API-Gutschriften erhalten, werden inkonsistent gemeldet und nicht auf der offiziellen Preisübersicht bestätigt. Kalkulieren Sie, als ob diese nicht existieren würden.
Wichtiger für Gründer: DeepSeek betreibt kein dediziertes Startup-Guthabenprogramm. Günstige Preise pro Token sind das gesamte Angebot. Das ist eine echte Lücke, da die meisten Anbieter, mit denen es konkurriert, eines anbieten, und eine Gutschrift eine 5x günstigere Token-Rate schlägt, wenn Sie noch kein Umsatz haben.
| Route zu DeepSeek | Was es ändert | Wo suchen |
|---|---|---|
| DeepSeek direkte API | Günstigste Preise, Abrechnung nach Spitzenzeiten und außerhalb der Spitzenzeiten | Offizielle Preisübersicht |
| Drittanbieter-Hosts | Routing, Verfügbarkeit und Regionskontrolle, höhere Preise | Vor der Verpflichtung vergleichen |
| Anbieter-Gutschriftenprogramme | Entfernt die Rechnung vollständig, DeepSeek ausgenommen | AI Perks |
Bei Drittanbieter-Hosting listet Baseten DeepSeek V4.1 Flash-Eingabe für 0,30 $ pro Million auf und bietet eine stehende Testgutschrift von 30 $ für neue Arbeitsbereiche (vor der Budgetierung verifizieren). OpenRouter, Together und Fireworks bedienen ebenfalls DeepSeek-Modelle. Betrachten Sie diese Ebene als eine Entscheidung für Routing und Zuverlässigkeit, nicht für die Preisgestaltung.
7,7 Millionen US-Dollar an Guthaben bei 194 Unternehmen werden unter getaiperks.com verfolgt, was die Anbieter abdeckt, die ein Programm anbieten.

Häufig gestellte Fragen
Ist DeepSeek günstiger als Claude?
Ja, beim Listenpreis. DeepSeek-V4-Pro außerhalb der Spitzenzeiten kostet 0,66 $ pro Million eingehender neuer Tokens und 1,98 $ pro Million Ausgabe, im Vergleich zu 2,00 $ und 10,00 $ für Claude Sonnet 5. Das ist etwa das 5-fache bei der Ausgabe. Mit aktiviertem Caching auf beiden Seiten verringert sich die praktische Lücke, und kostenlose Gutschriften schließen sie vollständig. Siehe AI Perks.
Was sind die Spitzenzeiten von DeepSeek?
Die Spitzenzeiten sind werktags von 01:00-04:00 und 06:00-10:00 UTC. Anrufe innerhalb dieser Zeitfenster kosten doppelt so viel. Alles andere, einschließlich des gesamten Wochenendverkehrs, ist außerhalb der Spitzenzeiten zum halben Preis. Das sind etwa 21 % der Woche zu Spitzenpreisen (abgeleitet), sodass die meisten Workloads bereits standardmäßig den niedrigeren Preis zahlen.
Hat DeepSeek eine kostenlose API-Stufe?
Nein. Die DeepSeek Chat-App ist kostenlos nutzbar, aber die offizielle Preisübersicht nennt keine API-Free-Tier. Berichte über kostenlose Guthaben für neue API-Konten sind inkonsistent und unbestätigt. DeepSeek betreibt auch kein Startup-Guthabenprogramm, im Gegensatz zu den meisten seiner Konkurrenten, die unter getaiperks.com erfasst werden.
Warum sind meine DeepSeek API-Aufrufe plötzlich fehlgeschlagen?
DeepSeek-V4.1-Flash hat die Endpunktnamen deepseek-v4-flash und deepseek-v4-flash-vision-exp um den 10. September 2026 herum ausgemustert. Ältere Tutorials und kopierte Codebeispiele verweisen immer noch auf sie und werden mit der aktuellen API ohne Bereitstellung auf Ihrer Seite fehlschlagen. Überprüfen Sie zuerst den Modellstring, bevor Sie Schlüssel, Kontingente oder die Netzwerkkonfiguration debuggen.
Sollte ich DeepSeek oder Claude für Coding-Agenten verwenden?
Leiten Sie nach Aufgabe weiter. Hochvolumige Vervollständigungen, Refactorings und Massentransformationen laufen außerhalb der Spitzenzeiten günstig auf DeepSeek. Langfristige Agentenläufe, bei denen eine fehlgeschlagene Flugbahn mehr kostet als die gesparten Tokens, sind der Bereich, in dem Claudes Tool-Aufrufe und Kontextverwaltung ihren Preis rechtfertigen. Die meisten Teams nutzen beide und finanzieren die teurere Hälfte mit Gutschriften von AI Perks.
Wie viel kann Prompt-Caching bei DeepSeek tatsächlich sparen?
Ein Cache-Treffer bei V4-Pro-Eingabe ist etwa 30x günstiger als ein Cache-Fehlversuch. In Kombination mit der Abrechnung außerhalb der Spitzenzeiten ergibt ein gecachter Token außerhalb der Spitzenzeiten zu 0,022 $ pro Million im Vergleich zu einem Cache-Fehlversuch zur Spitzenzeit zu 1,32 $ pro Million eine Spanne von 60x bei identischen Tokens. Caching ist der wichtigste Hebel für jede DeepSeek-Rechnung.
Abonnieren Sie unter getaiperks.com →
Leiten Sie die günstigen Arbeiten an DeepSeek weiter. Lassen Sie jemand anderen für den Rest bezahlen.