DeepSeek Non Ha Un Prezzo Per Token
DeepSeek-V4-Pro ha quattro prezzi di input, non uno: $0.022, $0.044, $0.66 e $1.32 per milione di token. A quale prezzo paghi dipende dall'ora del giorno e se la richiesta ha colpito la cache. Si tratta di un divario di 60 volte per lo stesso modello, la stessa richiesta e lo stesso giorno.
Ogni tabella "DeepSeek vs ChatGPT" che riporta un solo numero per modello sta confrontando un numero che non esiste. DeepSeek è l'unico fornitore di modelli importanti che addebita in base all'ora del giorno. Le ore di punta sono dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC, dal lunedì al venerdì, e tutto ciò che è al di fuori di queste finestre, compresi i fine settimana, viene fatturato esattamente a metà prezzo.
Ecco i prezzi di listino pubblicati per milione di token, entrambe le metà incluse.
| Modello | Input in cache | Input fresco | Output |
|---|---|---|---|
| DeepSeek-V4-Pro, fuori punta | $0.022 | $0.66 | $1.98 |
| DeepSeek-V4-Pro, punta | $0.044 | $1.32 | $3.96 |
| DeepSeek-Flash, fuori punta | $0.003 | $0.15 | non pubblicato |
| DeepSeek-Flash, punta | $0.006 | $0.30 | non pubblicato |
Quest'ultima colonna non è un'omissione da parte nostra. DeepSeek pubblica i tassi di input cache-hit e cache-miss per la linea V4.1 Flash ma nessun tasso di output, quindi qualsiasi guida che citi una cifra di output Flash sta citando qualcosa che DeepSeek non ha dichiarato. Non lo ripeteremo, e nemmeno il tuo foglio di calcolo del budget.
La stessa disciplina si applica nell'altra direzione. Non ripubblichiamo i prezzi di listino OpenAI che non abbiamo verificato sulla pagina dei prezzi di OpenAI, poiché tali tariffe cambiano e un numero obsoleto in una tabella di confronto è peggio di nessun numero. Leggi questo articolo per la struttura della fattura di DeepSeek, quindi valuta ChatGPT dalla fonte. AI Perks tiene traccia della terza variabile, i crediti, che nessuno dei prezzi di listino include.

Chi Paga Effettivamente la Tariffa di Punta di DeepSeek
I prezzi di punta coprono sette ore nei giorni feriali, ovvero 35 delle 168 ore della settimana, quindi circa il 79% di tutte le ore di clock vengono fatturate a metà prezzo (derivato). Fuori punta non è una finestra di sconto. È la tariffa normale per la maggior parte del pianeta.
Convertite in UTC+8, le finestre di punta vanno dalle 09:00 alle 12:00 e dalle 14:00 alle 18:00, con l'intervallo che cade durante l'ora di pranzo. Questa è la forma di una giornata lavorativa nel mercato di origine di DeepSeek. DeepSeek non ha dichiarato questo come motivo, quindi trattate la corrispondenza come un'osservazione piuttosto che un fatto, ma prevede esattamente chi paga di più.
| Posizione del team | Giornata lavorativa in UTC | Ore in punta |
|---|---|---|
| San Francisco (UTC-7) | 16:00-00:00 | 0 su 8 |
| New York (UTC-4) | 13:00-21:00 | 0 su 8 |
| Londra (UTC+1) | 08:00-16:00 | 2 su 8 |
| Berlino (UTC+2) | 07:00-15:00 | 3 su 8 |
| Bengaluru (UTC+5:30) | 03:30-11:30 | 4,5 su 8 |
| Shenzhen (UTC+8) | 01:00-09:00 | 6 su 8 |
Un team statunitense che gestisce traffico interattivo durante l'orario di lavoro non raggiunge mai la tariffa di punta. Un team europeo la paga per le prime due o tre ore ogni mattina, il che è un argomento concreto per pianificare lavori batch e di valutazione dopo pranzo piuttosto che prima della riunione.
La Cache Hit Conta Più dell'Orologio
Spostare un carico di lavoro fuori punta dimezza la bolletta. Farlo entrare nella cache lo divide per 30. Su DeepSeek-V4-Pro, un token di input in cache costa $0.022 per milione fuori punta mentre uno fresco costa $0.66, esattamente 30 volte di più (derivato). La leva del fuori punta vale 2x. La maggior parte dei team ottimizza la leva 2x e ignora quella 30x.
Due confronti derivati rendono l'ordinamento ovvio:
- Un token in cache sul flagship V4-Pro fuori punta ($0.022) è 6,8 volte più economico di un token fresco sul modello Flash economico fuori punta ($0.15). La cache batte il downgrade.
- Anche un token V4-Pro in cache alla tariffa di punta ($0.044) è 3,4 volte più economico di un token Flash fresco fuori punta. La cache batte il downgrade e batte l'attesa delle ore economiche combinate.
Aumentare il tasso di cache hit dal 50% al 90% su V4-Pro riduce il costo di input misto da $0.341 a $0.0858 per milione di token, una riduzione di 4,0x (derivata) che nessuna programmazione può eguagliare.
Tre conseguenze pratiche:
La stabilità del prefisso batte la brevità della richiesta. Un prompt di sistema lungo che non cambia mai è più economico di uno breve che riscrivi per richiesta, perché solo il prefisso stabile viene memorizzato nella cache.
Metti la parte variabile per ultima. Qualsiasi cosa inserita prima del contesto recuperato invalida la cache per tutto ciò che segue.
La profondità della cache è una decisione sui prezzi, non una tecnica. DeepSeek prezza un cache hit V4-Pro al 3,3% di un token fresco e un hit Flash al 2,0% (entrambi derivati). I fornitori che prezzano i cache hit a una frazione meno profonda dell'input fresco ti offrono molto meno da ottimizzare. Quel rapporto, non la tariffa principale, è ciò che devi confrontare tra i provider.

Quanto Costa Effettivamente un Compito Reale
Prendiamo una realistica chiamata di un agente aumentato per il recupero: 40.000 token di input con un tasso di cache hit dell'80%, più 2.000 token di output. Tutte le cifre seguenti sono derivate dalle tariffe pubblicate sopra.
| Scenario | Costo di input | Costo di output | Totale |
|---|---|---|---|
| V4-Pro, fuori punta | $0.00598 | $0.00396 | $0.00994 |
| V4-Pro, punta | $0.01197 | $0.00792 | $0.01989 |
| Flash, fuori punta | $0.00130 | non pubblicato | non quotabile |
| Flash, punta | $0.00259 | non pubblicato | non quotabile |
Ne derivano due cose. Primo, l'input V4-Pro su questo compito costa 4,6 volte di più dell'input Flash (derivato), che è un divario molto più piccolo di quanto suggeriscano i livelli dei modelli, perché l'80% di cache hit sta facendo la maggior parte del lavoro su entrambi. Secondo, un costo totale del compito per Flash non è computabile dai dati pubblicati. Se un articolo di confronto ti fornisce una cifra, chiedi da dove proviene la tariffa di output.
Dove Si Rompe la Reputazione Economica
Instradare DeepSeek attraverso un host di terze parti appiattisce la divisione tra punta e fuori punta in un'unica tariffa fissa, quindi paghi qualcosa di vicino al prezzo di punta il 100% delle volte. Baseten, ad esempio, elenca l'input DeepSeek V4.1 Flash a $0.30 per milione, che è identico alla tariffa di punta cache-miss di DeepSeek e il doppio della tariffa fuori punta di $0.15 (cifra pubblicata da Baseten, vale la pena confermarla prima di preventivare su di essa; la sua tariffa di output non è stata confermata in modo affidabile). Baseten offre un credito di prova per nuovo spazio di lavoro di $30.
OpenRouter, Together e Fireworks ospitano anche modelli DeepSeek. Le loro tariffe sono loro a stabilirle e cambiano, quindi verifica ciascuna di esse piuttosto che fidarti di un numero in un post del blog, compreso questo. Il compromesso qualitativo è stabile: ottieni comodità di routing, failover e una singola fattura, e perdi permanentemente lo sconto del 50% fuori punta. Per il traffico che opera prevalentemente al di fuori dell'ora di punta, quel compromesso è negativo.

Cosa è Cambiato Rispetto alle Vecchie Guide sui Prezzi di DeepSeek
Ogni guida di DeepSeek scritta prima del 16 agosto 2026 riporta un singolo prezzo fisso. Quel prezzo non esiste più. Se un articolo fornisce un numero per modello senza menzionare le ore di punta, precede la struttura attuale.
- 24 aprile 2026: DeepSeek V4-Pro e V4-Flash vengono rilasciati in anteprima con una finestra di contesto di 1 milione di token, fino a 384 mila token di output e modalità di pensiero e non pensiero commutabili.
- 31 luglio 2026: DeepSeek-V4-Flash-0731 diventa il rilascio Flash stabile. I prezzi in quel momento erano fissi $0.14 per milione di input cache-miss e $0.28 per milione di output, senza componente oraria. Quella è storia, non una tariffa che puoi acquistare oggi.
- 13 agosto 2026: DeepSeek-V4-Pro-0813 raggiunge la disponibilità generale come modello di punta per il ragionamento e gli agenti.
- 16 agosto 2026: arrivano i prezzi di punta e fuori punta.
- Intorno al 10 settembre 2026: arriva DeepSeek-V4.1-Flash, elencato nella documentazione semplicemente come DeepSeek-Flash.
Un cambiamento radicale merita una nota a parte, perché disattiva silenziosamente il codice funzionante. DeepSeek-V4.1-Flash ha ritirato i nomi degli endpoint deepseek-v4-flash e deepseek-v4-flash-vision-exp. Tutorial, risposte nei forum e campioni di codice copiati fanno ancora riferimento a queste stringhe e falliranno contro l'API live. Controlla l'attuale identificatore del modello nella documentazione di DeepSeek anziché in un campione di codice, poiché la denominazione è cambiata due volte in cinque mesi.
DeepSeek Non Ha Programmi di Crediti di Avvio
L'app di chat DeepSeek è gratuita. L'API no, e DeepSeek non dichiara alcun livello gratuito sulla sua pagina ufficiale dei prezzi. Le affermazioni di crediti API gratuiti per i nuovi account DeepSeek circolano ampiamente, sono segnalate in modo incoerente e non sono confermate sulla pagina ufficiale. Trattale come non verificate.
Ancora più importante per i fondatori: DeepSeek non gestisce alcun programma dedicato di crediti per startup. Nessuna sovvenzione, nessuna allocazione basata sulla fase, nessun livello sovvenzionato. Ricarichi un saldo e lo spendi. Economico per token, zero sussidi.
Questo è l'unico punto in cui il vantaggio di costo si inverte. Un fornitore che addebita diverse volte di più per token ma concede a una giovane azienda crediti per cifre a cinque zeri è più economico nel primo anno di un fornitore economico senza sussidi. Il costo per token è la metrica giusta solo una volta che qualcuno sta effettivamente pagando in contanti.
La maggior parte dei fornitori con cui DeepSeek compete gestisce programmi di crediti. AI Perks traccia 7,7 milioni di dollari in crediti in 194 aziende, che è l'intero strato che un confronto dei prezzi di listino ignora.
Lo stack pratico: capacità accreditata dai fornitori che la concedono, DeepSeek-Flash fuori punta come opzione a pagamento predefinita, caching aggressivo dei prefissi su tutto ciò che opera in punta, e un fallback verificato per le ore che non puoi spostare. Inizia con i crediti, perché sono l'unica parte della fattura che può andare a zero. Vedi cosa è attualmente disponibile.

Domande Frequenti
DeepSeek è più economico di ChatGPT?
Quella domanda ha quattro risposte solo da parte di DeepSeek. L'input fresco di DeepSeek-V4-Pro costa $0.66 per milione fuori punta e $1.32 in punta, e un token in cache costa $0.022 fuori punta. Valuta il tuo traffico rispetto alle attuali tariffe pubblicate di OpenAI, ponderando ogni tariffa di DeepSeek per la quota di chiamate che effettivamente vi ricade. La risposta dipende dal tuo orologio e dal tuo tasso di cache hit, non dal fornitore.
Quali sono le ore di punta di DeepSeek?
Le ore di punta sono dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC, dal lunedì al venerdì. Tutto il resto, compresi i fine settimana, viene fatturato a metà della tariffa di punta. Ciò rende circa il 79% della settimana fuori punta. I team nei fusi orari degli Stati Uniti raramente raggiungono i prezzi di punta durante le normali ore di lavoro.
DeepSeek offre crediti API gratuiti o un programma per startup?
No. L'app di chat di DeepSeek è gratuita, ma non è indicato alcun livello API gratuito sulla sua pagina ufficiale dei prezzi, e i resoconti sui crediti di registrazione sono incoerenti e non confermati. DeepSeek inoltre non gestisce alcun programma di crediti per startup, a differenza di molti dei fornitori tracciati su AI Perks.
Perché la mia chiamata API DeepSeek ha smesso di funzionare?
DeepSeek-V4.1-Flash ha ritirato gli identificatori di modello deepseek-v4-flash e deepseek-v4-flash-vision-exp, silenziosamente e senza finestra di deprecazione. Tutorial più vecchi e campioni copiati li referenziano ancora e falliranno. Scarica l'identificatore corrente dalla documentazione live di DeepSeek prima di fare il debug di qualsiasi altra cosa.
Quanto costa DeepSeek-Flash per i token di output?
DeepSeek non lo ha pubblicato. La linea V4.1 Flash elenca solo i tassi di input cache-hit e cache-miss. Qualsiasi cifra di costo totale per compito che vedi per Flash è costruita su una tariffa di output presunta, quindi trattala come una stima piuttosto che un prezzo.
È più economico eseguire DeepSeek tramite un host di terze parti?
Solitamente no, se il tuo traffico opera fuori punta. Gli host addebitano una tariffa fissa senza divisione tra punta e fuori punta, quindi rinunci permanentemente allo sconto del 50% fuori punta in cambio di comodità di routing e failover. Verifica tu stesso la tariffa attuale di ciascun host prima di cambiare, poiché i margini variano e cambiano spesso.
Quanto risparmiano effettivamente i crediti AI gratuiti per una startup?
Abbastanza da invertire il confronto. Un fornitore che addebita diverse volte di più per token ma concede crediti per cifre a cinque zeri è più economico nel primo anno di un fornitore economico senza sussidi. AI Perks traccia 7,7 milioni di dollari in crediti in 194 aziende, che è lo strato che i confronti dei prezzi di listino ignorano completamente.
Iscriviti per ricevere crediti settimanali
Il prezzo per token è il numero facile. Il prezzo per compito, dopo i crediti, è quello che compare sulla carta.