Quanto costa DeepSeek-V4-Pro per un milione di token?
DeepSeek-V4-Pro-0813 costa $0.66 per milione di token di input con cache miss fuori picco e $1.32 al picco. L'output costa $1.98 fuori picco e $3.96 al picco. Un colpo di cache riduce l'input a $0.022 fuori picco.
DeepSeek-V4-Pro-0813 ha raggiunto la disponibilità generale il 13 agosto 2026 come fiore all'occhiello della linea V4, costruito per l'uso di strumenti, l'esecuzione di codice e flussi di lavoro autonomi multi-passo. È tariffato a ore: il picco è dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC nei giorni feriali, e ogni altra ora costa la metà.
Tariffe pubblicate nella documentazione API di DeepSeek, in USD per milione di token:
| Modello | Tipo di token | Fuori picco | Picco |
|---|---|---|---|
| DeepSeek-V4-Pro-0813 | Input, cache hit | $0.022 | $0.044 |
| DeepSeek-V4-Pro-0813 | Input, cache miss | $0.66 | $1.32 |
| DeepSeek-V4-Pro-0813 | Output | $1.98 | $3.96 |
| DeepSeek-V4.1-Flash | Input, cache hit | $0.003 | $0.006 |
| DeepSeek-V4.1-Flash | Input, cache miss | $0.15 | $0.30 |
| DeepSeek-V4.1-Flash | Output | $0.60 | $1.20 |
All'anteprima di aprile 2026, si è detto che la coppia V4 avesse una finestra di contesto da 1 milione di token con fino a 384 mila token di output, una modalità di pensiero commutabile e pesi aperti sotto licenza MIT. Questo proviene dalla copertura del lancio, non dalla pagina dei prezzi attuale di DeepSeek, quindi confermalo rispetto alla stringa del modello esatta che chiami. AI Perks tiene traccia dei programmi di prezzi e crediti in 194 aziende, e DeepSeek si distingue nel secondo conteggio: non pubblica alcun programma di credito per startup.

Il picco è solo il 21% della settimana
La maggior parte della copertura inquadra il fuori picco come uno sconto che si sblocca. L'aritmetica dice il contrario: il picco copre 7 ore al giorno nei feriali, 35 su 168, quindi il 79% della settimana viene già fatturato alla tariffa più bassa.
Il fuori picco è l'impostazione predefinita. Il picco è un sovrapprezzo che si paga per errore, in una finestra che cade durante la mattinata europea. Non stai cercando uno sconto, stai evitando una scatola di penalità di 35 ore, e la soluzione è verificare che nessun cron job sia finito lì. Il traffico interattivo è l'eccezione, perché quell'orologio è impostato dai tuoi utenti.
Perché V4.1-Flash batte V4-Pro sul prezzo
Spostare un job fuori picco dimezza la fattura, esattamente 2x. Spostarlo da V4-Pro a V4.1-Flash riduce l'input con cache miss di 4.4x e l'output di 3.3x. La scelta del modello è la leva più grande, e i due si compongono.
Un milione di token di input con cache miss più un milione di token di output, ad entrambe le estremità dell'orologio:
| Modello e orario | Input | Output | Totale |
|---|---|---|---|
| V4-Pro al picco | $1.32 | $3.96 | $5.28 |
| V4-Pro fuori picco | $0.66 | $1.98 | $2.64 |
| V4.1-Flash al picco | $0.30 | $1.20 | $1.50 |
| V4.1-Flash fuori picco | $0.15 | $0.60 | $0.75 |
V4-Pro nella sua ora più economica costa ancora 1.76x quello che V4.1-Flash costa nella sua ora più costosa. Nessun trucco di programmazione chiude quel divario.
Impila entrambe le leve e lo spread si allarga di nuovo: V4-Pro al picco contro V4.1-Flash fuori picco è 7x su conteggi di token identici, e solo una di queste due decisioni è impostata dall'orologio. Il consiglio usuale di spingere il lavoro batch nelle ore economiche presuppone che il modello sia fisso. Raramente lo è, e declassarlo paga anche quando il traffico non può essere riprogrammato.
Flash vince sul prezzo in ogni ora del giorno, picco incluso. Il vantaggio di V4-Pro è solo la capacità, quindi deve guadagnarsi il suo posto sulla difficoltà del compito.

Perché l'esecuzione di un agente V4-Pro costa più di quanto suggerisce la tabella
L'output costa 3 volte di più dell'input con cache miss su V4-Pro, e i carichi di lavoro per cui DeepSeek ha costruito V4-Pro - cicli di agenti, chiamate di strumenti, esecuzione multi-passo - generano il massimo output per unità di lavoro.
Un mese di utilizzo reale: 100 milioni di token di input con un tasso di cache hit del 70% più 20 milioni di token di output, alle tariffe sopra indicate:
| Configurazione | Input | Output | Totale mensile |
|---|---|---|---|
| V4-Pro, picco | $42.68 | $79.20 | $121.88 |
| V4-Pro, fuori picco | $21.34 | $39.60 | $60.94 |
| V4.1-Flash, picco | $9.42 | $24.00 | $33.42 |
| V4.1-Flash, fuori picco | $4.71 | $12.00 | $16.71 |
Ne conseguono tre cose.
L'output è il 65% della fattura V4-Pro fuori picco. Una volta che la cache funziona e i job evitano il picco, DeepSeek smette di essere un problema di input e diventa un problema di lunghezza della risposta.
Lo spread completo è 7.3x. Stessi token, stesso fornitore, stesso mese. Dalla prima all'ultima riga ci sono due decisioni.
Lo sconto cache è più marcato su Flash. Un colpo di cache V4-Pro è 30 volte più economico di un miss; su V4.1-Flash è 50 volte più economico. La disciplina del prefisso prompt paga di più sul modello economico, il contrario di quanto ipotizzano i team.
Cosa DeepSeek ha pubblicato e cosa no
DeepSeek pubblica prezzi per token e poco altro di ciò che un acquirente desidera. Non c'è un tier gratuito API dichiarato sulla pagina dei prezzi ufficiale, nessun programma di credito per startup e nessun prezzo pubblicato separatamente per i modelli di anteprima di aprile.
Qualsiasi guida scritta prima di metà agosto descrive un modello di prezzi che non esiste più:
| Data | Cosa è stato spedito | Stato dei prezzi |
|---|---|---|
| 24 aprile 2026 | Anteprima V4-Pro e V4-Flash | Non pubblicato separatamente all'anteprima |
| 31 luglio 2026 | DeepSeek-V4-Flash-0731, stabile | Riportato a $0.14 input / $0.28 output, fisso |
| 13 agosto 2026 | DeepSeek-V4-Pro-0813, disponibilità generale | Sostituito dalla suddivisione seguente |
| Metà agosto 2026 | Introdotta la tariffazione per picco e fuori picco | Struttura attuale |
| Intorno al 10 settembre 2026 | DeepSeek-V4.1-Flash | Tariffe Flash attuali |
I dettagli dell'anteprima di aprile, le cifre di luglio per Flash e la data esatta della modifica sono riportati, non confermati sulla pagina dei prezzi attuale di DeepSeek: trattali come storia, non come input per il budget. Le tariffe V4-Pro e V4.1-Flash sopra riportate provengono direttamente da DeepSeek.
La modifica di agosto, secondo quanto riportato, ha spostato Flash da una tariffa fissa di $0.14 per input con cache miss a $0.15 fuori picco e $0.30 al picco. Non si tratta di una riduzione di prezzo con un asterisco, ma di una suddivisione dei prezzi: eseguendo fuori picco si paga circa la vecchia tariffa, eseguendo al picco si paga circa il doppio.
Sull'accesso gratuito: l'app chat DeepSeek è gratuita. Le affermazioni che i nuovi account API ricevono crediti gratuiti sono riportate in modo incoerente e non confermate sulla pagina dei prezzi ufficiale, quindi tratta qualsiasi cifra che vedi altrove come non verificata. DeepSeek inoltre non gestisce programmi di credito per startup, non lasciando alcuna corsia di atterraggio gratuita. AI Perks tiene traccia di 7.7 milioni di dollari in crediti distribuiti su 194 aziende che ne gestiscono uno.
Trova i fornitori che offrono effettivamente crediti su getaiperks.com →

Dove lo sconto fuori picco non si applica
La tariffazione oraria è una meccanica proprietaria di DeepSeek. Gli host e i router di terze parti stabiliscono le proprie tariffe, e una tariffa fissa che sembra economica sulla carta può attestarsi al prezzo di picco di DeepSeek tutto il giorno.
Baseten ha aggiunto DeepSeek V4.1 Flash alle sue API di modelli il 10 settembre 2026, con l'input elencato a $0.30 per milione di token. Né questa cifra né la cifra corrispondente dell'output sono confermate qui (il numero di output non era leggibile in modo affidabile al momento del controllo), quindi verifica entrambi con il fornitore prima di fare il budget. Preso per quello che è, $0.30 è esattamente la tariffa di picco per l'input di DeepSeek e il doppio della sua tariffa fuori picco, addebitata ogni ora del giorno. Il credito di prova per i nuovi spazi di lavoro di Baseten è segnalato a $30, che non è né specifico per DeepSeek né nuovo.
Il compromesso può comunque essere corretto: si acquistano latenza, regione e semplicità, e una tariffa fissa prevede meglio di un programma. Prezzalo onestamente però, perché una tariffa impostata al numero di picco non ottiene mai il 79% della settimana che altrimenti verrebbe fatturato a metà prezzo. La corsia di atterraggio gratuita proviene dai fornitori che la finanziano, e quell'elenco si trova su getaiperks.com.
Come ridurre una fattura DeepSeek-V4-Pro, in ordine di impatto
Leva 1: Finanzia i tier costosi altrove. DeepSeek non offre crediti, quindi usa getaiperks.com per coprire i fornitori premium a cui indirizzi i task più difficili, e lascia che DeepSeek gestisca il lavoro di volume.
Leva 2: Demote ogni task che non necessita del fiore all'occhiello. Sul carico di lavoro sopra indicato, passare da V4-Pro a V4.1-Flash è 3.6 volte più economico a impostazioni identiche. Nient'altro qui si avvicina.
Leva 3: Controlla la tua programmazione per un uso accidentale del picco. Il picco dura 35 ore a settimana, quindi verifica che nessun cron job sia finito tra le 01:00 e le 04:00 o tra le 06:00 e le 10:00 UTC in un giorno feriale.
Leva 4: Stabilizza il tuo prefisso prompt. I colpi di cache richiedono un prefisso iniziale identico, quindi metti il contenuto volatile per ultimo. È qui che si trovano il 30x su V4-Pro e il 50x su Flash.
Leva 5: Attacca la lunghezza della risposta. Dopo i quattro precedenti, l'output rappresenta circa due terzi della fattura ed è la cosa più grande rimasta.

Domande frequenti
Quanto costa DeepSeek-V4-Pro per milione di token?
L'input con cache miss costa $0.66 fuori picco e $1.32 al picco. L'output costa $1.98 fuori picco e $3.96 al picco. Un colpo di cache costa $0.022 fuori picco e $0.044 al picco. Le ore di picco sono dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC nei giorni feriali.
Quali sono le ore di picco di DeepSeek e quanto della settimana rappresentano?
Il picco è dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC, dal lunedì al venerdì. Sono 7 ore al giorno nei feriali, 35 sulle 168 in una settimana, ovvero circa il 21%. Il restante 79%, compresi tutti i fine settimana, viene fatturato a metà della tariffa di picco.
DeepSeek-V4-Pro vale la pena rispetto a V4.1-Flash?
Solo per lavori che necessitano veramente del fiore all'occhiello. V4-Pro costa 4.4 volte di più sull'input con cache miss, 3.3 volte di più sull'output, e circa 3.6 volte di più su un carico di lavoro mensile misto. Indirizza prima in base alla difficoltà del compito, quindi ottimizza la programmazione.
DeepSeek offre crediti gratuiti per V4-Pro?
No. L'app chat DeepSeek è gratuita, ma la pagina dei prezzi ufficiale dichiara nessun tier gratuito API e non c'è alcun programma di credito per startup. Le segnalazioni di crediti gratuiti per nuovi account API non sono confermate. Per una vera corsia di atterraggio gratuita, AI Perks tiene traccia di 7.7 milioni di dollari distribuiti su 194 aziende.
Gli host di terze parti trasferiscono i prezzi fuori picco di DeepSeek?
Generalmente no. La tariffazione oraria è una meccanica proprietaria e gli host stabiliscono le proprie tariffe. Baseten ha segnalato di elencare l'input di DeepSeek V4.1 Flash a $0.30 per milione, che equivarrebbe alla tariffa di picco di DeepSeek applicata tutto il giorno, sebbene ciò non sia confermato qui. Verifica la tariffa attuale con l'host prima di impegnarti.
Cosa è successo al nome dell'endpoint deepseek-v4-flash?
DeepSeek-V4.1-Flash ha ritirato i nomi dei modelli deepseek-v4-flash e deepseek-v4-flash-vision-exp, e le richieste ora vengono indirizzate al modello Flash corrente alle tariffe Flash. Il codice scritto contro i vecchi identificatori necessita di aggiornamenti, quindi fissa la stringa del modello corrente anziché fare affidamento su alias.
DeepSeek ha prezzi bassi e non finanzia nulla. I fornitori che ti finanziano si trovano su getaiperks.com.