DeepSeek è più economico diretto o tramite un host?
Diretto, nella quasi totalità dei casi, e il motivo è strutturale piuttosto che una questione di ricarico. Il prezzo basso di DeepSeek deriva da due moltiplicatori che esistono solo nell'API di prima parte: una finestra a metà prezzo in orario non di punta e un colpo di cache che costa circa 30 volte meno di un mancato colpo di cache su V4-Pro. I rivenditori fatturano una tariffa fissa per token, quindi entrambi i moltiplicatori svaniscono alla porta.
Questa è l'intera decisione di routing in una riga. Un host non ti addebita un modesto sovrapprezzo sullo stesso prezzo, ti addebita un prezzo fisso rispetto a una fattura che avrebbe potuto essere una frazione di essa.
Il divario è più grande di quanto chiunque effettui il routing su una classifica immaginerebbe. I team che inseguono questo tipo di economia unitaria stanno anche inseguendo crediti gratuiti, che AI Perks tiene traccia su 194 aziende e $7,7 milioni in crediti.

I quattro prezzi che DeepSeek addebita per lo stesso token
DeepSeek-V4-Pro ha quattro diversi prezzi di input a seconda dell'ora del giorno e se il prefisso del tuo prompt era memorizzato nella cache. Nessun altro fornitore principale ha questo tipo di prezzi.
Le ore di punta sono dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC nei giorni feriali. Tutto ciò che è al di fuori di queste finestre, compresi l'intero fine settimana, è fuori punta a metà prezzo.
| DeepSeek-V4-Pro-0813 | Orario non di punta (per 1 milione) | Orario di punta (per 1 milione) |
|---|---|---|
| Input, cache hit | $0.022 | $0.044 |
| Input, cache miss | $0.66 | $1.32 |
| Output | $1.98 | $3.96 |
| DeepSeek-V4.1-Flash | Orario non di punta (per 1 milione) | Orario di punta (per 1 milione) |
|---|---|---|
| Input, cache hit | $0.003 | $0.006 |
| Input, cache miss | $0.15 | $0.30 |
I due moltiplicatori si sommano. Un token di input fuori punta in cache a $0.022 rispetto a un mancato colpo di cache in punta a $1.32 è una differenza di 60x sullo stesso modello (derivato dalla tabella sopra). Su Flash la differenza è ancora maggiore: $0.003 contro $0.30 è 100x, anch'esso derivato.
Le ore di punta totalizzano 7 ore al giorno per 5 giorni feriali, quindi circa il 79% della settimana viene fatturato alla tariffa fuori punta per impostazione predefinita (derivato). Non devi fare nulla di speciale per rientrare in questa fascia. Devi evitare di fare qualcosa di avventato.
Cosa è cambiato nei prezzi di DeepSeek nell'agosto 2026
Il modello di prezzi stesso è cambiato il 16 agosto 2026, quando una tariffa fissa per token ha lasciato il posto alla divisione punta/fuori punta. Qualsiasi confronto dei costi scritto prima di quella data descrive una carta tariffaria che non esiste più.
La cronologia che conta:
- 24 aprile 2026: anteprima V4-Pro e V4-Flash, con contesto di 1 milione di token e modalità di pensiero commutabili (fiducia: media).
- 31 luglio 2026: DeepSeek-V4-Flash-0731 viene rilasciato come versione Flash stabile. L'ultimo prezzo fisso noto era $0.14 per 1 milione di input con cache miss e $0.28 per l'output (fiducia: media, solo storico).
- 13 agosto 2026: DeepSeek-V4-Pro-0813 raggiunge la disponibilità generale.
- Intorno al 10 settembre 2026: DeepSeek-V4.1-Flash arriva, elencato nella documentazione come DeepSeek-Flash.
Metti la vecchia tariffa fissa di $0.14 accanto agli attuali prezzi Flash e il disegno del cambiamento diventa ovvio. L'input fuori punta con cache miss a $0.15 si trova quasi esattamente dove si trovava la vecchia tariffa fissa, mentre il picco costa $0.30, leggermente più del doppio (derivato). DeepSeek non ha aumentato i prezzi, ma ha installato una tariffa di congestione.

Quanto costano gli host di terze parti e perché non possono competere
Un host acquista capacità e vende token, quindi deve quotare un numero che copra la sua ora peggiore. Quel numero si posiziona sopra la tariffa fuori punta di DeepSeek e astronomicamente sopra la sua tariffa fuori punta in cache.
Due cose si rompono nella rivendita:
I prezzi per ora del giorno non sopravvivono. Un host che serve ogni fuso orario non può trasferire uno sconto ancorato all'UTC senza arbitraggio o una pagina di prezzi invendibile.
Lo stato della cache è per tenant. La memorizzazione nella cache del prefisso è vantaggiosa quando lo stesso prompt di sistema raggiunge ripetutamente lo stesso backend. Instrada quel prompt attraverso un aggregatore che bilancia il carico tra i provider e paghi i prezzi di mancato colpo di cache su un prompt che hai inviato mille volte.
Verifica tu stesso qualsiasi prezzo di host prima di impegnarti, poiché i numeri pubblicati si muovono e la maggior parte dei post di confronto cita tariffe scadute settimane fa. Una cifra inquadra chiaramente il divario. Baseten elenca l'input DeepSeek V4.1 Flash a $0.30 per 1 milione (fiducia: media, verificare prima di citare), insieme a $30 di credito di prova per il nuovo spazio di lavoro. La cifra di output non è stata confermata in modo affidabile, quindi non è quotata qui.
| Routing | Prezzi per ora del giorno | Sconto cache prefisso | Segnale di prezzo verificato |
|---|---|---|---|
| DeepSeek prima parte, V4-Pro | Sì, oscillazione 2x | Sì, 30x | $0.66 in / $1.98 out, fuori punta |
| DeepSeek prima parte, V4.1-Flash | Sì, oscillazione 2x | Sì, 50x (derivato) | $0.15 in, fuori punta |
| Baseten | Non pubblicato | Non pubblicato | $0.30 in, V4.1 Flash |
| OpenRouter, Together AI, Fireworks | Non pubblicato | Varia per provider | Verificare alla fonte |
Rispetto ai $0.30 quotati da Baseten, l'input con mancato colpo di cache fuori punta di DeepSeek a $0.15 costa la metà, e il suo input fuori punta in cache a $0.003 è 100 volte più economico (derivato). Non è un rivenditore avido. È una tariffa fissa che incontra una tariffa a quattro livelli.
OpenRouter, Together AI e Fireworks ospitano tutti i modelli DeepSeek. I loro prezzi non sono quotati qui perché non sono stati verificati, e un prezzo obsoleto in un confronto dei costi è peggio di nessun prezzo.
Quando pagare il sovrapprezzo dell'host è la scelta giusta
Effettua il routing tramite un host quando ciò che stai acquistando non sono token. Ci sono quattro situazioni in cui il sovrapprezzo è razionale.
L'approvvigionamento blocca l'endpoint della Cina. Se la tua revisione di sicurezza non approverà la chiamata diretta a DeepSeek, l'host non è un sovrapprezzo, è l'unico modo per spedire. Questo è il motivo più comune per cui i team instradano DeepSeek tramite un provider statunitense.
Hai bisogno di una fattura e una chiave per molti modelli. Un aggregatore che passa da DeepSeek a un endpoint Llama o Qwen quando qualcosa non funziona sta vendendo uptime, non prezzo.
Il tuo traffico è in ora di punta e comunque "cache-cold". Un prodotto interattivo a basso volume che serve le mattine europee si trova all'interno della finestra di punta con prompt brevi e unici. Quel carico di lavoro rinuncia a entrambi gli sconti, il che riduce considerevolmente il vantaggio della prima parte.
Stai ancora valutando. Un credito di prova come i $30 di Baseten non costa nulla e risponde alla domanda sulla qualità prima che tu colleghi un secondo fornitore. Il credito di valutazione gratuito è la forma più economica di diligenza, e AI Perks esiste per catalogare dove è disponibile.

Il cambio di nome dell'endpoint che interrompe le configurazioni di routing
DeepSeek-V4.1-Flash ha silenziosamente ritirato i nomi dei modelli deepseek-v4-flash e deepseek-v4-flash-vision-exp. Esempi di codice e tutorial scritti prima di settembre 2026 li referenziano ancora, e quelle chiamate ora falliscono.
Questo colpisce di più nella configurazione di cui tratta questo articolo. Una configurazione del router contiene gli identificatori dei modelli per diversi provider in un unico file, la maggior parte stabile da anni, quindi un nome silenziosamente ritirato si presenta come un guasto intermittente su un percorso piuttosto che un'interruzione evidente.
Due conseguenze pratiche:
- Effettua una ricerca (grep) nel tuo codebase e nei tuoi modelli di prompt per i vecchi nomi prima di debuggare qualsiasi altra cosa.
- Gli identificatori di modello lato host sono in uno spazio dei nomi diverso da quello di DeepSeek, quindi conferma quale stringa esatta espone il tuo provider piuttosto che presumere che il nome di prima parte funzioni.
DeepSeek non ha un programma di crediti per startup. Altri sì.
L'app di chat di DeepSeek è gratuita, non c'è un livello gratuito API dichiarato sulla pagina ufficiale dei prezzi e DeepSeek non gestisce un programma dedicato di crediti per startup. Le affermazioni di crediti API gratuiti per nuovi account circolano ampiamente ma sono segnalate in modo incoerente e non confermate sulla pagina ufficiale. Trattale come non verificate.
Questa è una lacuna reale. Un'API prezzata così in basso è una delle poche che non darà a una startup un dollaro di autonomia, il che rende DeepSeek un pavimento di costi piuttosto che un gioco di crediti.
I provider che gestiscono programmi sono quelli a cui vale la pena fare domanda, e ce ne sono molti più di quanti la maggior parte dei fondatori sappia. AI Perks tiene traccia di $7,7 milioni in crediti su 194 aziende, che è la linea di bilancio che DeepSeek stesso non coprirà mai.
Vedi quali provider offrono crediti su getaiperks.com →

Domande frequenti
DeepSeek è più economico su OpenRouter o diretto?
Diretto, strutturalmente. Il prezzo dimezzato fuori punta di DeepSeek e il suo sconto di circa 30x sui colpi di cache di V4-Pro sono meccanismi di prima parte che i rivenditori fatturano come un'unica tariffa fissa. Un host guadagna il suo prezzo su conformità, failover e una fattura per più modelli. Per il costo grezzo dei token, la prima parte vince. I crediti dei provider che gestiscono programmi sono su AI Perks.
Quando sono le ore di punta di DeepSeek?
L'ora di punta è dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC nei giorni feriali. Tutto il resto, compresi tutto il sabato e la domenica, viene fatturato a metà prezzo. Ciò lascia circa il 79% della settimana alla tariffa fuori punta per impostazione predefinita (derivato), quindi il lavoro batch e in coda quasi sempre rientra lì senza alcuno sforzo di pianificazione.
Quanto fa risparmiare un colpo di cache DeepSeek?
Su DeepSeek-V4-Pro, un colpo di cache costa $0.022 per milione di token di input fuori punta contro $0.66 per un mancato colpo, circa 30 volte. Su V4.1-Flash lo stesso confronto è $0.003 contro $0.15, circa 50 volte (derivato). Sommando lo sconto cache con l'orario fuori punta, la differenza rispetto a un mancato colpo di punta raggiunge 60x su V4-Pro.
Perché la mia chiamata API deepseek-v4-flash ha smesso di funzionare?
DeepSeek-V4.1-Flash ha ritirato i nomi degli endpoint deepseek-v4-flash e deepseek-v4-flash-vision-exp. Qualsiasi tutorial o esempio di codice scritto prima di settembre 2026 li utilizza ancora e ora fallirà. Aggiorna l'identificatore del modello e nota che gli host di terze parti gestiscono i propri identificatori in modo diverso da quelli di DeepSeek.
DeepSeek offre crediti API gratuiti ai nuovi account?
L'app di chat DeepSeek è gratuita, ma non c'è un livello gratuito API dichiarato sulla pagina ufficiale dei prezzi, e le affermazioni di crediti per nuovi account sono segnalate in modo incoerente e non confermate. DeepSeek inoltre non gestisce alcun programma di crediti per startup. I provider che lo fanno sono tracciati su AI Perks su 194 aziende.
Quanto costa DeepSeek V4-Pro per milione di token?
DeepSeek-V4-Pro-0813 costa $0.66 per milione di token di input con mancato colpo di cache e $1.98 per milione di output fuori punta, raddoppiando a $1.32 e $3.96 durante le ore di punta. L'input in cache costa $0.022 fuori punta. Questa differenziazione su un singolo modello è il motivo per cui una tariffa fissa di rivenditore raramente compete. Compensa le tue fatture di altri modelli su AI Perks.
DeepSeek stabilisce il pavimento dei prezzi. I crediti gratuiti da tutti gli altri coprono il resto.