DeepSeek Prezzi per il Coding 2026: Costi Fuori Picco e Cache

DeepSeek è l'unico importante fornitore di modelli che applica prezzi in base all'ora del giorno. Tariffe di punta e fuori punta, economia cache-hit per agenti di codifica e cosa è cambiato in V4.

DeepSeekDeepSeek V4LLM PricingAI Coding ToolsFree AI Credits
Author Avatar
Andrew
AI Perks Team
7,965

Quick Answer

DeepSeek-V4-Pro costa $0,66 per milione di token di input cache-miss e $1,98 per milione di token di output fuori orario di punta, e esattamente il doppio di entrambi durante le ore di punta. L'input memorizzato nella cache scende a $0,022 per milione. DeepSeek non offre alcun programma di credito di avvio, quindi i fondatori accumulano crediti dai fornitori che lo fanno su getaiperks.com.

Quanto costa DeepSeek per il lavoro di codifica nel 2026?

DeepSeek-V4-Pro-0813 costa $0,66 per milione di token di input con cache miss fuori dagli orari di punta e $1,98 per milione di token di output fuori dagli orari di punta, e il doppio di entrambe le cifre durante le ore di punta. L'input memorizzato nella cache scende a $0,022 per milione fuori dagli orari di punta, dove si trova il vero guadagno.

DeepSeek è l'unico importante fornitore di modelli che addebita in base all'ora del giorno. Due moltiplicatori si sommano e insieme raccontano l'intera storia di quanto costa effettivamente DeepSeek: le ore fuori dagli orari di punta dimezzano il conto, e un cache hit è circa 30 volte più economico di un cache miss.

Questa combinazione è fondamentale per la codifica. Un loop di codifica agentivo ripete lo stesso contesto del repository ad ogni turno, quindi è l'unico carico di lavoro in cui alti tassi di cache hit sono più strutturali che fortuiti.

DeepSeek stesso non offre alcun programma di credito per startup. I fornitori che lo fanno sono tracciati su AI Perks, insieme a 7,7 milioni di dollari in crediti distribuiti su 194 aziende.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Prezzi di punta e fuori dagli orari di punta: il meccanismo che nessuno spiega

Gli orari di punta di DeepSeek sono dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC nei giorni feriali. Tutto il resto, inclusi tutto il sabato e la domenica, è fuori dagli orari di punta a metà prezzo.

Prezzi di listino attuali, per milione di token:

ModelloInput, cache hitInput, cache missOutput
DeepSeek-V4-Pro-0813, fuori dagli orari di punta$0,022$0,66$1,98
DeepSeek-V4-Pro-0813, ore di punta$0,044$1,32$3,96
DeepSeek-V4.1-Flash, fuori dagli orari di punta$0,003$0,15non pubblicato
DeepSeek-V4.1-Flash, ore di punta$0,006$0,30non pubblicato

Da queste finestre derivano due aspetti che quasi nessuno dichiara apertamente. Entrambi sono calcoli derivati dal programma UTC pubblicato, non cifre citate.

Le ore di punta rappresentano solo circa il 21% della settimana. Sette ore di punta per giorno feriale equivalgono a 35 ore su 168. Poco meno dell'80% di tutto il tempo è già fuori dagli orari di punta prima di apportare qualsiasi modifica.

Un'intera giornata lavorativa statunitense non tocca mai le ore di punta. Dalle 9:00 alle 17:00 Pacifico corrispondono alle 16:00 alle 24:00 UTC. Dalle 9:00 alle 17:00 Orientale corrispondono alle 13:00 alle 21:00 UTC. Nessuna delle due finestre si sovrappone a un blocco di punta, quindi i team con sede negli Stati Uniti pagano accidentalmente la metà del prezzo. Le mattine europee sono l'eccezione: dalle 08:00 alle 10:00 UTC sono ore di punta, che corrispondono alle 9:00-11:00 a Londra e alle 10:00-12:00 a Berlino.

C'è anche un intervallo di due ore fuori dagli orari di punta tra i due blocchi di punta, dalle 04:00 alle 06:00 UTC, che è un parcheggio gratuito per i lavori CI notturni e i refactoring batch.


Perché i Cache Hit Contano di Più per la Codifica che per la Chat

Un cache hit su DeepSeek-V4-Pro costa $0,022 per milione di token fuori dagli orari di punta contro $0,66 per un miss, un divario di 30 volte, e gli agenti di codifica generano i più alti tassi di hit naturali di qualsiasi carico di lavoro.

Il traffico chat è uno stream di prompt brevi e non correlati, quindi la maggior parte degli input è nuova. Un agente di codifica è l'opposto: trasporta lo stesso albero di file, lo stesso prompt di sistema e la stessa recente diff attraverso ogni turno di una lunga sessione.

Ecco cosa fanno i due moltiplicatori su un identico pezzo di lavoro. Volumi illustrativi, aritmetica derivata dai prezzi di listino sopra:

Un'esecuzione dell'agente: 2M input, 200K outputCosto
Fuori dagli orari di punta, 90% di tasso di cache hit$0,57
Ore di punta, 90% di tasso di cache hit$1,14
Fuori dagli orari di punta, senza caching$1,72
Ore di punta, senza caching$3,43

Stessi token, stesso modello, stesso output. Uno spread di 6x su lavoro identico, deciso interamente dall'orologio e dalla disciplina della cache.

Spingendo all'estremo, il divario si allarga ulteriormente: un token di input memorizzato nella cache fuori dagli orari di punta a $0,022 per milione contro un token con cache miss durante le ore di punta a $1,32 per milione è uno spread di 60x sullo stesso modello. Nessun altro fornitore ha una leva di questo tipo, motivo per cui così pochi tutorial la menzionano.

A mille esecuzioni di agenti al mese, la stessa aritmetica derivata fornisce circa $570 contro circa $3.430. Per un team che paga anche per Claude o GPT per i compiti più difficili, AI Perks copre il lato crediti di quella fattura.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Cosa è cambiato in DeepSeek dal lancio di V4

Quattro rilasci in cinque mesi hanno spostato DeepSeek da un prezzo fisso per token a un prezzo basato sull'ora del giorno, e la maggior parte delle guide pubblicate cita ancora i vecchi numeri fissi.

La sequenza, con la confidenza indicata dove appropriato:

  • 24 aprile 2026: Anteprima di DeepSeek V4-Pro e V4-Flash. Contesto di 1 milione di token, fino a 384K token di output, modalità di pensiero e non-pensiero commutabili. (Confidenza: media.)
  • 31 luglio 2026: DeepSeek-V4-Flash-0731, il rilascio stabile di Flash. I prezzi all'epoca erano $0,14 per milione di input con cache miss e $0,28 per milione di output. (Solo contesto storico, non prezzi attuali.)
  • 13 agosto 2026: DeepSeek-V4-Pro-0813 raggiunge la disponibilità generale come modello di ragionamento e agente di punta.
  • 16 agosto 2026: arriva la divisione tra ore di punta e fuori dagli orari di punta e finiscono i prezzi fissi.
  • Intorno al 10 settembre 2026: DeepSeek-V4.1-Flash, disponibile nella documentazione come "DeepSeek-Flash".

Se stai leggendo un confronto dei costi di DeepSeek che mostra un singolo prezzo di input e un singolo prezzo di output senza menzione delle ore UTC, è antecedente al 16 agosto 2026 e le sue conclusioni sono errate in entrambe le direzioni.


Il cambio di nome dell'endpoint che rompe il vecchio codice

DeepSeek-V4.1-Flash ha silenziosamente ritirato i nomi dei modelli deepseek-v4-flash e deepseek-v4-flash-vision-exp. Il codice che li utilizza ancora fallirà.

Questo è il tipo di cambiamento che mette in difficoltà un team in un momento scomodo, perché il fallimento si manifesta in runtime in qualsiasi servizio che utilizzi la stringa, non in fase di build. Vecchi tutorial, risposte di Stack Overflow e file di configurazione copiati portano ancora i nomi ritirati.

Due conseguenze pratiche. Primo, esegui un grep sul tuo repository per entrambe le stringhe prima del prossimo deploy, non dopo. Secondo, considera inaffidabili tutti i tutorial DeepSeek pubblicati prima di settembre 2026, sia per gli identificatori dei modelli che per i prezzi.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

DeepSeek offre un piano gratuito o crediti per startup?

L'app chat di DeepSeek è gratuita. Non c'è un piano gratuito per API dichiarato sulla pagina ufficiale dei prezzi, e DeepSeek non gestisce alcun programma dedicato di crediti per startup.

Fai attenzione ai secondi e terzi punti, perché è qui che la maggior parte dei siti sbaglia su DeepSeek. Le affermazioni secondo cui i nuovi account API ricevono crediti gratuiti sono riportate in modo incoerente e non confermate sulla pagina ufficiale dei prezzi. Chiunque citi una cifra specifica di credito per nuovi account sta ripetendo qualcosa che DeepSeek non ha pubblicato.

L'assenza di un programma per startup è il fatto più utile. I prezzi bassi per token non sono la stessa cosa di una sovvenzione, e un fondatore che ottimizza solo per il prezzo di listino sta lasciando sul tavolo il numero più grande:

PercorsoCosa è realmente
App chat DeepSeekGratuita, nessun accesso API
API DeepSeekA pagamento dal primo token, nessun piano gratuito dichiarato
Crediti per startup DeepSeekNon esiste
Altri principali fornitori di modelliMolti gestiscono programmi dedicati di crediti per startup

DeepSeek è il modo più economico per pagare. Non è un modo per non pagare. Queste sono strategie diverse e i team più forti utilizzano entrambe: DeepSeek per il lavoro di codifica ad alto volume e memorizzato nella cache, crediti concessi per i modelli di frontiera in aggiunta. AI Perks tiene traccia di quali fornitori finanziano attualmente questa seconda parte.

Gli host di terze parti sono una soluzione parziale. Baseten elenca l'input di DeepSeek V4.1 Flash a $0,30 per milione e ha un credito di prova di $30 per nuovo spazio di lavoro (confidenza: media, verifica prima di fare budget su di esso). OpenRouter, Together e Fireworks ospitano anche modelli DeepSeek. I loro prezzi cambiano abbastanza frequentemente che il consiglio onesto è di controllarli tu stesso il giorno stesso anziché fidarti di qualsiasi numero in un post del blog, incluso questo.


Come ridurre la bolletta della codifica con DeepSeek

Passaggio 1: Copri il livello di frontiera con i crediti. Controlla quali fornitori finanziano attualmente quel livello su getaiperks.com, in modo che DeepSeek si occupi solo del lavoro di volume.

Passaggio 2: Controlla in quale fuso orario vengono eseguiti i tuoi agenti. Se i tuoi lavori di CI, refactoring notturni o valutazioni batch vengono eseguiti tra le 01:00 e le 04:00 o le 06:00 e le 10:00 UTC, spostandoli di qualche ora si dimezza quella voce di spesa senza modifiche al codice.

Passaggio 3: Rendi stabile il prefisso memorizzato nella cache. Qualsiasi cosa che riordini il tuo prompt di sistema, inserisca un timestamp o mescoli il contesto dei file trasforma un token da $0,022 in un token da $0,66.

Passaggio 4: Dividi i modelli per lavoro. V4-Pro per ragionamento e loop di agenti, Flash per classificazione, linting e le chiamate economiche ad alta frequenza che li circondano.

Passaggio 5: Controlla subito le tue stringhe modello. I nomi degli endpoint Flash ritirati rappresentano un'interruzione programmata in attesa di chi effettuerà il prossimo deploy.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Domande frequenti

Quanto costa DeepSeek per la codifica?

DeepSeek-V4-Pro-0813 costa $0,66 per milione di token di input con cache miss e $1,98 per milione di token di output fuori dagli orari di punta. Le ore di punta costano esattamente il doppio. L'input memorizzato nella cache costa $0,022 per milione fuori dagli orari di punta. Le fatture di codifica reali si collocano tra questi estremi a seconda del tasso di cache hit e dell'ora.

Quali sono gli orari di punta e fuori dagli orari di punta di DeepSeek?

Gli orari di punta sono dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC nei giorni feriali. Tutto il resto, inclusi i fine settimana, è fuori dagli orari di punta a metà prezzo. Derivato da queste finestre, ciò lascia circa l'80% della settimana fuori dagli orari di punta, e una tipica giornata lavorativa statunitense si colloca interamente al di fuori di entrambe le finestre di punta.

DeepSeek offre crediti API gratuiti?

L'app chat di DeepSeek è gratuita, ma non c'è un piano gratuito per API dichiarato sulla pagina ufficiale dei prezzi. I resoconti di crediti gratuiti per i nuovi account API sono incoerenti e non confermati. DeepSeek inoltre non gestisce un programma di crediti per startup, a differenza della maggior parte dei principali fornitori tracciati su AI Perks.

Perché la mia chiamata API DeepSeek ha smesso di funzionare?

DeepSeek-V4.1-Flash ha ritirato i nomi dei modelli deepseek-v4-flash e deepseek-v4-flash-vision-exp. Qualsiasi codice, tutorial o configurazione che utilizza ancora queste stringhe fallirà in runtime. Il cambio di nome non è stato annunciato in modo evidente, quindi i vecchi esempi e le configurazioni copiate li riportano ancora. Cerca nel tuo repository entrambe le stringhe e aggiornale all'attuale identificatore Flash.

DeepSeek è più economico di Claude o GPT per la codifica?

Al prezzo di listino, sostanzialmente, specialmente con un alto tasso di cache hit fuori dagli orari di punta. Sul costo totale, il confronto cambia una volta che i crediti per startup sono coinvolti, poiché DeepSeek non ne concede nessuno e molti rivali sì. Controlla cosa finanziano le alternative prima di presumere su AI Perks.

Dovrei utilizzare DeepSeek tramite OpenRouter o Baseten invece?

Gli host di terze parti aggiungono flessibilità di routing, fallback e talvolta crediti di prova, ma prezzano indipendentemente dal programma di punta e fuori dagli orari di punta di DeepSeek. Baseten offre un credito di prova di $30 per nuovo spazio di lavoro. Verifica qualsiasi cifra per token ospitata il giorno stesso, poiché questi prezzi cambiano frequentemente.


Iscriviti su getaiperks.com →

DeepSeek è il modo più economico per pagare. I crediti sono il modo per non pagare.

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.