Prezzi API DeepSeek: Le ore di punta costano il doppio nel 2026

L'API DeepSeek fattura in base all'ora del giorno. Le ore non di punta costano la metà, una cache hit costa 30 volte meno e un rinomina di endpoint rompe il codice precedente.

DeepSeekDeepSeek APIDeepSeek PricingLLM API PricingAI Perks
Author Avatar
Andrew
AI Perks Team
5,217

Quick Answer

L'API DeepSeek applica tariffe diverse in base all'ora del giorno. DeepSeek-V4-Pro-0813 costa $0,66 per milione di token di input cache-miss e $1,98 per milione di token di output in orario non di punta, e esattamente il doppio durante le ore di punta nei giorni feriali dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC. Non è previsto un livello gratuito API dichiarato né un programma di crediti di avvio DeepSeek, quindi i fondatori che cercano crediti iniziano su getaiperks.com.

Quanto costa l'API DeepSeek a settembre 2026?

DeepSeek-V4-Pro-0813 costa $0,66 per milione di token di input cache-miss e $1,98 per milione di token di output fuori dall'ora di punta, e esattamente il doppio durante l'ora di punta. DeepSeek è l'unico importante fornitore di modelli che fissa i prezzi in base all'ora del giorno, motivo per cui qualsiasi "prezzo API DeepSeek" singolo che leggerai sarà sbagliato almeno una parte della settimana.

Prezzi pubblicati attuali, in USD per milione di token:

ModelloInput, cache hitInput, cache missOutput
DeepSeek-V4-Pro-0813, fuori dall'ora di punta$0,022$0,66$1,98
DeepSeek-V4-Pro-0813, ora di punta$0,044$1,32$3,96
DeepSeek-V4.1-Flash, fuori dall'ora di punta$0,003$0,15Non confermato
DeepSeek-V4.1-Flash, ora di punta$0,006$0,30Non confermato

I prezzi di output Flash sono contrassegnati come non confermati anziché ipotizzati, perché la pagina pubblicata di DeepSeek non li ha confermati. Verificali tu stesso prima di fare un budget basato su di essi.

Queste sono le tariffe di DeepSeek. DeepSeek non gestisce programmi di credito per startup, il che lo rende l'eccezione tra i fornitori all'avanguardia: AI Perks tiene traccia di $7,7 milioni in crediti per 194 aziende, e DeepSeek non è tra queste.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Ora di punta e fuori dall'ora di punta: DeepSeek ti fattura in base all'orologio

Le ore di punta sono dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC nei giorni feriali. Tutto il resto, inclusi l'intero fine settimana, è fuori dall'ora di punta a metà prezzo.

Ci sono sette ore di punta per giorno feriale, 35 a settimana. Derivato da queste finestre, circa il 79% della settimana viene fatturato alla tariffa fuori dall'ora di punta (133 ore su 168).

Convertendo le finestre in orario di Pechino, la logica diventa ovvia. 01:00-04:00 UTC sono le 09:00-12:00 locali, e 06:00-10:00 UTC sono le 14:00-18:00. La finestra di punta di DeepSeek è la giornata lavorativa cinese con la pausa pranzo esclusa dal centro, che è un calcolo derivato dalle finestre UTC dichiarate piuttosto che un'affermazione che DeepSeek fa.

Per un team al di fuori dell'Asia, è quasi denaro gratuito. Derivato dalle finestre dichiarate e dagli offset di settembre 2026, ecco quanto della giornata lavorativa locale dalle 09:00 alle 18:00 rientra nella finestra di punta:

Posizione del teamOrario locale 09:00-18:00, in UTCOre di lavoro al prezzo di punta
Pacifico USA (UTC-7)16:00-01:000 di 9
Orientale USA (UTC-4)13:00-22:000 di 9
Regno Unito (UTC+1)08:00-17:002 di 9
Europa Centrale (UTC+2)07:00-16:003 di 9
India (UTC+5:30)03:30-12:304,5 di 9
Cina (UTC+8)01:00-10:007 di 9

Un team statunitense che gestisce traffico nelle ore lavorative interattive non paga mai la tariffa di punta di DeepSeek. Un team europeo la paga per un terzo della giornata e può spostare il lavoro batch fuori dalla finestra UTC 06:00-10:00 per evitarla del tutto, senza alcun costo di ingegneria.


I cache hit sono l'altro moltiplicatore, e si sommano

Un cache hit su DeepSeek-V4-Pro costa $0,022 per milione di token di input contro $0,66 per un miss, esattamente 30 volte più economico (derivato). Sommalo all'ora fuori punta e la differenza tra il prezzo di input migliore e peggiore sullo stesso modello raggiunge 60 volte.

Confronta $0,022 per milione per un token fuori punta in cache con $1,32 per milione per un cache miss di punta. Stesso modello, stesso token, 60 volte di differenza.

Ecco cosa fanno i due moltiplicatori su una fattura reale. Prendiamo 50 milioni di token di input e 10 milioni di token di output al mese su V4-Pro, con ogni cifra derivata dai prezzi sopra:

ScenarioInputOutputTotale mensile
Punta, cache miss$66,00$39,60$105,60
Punta, cache hit$2,20$39,60$41,80
Fuori punta, cache miss$33,00$19,80$52,80
Fuori punta, cache hit$1,10$19,80$20,90

Lavoro identico, una differenza di 5 volte, e le uniche due variabili sono quando invii la richiesta e se il tuo prefisso prompt è stabile.

Un'altra conclusione deriva da quella tabella. Una volta che il tuo input è in cache, l'output rappresenta circa il 95% della fattura ($19,80 su $20,90). L'ottimizzazione della cache ha un limite, e oltre esso l'unica leva rimasta è generare meno token di output.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Cosa è cambiato in DeepSeek V4 dalla precedente guida sui prezzi

Qualsiasi guida DeepSeek che citi un singolo prezzo di input è stata scritta prima del 16 agosto 2026 ed è ora errata in entrambe le direzioni: troppo alta per l'ora fuori punta, troppo bassa per l'ora di punta.

DataRilascioCosa è cambiato
24 aprile 2026Anteprima V4-Pro e V4-FlashContesto 1M di token, fino a 384K di output, modalità selezionabili di pensiero e non-pensiero (confidenza: media)
31 luglio 2026DeepSeek-V4-Flash-0731Linea Flash stabile a $0,14 di input cache-miss, $0,28 di output (storico, ora superato)
13 agosto 2026DeepSeek-V4-Pro-0813Disponibilità generale del modello di ragionamento e agenti di punta
Intorno al 10 settembre 2026DeepSeek-V4.1-FlashGenerazione Flash attuale, attiva nella documentazione come "DeepSeek-Flash"

Il confronto Flash da luglio a settembre è l'illustrazione più chiara. Un prezzo fisso di $0,14 per milione di token di input cache-miss è diventato $0,15 fuori dall'ora di punta e $0,30 all'ora di punta. L'ora fuori punta è circa il vecchio prezzo, l'ora di punta è più del doppio (derivato). Il traffico che rientra nella finestra di punta è diventato più costoso del 114% (derivato: $0,30 contro $0,14) mentre l'intestazione rimaneva "economica".


Il rinominare dell'endpoint che interrompe il vecchio codice DeepSeek

DeepSeek-V4.1-Flash ha silenziosamente ritirato i nomi dei modelli deepseek-v4-flash e deepseek-v4-flash-vision-exp. Il codice e i tutorial che li richiamano ancora falliranno.

Questo è il motivo più comune per cui un'integrazione DeepSeek che funzionava in agosto smette di funzionare in settembre. Non è un avviso di deprecazione graduale, è un identificatore di modello che non si risolve più.

Da ciò derivano due regole:

Fissa il nome del modello in un unico posto. Se la stringa appare in sei file, un rinominare richiede sei modifiche e un incidente di produzione.

Considera qualsiasi tutorial più vecchio di un mese come un rischio di denominazione. Questa singola release ha ritirato due identificatori contemporaneamente, senza una finestra di deprecazione per avvisarti. Copia l'architettura da una vecchia guida, quindi verifica la stringa del modello rispetto alla documentazione attuale.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Esiste un livello gratuito o un credito per startup dell'API DeepSeek?

L'app di chat DeepSeek è gratuita. L'API non ha un livello gratuito dichiarato sulla pagina dei prezzi ufficiale e DeepSeek non gestisce un programma di credito per startup dedicato.

È qui che la maggior parte degli articoli su DeepSeek sbaglia. Le affermazioni secondo cui i nuovi account API ricevono crediti gratuiti sono segnalate in modo incoerente e non sono confermate sulla pagina dei prezzi ufficiale di DeepSeek. Considerale come non verificate piuttosto che come un piano su cui puoi basare il tuo budget.

La mancanza del programma per startup è il divario maggiore. Quasi tutti gli altri fornitori all'avanguardia, tra cui Anthropic, OpenAI, Google e i principali cloud, gestiscono una qualche forma di programma di crediti per le aziende in fase iniziale. DeepSeek no, il che significa che il modello più economico sul mercato è anche quello che non puoi ottenere gratuitamente.

Ciò inverte il consiglio usuale. Utilizza i crediti gratuiti dove esistono e paga le tariffe già basse di DeepSeek dove non esistono. AI Perks tiene traccia di $7,7 milioni in crediti per 194 aziende, coprendo i fornitori che gestiscono un programma.


Le leve che incidono effettivamente su una fattura DeepSeek

Prezza prima il tuo carico di lavoro. Moltiplica i tuoi token di input e output mensili previsti attraverso i quattro scenari sopra. Se la differenza è piccola, i meccanismi di temporizzazione di DeepSeek non ti riguardano e qualsiasi fornitore andrà bene.

Verifica dove ricade il tuo traffico in UTC. Il traffico interattivo basato negli Stati Uniti è già fuori dall'ora di punta. I team europei e asiatici possono dimezzare quella parte della fattura spostando i lavori batch fuori dalle finestre UTC 01:00-04:00 e 06:00-10:00.

Stabilizza il tuo prefisso prompt. I cache hit sono circa 30 volte più economici dei miss su V4-Pro. Un prompt di sistema che cambia ad ogni chiamata, ad esempio perché interpola un timestamp, vanifica ciò.

Fissa la stringa del modello e verificatela rispetto alla documentazione attuale, poiché deepseek-v4-flash non esiste più.

Copri il resto dello stack con crediti. DeepSeek non te ne darà nessuno, ma la maggior parte degli altri fornitori lo farà. Inizia su getaiperks.com.

Sull'hosting di terze parti: OpenRouter, Together, Fireworks e Baseten servono tutti modelli DeepSeek. Il compromesso è strutturale piuttosto che una questione di centesimi, perché gli aggregatori fatturano una tariffa fissa, quindi instradarsi attraverso uno di essi di solito significa rinunciare allo sconto fuori dall'ora di punta in cambio di affidabilità, una fattura unica e un fallback quando l'endpoint di DeepSeek è lento. Baseten elenca l'input di DeepSeek V4.1 Flash a $0,30 per milione e offre un credito di prova permanente di $30 per nuovo spazio di lavoro, entrambi non verificati qui, quindi conferma prima di fare un budget. Nota che $0,30 corrisponde esattamente al prezzo di punta di DeepSeek, quindi una tariffa fissa a quel livello vince solo se il tuo traffico sarebbe stato comunque di punta.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Domande frequenti

Quanto costa l'API DeepSeek?

DeepSeek-V4-Pro-0813 costa $0,66 per milione di token di input cache-miss e $1,98 per milione di token di output fuori dall'ora di punta. Le ore di punta, dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC nei giorni feriali, costano esattamente il doppio. L'input in cache scende a $0,022 per milione. I crediti per il resto del tuo stack sono tracciati su getaiperks.com.

Quando sono le ore di punta di DeepSeek?

L'ora di punta è dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC nei giorni feriali. Tutto il resto, inclusi l'intero fine settimana, è fuori dall'ora di punta a metà prezzo. Derivato da queste finestre, circa il 79% della settimana viene fatturato alla tariffa più economica, e le finestre corrispondono alla giornata lavorativa cinese da entrambi i lati della pausa pranzo.

L'API DeepSeek ha un livello gratuito?

Nessun livello gratuito dell'API è dichiarato sulla pagina dei prezzi ufficiale di DeepSeek. L'app di chat DeepSeek è gratuita, ma si tratta di un prodotto separato. Le affermazioni sui crediti API gratuiti per nuovi account sono segnalate in modo incoerente e non confermate. Per i crediti confermati, consulta getaiperks.com.

DeepSeek offre crediti per startup?

DeepSeek non gestisce un programma di credito per startup dedicato, il che è insolito tra i fornitori di modelli all'avanguardia. L'approccio pratico è utilizzare i crediti gratuiti dai fornitori che ne gestiscono uno e pagare le tariffe basse di DeepSeek per tutto il resto. AI Perks tiene traccia di $7,7 milioni per 194 aziende.

Perché la mia chiamata API DeepSeek ha smesso di funzionare?

La causa più probabile è il nome del modello. DeepSeek-V4.1-Flash ha ritirato gli identificatori deepseek-v4-flash e deepseek-v4-flash-vision-exp, quindi il codice o i tutorial scritti prima di settembre 2026 che li richiamano falliranno con un identificatore di modello che non si risolve più. Controlla la stringa del modello rispetto alla documentazione attuale prima di eseguire il debug di qualsiasi altra cosa.

DeepSeek è più economico direttamente o tramite OpenRouter o Baseten?

Fuori dall'ora di punta, di solito sì, poiché gli aggregatori fatturano una tariffa fissa e non possono trasferire uno sconto in base all'ora del giorno. Baseten elenca l'input di V4.1 Flash a $0,30 per milione, che corrisponde al prezzo di punta di DeepSeek. Gli aggregatori vincono per affidabilità e routing piuttosto che per la tariffa fuori dall'ora di punta.


Iscriviti su getaiperks.com →

Il modello più economico sul mercato è quello che nessuno regala. Budgetta di conseguenza.

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.