Prezzi Off-Peak di DeepSeek: Taglia la Tua Fattura API a Metà

DeepSeek applica uno sconto del 50% fuori dagli orari di punta, dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC nei giorni feriali. Le finestre, il moltiplicatore di cache e cosa si risparmia realmente.

DeepSeekDeepSeek PricingOff-Peak PricingLLM API CostsAI Perks
Author Avatar
Andrew
AI Perks Team
5,395

Quick Answer

DeepSeek addebita metà prezzo fuori dagli orari di punta. L'ora di punta è dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC nei giorni feriali, e derivato da queste finestre circa il 79% della settimana si trova al tasso fuori punta. Somma questo alla cache dei prompt, circa 30 volte più economica di una cache miss su V4-Pro, e questo articolo deriva un taglio del 74% su una fattura campione V4-Pro. I programmi di credito dei fornitori che ne gestiscono uno sono tracciati su getaiperks.com.

Quanto fa risparmiare il prezzo fuori picco di DeepSeek?

DeepSeek è l'unico grande fornitore di modelli che addebita in base all'ora del giorno. Le ore di punta sono dalle 01:00 alle 04:00 e dalle 06:00 alle 10:00 UTC nei giorni feriali, e tutto ciò che è al di fuori di queste finestre costa esattamente la metà.

Ciò significa sette ore di punta per giorno feriale, 35 ore su 168 in una settimana. Circa il 79% del calendario è già fuori picco (derivato dalle finestre pubblicate). La maggior parte dei team paga la tariffa intera su una frazione del proprio traffico e non se ne accorge mai.

Lo sconto non è una promozione o un livello di utilizzo impegnato. Si applica automaticamente in base all'orologio al momento dell'arrivo della richiesta. AI Perks tiene traccia dei prezzi dei fornitori e dei programmi di crediti di 194 aziende, e questa è la singola leva di costo più trascurata su ognuna di esse.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Quando sono le ore di punta di DeepSeek nel tuo fuso orario?

Le finestre di punta sono fisse in UTC, quindi la loro collocazione nella tua giornata lavorativa dipende interamente da dove ti trovi. Per i team nordamericani, l'intera giornata lavorativa è già fuori picco.

Convertito dalle finestre UTC pubblicate:

PosizioneFinestra di punta 1Finestra di punta 2
UTC01:00-04:0006:00-10:00
Cina (UTC+8)09:00-12:0014:00-18:00
India (UTC+5:30)06:30-09:3011:30-15:30
Europa Centrale (UTC+2)03:00-06:0008:00-12:00
Regno Unito (UTC+1)02:00-05:0007:00-11:00
US Eastern (UTC-4)21:00-00:0002:00-06:00
US Pacific (UTC-7)18:00-21:0023:00-03:00

La colonna Cina spiega l'intero progetto. Entrambe le finestre di punta si sovrappongono alla giornata lavorativa cinese, mattina e pomeriggio, con la pausa pranzo situata fuori picco tra di esse. Il prezzo di punta è un prezzo di congestione sul mercato interno di DeepSeek.

Due conseguenze pratiche:

Se ti trovi negli Stati Uniti, probabilmente sei già fuori picco per caso. Il tuo traffico dalle 9:00 alle 17:00 si trova al di fuori di entrambe le finestre. Ciò che ti colpisce è il processo batch notturno, che è esattamente quando inizia il picco.

Se ti trovi in Europa, la tua mattinata è costosa e il tuo pomeriggio ha metà prezzo. La finestra locale dalle 08:00 alle 12:00 copre la parte più intensa di una giornata lavorativa europea.

Le finestre sono fisse in UTC, quindi gli orari locali cambiano con l'ora legale e una domenica sera nelle Americhe può cadere all'interno della prima finestra di punta del lunedì.


Il Moltiplicatore Cache che si aggiunge

Il fuori picco dimezza la tua fattura. Un colpo di cache riduce il costo di input di circa 30 volte. I due si moltiplicano e insieme rappresentano quasi l'intera differenza tra ciò che diversi team pagano a DeepSeek per lo stesso lavoro.

Tariffe pubblicate attuali, in USD per milione di token:

ModelloTipo di tokenFuori piccoPicco
DeepSeek-V4-Pro-0813Input, colpo di cache$0.022$0.044
DeepSeek-V4-Pro-0813Input, mancata cache$0.66$1.32
DeepSeek-V4-Pro-0813Output$1.98$3.96
DeepSeek-V4.1-FlashInput, colpo di cache$0.003$0.006
DeepSeek-V4.1-FlashInput, mancata cache$0.15$0.30

Un token di input in cache fuori picco a $0.022 contro una mancata cache in picco a $1.32 è una differenza di 60 volte sullo stesso modello. Non è cambiato nulla nella richiesta tranne quando è stata eseguita e se il prefisso era già residente.

Ecco come appare su un carico di lavoro mensile reale di 50 milioni di token di input e 10 milioni di token di output su V4-Pro (aritmetica derivata dalla tabella sopra):

ConfigurazioneInputOutputTotale mensile
Picco, nessuna cache$66.00$39.60$105.60
Picco, 80% di colpi di cache$14.96$39.60$54.56
Fuori picco, nessuna cache$33.00$19.80$52.80
Fuori picco, 80% di colpi di cache$7.48$19.80$27.28

Questa è una riduzione del 74% per gli stessi token e lo stesso modello. Le due righe centrali stabiliscono quale leva tirare per prima: spostare l'orologio da solo ($52.80) supera la cache da sola ($54.56), ed è una riga di configurazione cron piuttosto che un refactor del prompt.

Notare poi il dettaglio che quasi nessuno sottolinea: a $27.28, i token di output rappresentano $19.80 della fattura, circa il 73%. Una volta che si utilizza la cache e si passa al fuori picco, DeepSeek smette completamente di essere un problema di costo di input e diventa un problema di lunghezza dell'output. Tagliare risposte verbose vale quindi più di qualsiasi ulteriore ottimizzazione del prompt.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Cosa è cambiato dall'ultima guida sui prezzi di DeepSeek

DeepSeek-V4-Pro-0813 ha raggiunto la disponibilità generale il 13 agosto 2026 e il prezzo per ora del giorno è stato introdotto il 16 agosto 2026. Qualsiasi guida sui costi di DeepSeek scritta prima di tali date descrive un modello di prezzo che non esiste più.

La cronologia che conta:

  • 24 aprile 2026: anteprima di V4-Pro e V4-Flash, con una finestra di contesto di 1 milione di token, fino a 384K di output e modalità di pensiero e non pensiero selezionabili (confidenza: media).
  • 31 luglio 2026: DeepSeek-V4-Flash-0731, la release stabile di Flash. L'ultimo prezzo conosciuto prima della modifica era $0.14 per milione di token di input senza cache e $0.28 per milione di output (confidenza: media, solo storico).
  • 13 agosto 2026: disponibilità generale di V4-Pro-0813.
  • 16 agosto 2026: entra in vigore il prezzo di picco e fuori picco.
  • Circa 10 settembre 2026: DeepSeek-V4.1-Flash, live nella documentazione come DeepSeek-Flash.

Confronta il vecchio prezzo fisso di input di Flash di $0.14 con il nuovo $0.15 fuori picco e $0.30 di picco. La modifica di agosto non è stata una riduzione di prezzo, ma una divisione del prezzo. Eseguendo Flash fuori picco si paga all'incirca quanto si pagava sempre. Eseguendolo all'interno di una finestra di punta si paga circa il doppio della vecchia tariffa. I team che non hanno mai guardato l'orologio hanno subìto silenziosamente un aumento di prezzo.


Il cambiamento di rottura in DeepSeek V4.1-Flash

DeepSeek-V4.1-Flash ha ritirato i nomi degli endpoint deepseek-v4-flash e deepseek-v4-flash-vision-exp. Il codice scritto contro di essi fallisce e la maggior parte dei tutorial ancora pubblicati online li fa riferimento.

Ciò è avvenuto senza clamore, che è la peggiore versione di un cambiamento di rottura: i tutorial, le risposte di Stack Overflow e i repository di avvio che si classificano bene per le query DeepSeek sono stati scritti prima di esso e non sono stati aggiornati. Se stai risolvendo un'integrazione che funzionava il mese scorso, controlla la tua stringa del modello prima di controllare qualsiasi altra cosa.

La lezione si generalizza: DeepSeek documenta le modifiche nella documentazione API anziché annunciarle, quindi fissa esplicitamente gli identificatori dei modelli e rileggi la pagina dei prezzi trimestralmente.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

DeepSeek offre crediti gratuiti o un programma per startup?

L'app di chat DeepSeek è gratuita. Non esiste un livello gratuito API dichiarato sulla pagina ufficiale dei prezzi e DeepSeek non gestisce alcun programma di crediti per startup dedicato.

Fai attenzione a ciò che leggi altrove qui. Le affermazioni secondo cui i nuovi account API ricevono crediti gratuiti sono segnalate in modo incoerente e non confermate sulla pagina ufficiale dei prezzi di DeepSeek. Molti articoli ripetono comunque una cifra. Considera qualsiasi numero specifico che vedi come non verificato finché non lo ottieni direttamente da DeepSeek.

Questa assenza è la vera storia per i fondatori. Quasi tutti i principali fornitori ora gestiscono una qualche forma di programma di crediti e DeepSeek no. La sua risposta ai costi è un basso prezzo di listino più le meccaniche fuori picco e cache sopra menzionate, che è una strategia genuinamente diversa, ma significa che non c'è un percorso gratuito a cui fare domanda.

La mossa pratica è trattare DeepSeek come il tuo livello economico sempre attivo e finanziare i livelli costosi con i crediti dei fornitori che gestiscono programmi. AI Perks tiene traccia di $7.7 milioni in crediti su 194 aziende, che è da dove proviene effettivamente quel percorso.

Trova i programmi che offrono crediti su getaiperks.com →

Per l'hosting di terze parti, Baseten elenca l'input di DeepSeek V4.1 Flash a $0.30 per milione e offre un credito di prova di $30 per nuovo spazio di lavoro (verifica prima di preventivare). OpenRouter, Together e Fireworks ospitano anche modelli DeepSeek. I loro prezzi cambiano abbastanza spesso che la decisione di routing dovrebbe essere presa in base a latenza, regione e affidabilità, quindi riprezzata nel momento in cui ti impegni.


Come ristrutturare un carico di lavoro attorno alle ore fuori picco

Passaggio 1: Finanzia prima il tuo livello premium. Inizia su getaiperks.com e raccogli crediti per i fornitori a cui indirizzi attività difficili, in modo che DeepSeek gestisca solo il lavoro di volume.

Passaggio 2: Sposta ogni lavoro batch fuori dalle finestre di picco. Backfill, esecuzioni di embedding, scansioni di valutazione e riepiloghi notturni non hanno scadenze. Spostare un cron job di due ore è uno sconto del 50% per una riga di configurazione.

Passaggio 3: Stabilizza il prefisso del tuo prompt. I colpi di cache dipendono da un prefisso iniziale identico, quindi metti le parti volatili del tuo prompt per ultime. È qui che vive il fattore 30x.

Passaggio 4: Misura il tuo effettivo tasso di colpi di cache. La maggior parte dei team presume che la cache funzioni e non abbia mai controllato. Il divario tra un 80% presunto e un 30% effettivo rappresenta la maggior parte della tua fattura.

Passaggio 5: Attacca la lunghezza dell'output. Una volta completati i passaggi 2 e 3, i token di output dominano. Risposte più brevi sono ora la tua più grande leva rimanente.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Domande frequenti

Quali sono le ore fuori picco di DeepSeek?

Il fuori picco è tutto ciò che è al di fuori delle 01:00-04:00 e delle 06:00-10:00 UTC nei giorni feriali, il che si traduce in circa il 79% della settimana, inclusi tutti i sabati e le domeniche. Le richieste fuori picco costano esattamente la metà della tariffa di picco sia sui token di input che di output, applicate automaticamente senza necessità di configurazione.

DeepSeek ha un livello API gratuito?

No. L'app di chat DeepSeek è gratuita, ma non esiste un livello gratuito API dichiarato sulla pagina ufficiale dei prezzi. Le segnalazioni di crediti gratuiti per nuovi account API sono incoerenti e non confermate. Per un percorso API gratuito effettivo, vedere i programmi tracciati su AI Perks.

Quanto costa di meno un colpo di cache DeepSeek?

Su DeepSeek-V4-Pro-0813, un colpo di cache costa $0.022 per milione di token di input fuori picco rispetto a $0.66 per una mancata cache, il che è 30 volte più economico. Rispetto a una mancata cache in picco di $1.32, la differenza raggiunge 60 volte sullo stesso modello per la stessa richiesta.

Perché la mia chiamata API DeepSeek ha smesso di funzionare?

DeepSeek-V4.1-Flash ha ritirato i nomi degli endpoint deepseek-v4-flash e deepseek-v4-flash-vision-exp. Tutorial e campioni di codice più vecchi li fanno ancora riferimento e ora falliscono. Controlla prima la stringa del tuo identificatore di modello, poiché questa modifica è stata rilasciata silenziosamente e la maggior parte delle guide pubblicate non è stata aggiornata. Fissa esplicitamente il nome corrente nella tua configurazione.

DeepSeek ha un programma di crediti per startup?

No. DeepSeek non gestisce alcun programma di crediti per startup dedicato, a differenza della maggior parte dei principali fornitori di modelli. La sua strategia di costo è un basso prezzo di listino più gli sconti fuori picco e di caching invece. Per i fornitori che offrono crediti per startup, AI Perks tiene traccia di $7.7 milioni su 194 aziende.

Devo eseguire DeepSeek tramite OpenRouter o direttamente?

L'accesso diretto è dove si applicano i prezzi fuori picco e cache come pubblicato. I rivenditori impostano le proprie tariffe e potrebbero non trasferire lo sconto orario. Baseten, OpenRouter, Together e Fireworks ospitano tutti modelli DeepSeek, quindi confronta in base a latenza e regione, quindi verifica il prezzo corrente prima di impegnarti.


Iscriviti su getaiperks.com →

DeepSeek non ti darà crediti. Molti altri lo faranno, e sono tutti su getaiperks.com.

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.