Quanti token gratuiti offre il Programma Z.ai Startups?
Il Programma Z.ai Startups concede alle startup approvate fino a 1 miliardo di token gratuiti per l'API GLM.
La maggior parte dei programmi per startup dei fornitori sono denominati in dollari. Zhipu AI, il laboratorio dietro Z.ai e i modelli GLM, denomina questo in token anziché in dollari. Questa singola differenza rende difficile confrontare l'offerta su un foglio di calcolo, ed è probabilmente il motivo per cui la sovvenzione riceve così poca attenzione rispetto alla sua entità.
Oltre ai token, Z.ai elenca prezzi all'ingrosso, limiti di velocità prioritari e supporto tecnico per le aziende approvate. AI Perks tiene traccia delle condizioni attuali accanto al resto dei programmi dei fornitori.
Questa pagina esegue la conversione e etichetta qualsiasi dato che sia riportato piuttosto che confermato nelle pagine di Z.ai.

GLM-5.1, 5.2 e 5.3: Cosa è stato rilasciato e quando
Zhipu AI ha rilasciato tre versioni di punta GLM in circa quattro mesi e i numeri di versione li rendono facili da confondere.
| Rilascio | Data | Cos'è |
|---|---|---|
| GLM-5.1 | 8 aprile 2026 | Modello agente di punta open-source, migliore in codifica, supporto alla visione e input di file |
| GLM-5.2 | 13 giugno 2026 | Modello di punta a miscela di esperti da 744 miliardi di parametri, completamente open source con una semplice licenza MIT |
| GLM-5.3 e GLM-5.3-Flash | 14 agosto 2026 | Modello di punta per il ragionamento orientato alla codifica e alla difesa informatica, più un fratello Flash più economico e veloce |
Una fonte secondaria indica la data di GLM-5.3 al 17 agosto anziché al 14 agosto. La discrepanza non è stata riconciliata, quindi considera la data esatta come incerta.
GLM-5.3 porta lo slogan "Costruito per codificare. Pronto per la difesa informatica." ed è post-addestrato su una base di 743 miliardi di parametri. I conteggi dei parametri intorno a questa famiglia si spostano tra le fonti di un miliardo o due, quindi il consiglio pratico è di citare la scheda del modello nel repository dei pesi piuttosto che un resoconto del lancio. La finestra di contesto e la lunghezza massima dell'output vale la pena di leggerle dalla documentazione di Z.ai nel momento in cui ne hai bisogno, poiché sono le specifiche più spesso riportate in modo errato da fonti secondarie.
Il modello utile qui è la cadenza, non i numeri di versione. Tre rilasci di punta in circa quattro mesi significa che qualsiasi modello che blocchi oggi è uno che dovrai rivedere entro un trimestre, il che è un argomento a favore del mantenimento del nome del modello nella configurazione piuttosto che sparso nel tuo codice.
Quanto costa GLM a prezzo di listino
GLM-5.1, GLM-5.2 e GLM-5.3 costano tutti esattamente lo stesso: $1,40 per milione di token di input, $4,40 per milione di token di output e $0,26 per milione di token di input memorizzati nella cache.
Questi dati provengono dalla documentazione ufficiale sui prezzi di Z.ai.
| Modello | Input / 1M | Output / 1M | Input memorizzato nella cache / 1M |
|---|---|---|---|
| GLM-5.3 | $1,40 | $4,40 | $0,26 |
| GLM-5.2 | $1,40 | $4,40 | $0,26 |
| GLM-5.1 | $1,40 | $4,40 | $0,26 |
| GLM-5.3-Flash | $0,15 | $0,50 | $0,03 |
L'aggiornamento da GLM-5.1 a GLM-5.3 è gratuito in termini di prezzo. Se stai ancora chiamando GLM-5.1 per abitudine, stai pagando la tariffa GLM-5.3 per il modello più vecchio, il che è una modifica di una riga nella maggior parte delle codebase e l'aggiornamento più economico in questa pagina.
GLM-5.3-Flash merita un secondo sguardo: a $0,15 di input e $0,50 di output, funziona a circa un decimo della tariffa di punta su entrambi i lati del contatore. Confrontalo con il resto del mercato su AI Perks.
L'input memorizzato nella cache a $0,26 per milione è il numero che la maggior parte dei team ignora, e decide se un lungo prompt di sistema è accessibile da inviare nuovamente ad ogni turno. I prezzi si muovono, quindi rileggi la pagina dei prezzi prima di impegnare un budget per qualsiasi cifra qui.

Dove si posiziona il livello Flash
Il divario tra GLM-5.3 e GLM-5.3-Flash è di circa dieci a uno, il che rende il routing del modello più prezioso del prompt golfing.
Un miliardo di token suona illimitato finché non inizia un ciclo di agente che ritenta. La conseguenza pratica è una decisione di sequenziamento piuttosto che una singola scelta del modello: metti la prototipazione, gli strumenti di valutazione, la classificazione, il routing e altri lavori di background a basso rischio sul livello Flash più economico, e riserva il modello di punta per il traffico che necessita veramente del ragionamento più forte.
Se fatto correttamente, questa divisione riduce la bolletta sul percorso a pagamento e estende una sovvenzione denominata in token su un utilizzo reale molto più ampio di quanto farebbe una distribuzione a modello singolo.
I limiti di velocità sono una delle cose che il programma startup migliora esplicitamente per le aziende approvate, e non siamo riusciti a confermare una tabella di limiti pubblicata per nessun livello al di fuori del programma. Costruisci il percorso di fallback prima di dipendere da uno. AI Perks tiene traccia di quali fornitori pubblicano i loro limiti e quali li lasciano ai biglietti di supporto.
Quanto vale un miliardo di token gratuiti in dollari
Tra $1.400 e $4.400 ai prezzi di listino di GLM-5.3, a seconda di come la sovvenzione si divide tra token di input e output. Z.ai non ha pubblicato questa divisione.
L'aritmetica, utilizzando i prezzi di listino verificati sopra:
- 1 miliardo di token, tutti input: 1.000 x $1,40 = $1.400
- 1 miliardo di token, 70% input e 30% output: $980 + $1.320 = $2.300
- 1 miliardo di token, tutto output: 1.000 x $4,40 = $4.400
Un carico di lavoro realistico di agenti o codifica si colloca vicino al caso intermedio, quindi circa $2.300 di valore equivalente al prezzo di listino è il numero onesto su cui pianificare, non il titolo di un miliardo.
Speso invece su GLM-5.3-Flash, lo stesso miliardo di token vale da $150 a $500, perché il modello è più economico. Ciò inverte l'istinto usuale: con una sovvenzione denominata in token, si estrae il massimo valore eseguendola sul modello più costoso, il che è l'opposto di come si comportano i crediti denominati in dollari. AI Perks è costruito attorno proprio a questi confronti.

Leggi il file di licenza, non la copertura del lancio
GLM-5.2 è completamente open source sotto una semplice licenza MIT. Questo è confermato. Non presumere che gli stessi termini si applichino a ogni versione successiva della linea.
La famiglia GLM è veramente open weight, il che è gran parte del motivo per cui è interessante per una startup: puoi auto-ospitare, affinare e mantenere l'inferenza su un'infrastruttura che controlli, quindi la sovvenzione API diventa una comodità piuttosto che una dipendenza. Ma "i modelli GLM sono MIT" è una generalizzazione, e una generalizzazione non è una licenza.
La copertura di un nuovo rilascio riporta regolarmente la cornice di licenza della versione precedente, perché è la frase più veloce da scrivere e nessuno controlla. Non siamo riusciti a confermare la licenza esatta allegata ai pesi GLM-5.3, quindi questa pagina non ne dichiara nessuna. Apri il file di licenza nel repository dei pesi per il modello specifico e la versione specifica che intendi rilasciare, e fai leggere quel file al tuo legale anziché a un post del blog, incluso questo.
I termini di licenza si muovono tanto quanto i prezzi, motivo per cui AI Perks li ricontrolla piuttosto che archiviare uno snapshot del giorno del lancio.
Cosa Z.ai non ha pubblicato
Tre cose cambiano materialmente il valore di questa offerta, e nessuna di esse è rispondibile dalle pagine pubbliche di Z.ai oggi.
Se la sovvenzione scade. Nessuna finestra di scadenza è pubblicata per la sovvenzione di token per startup. Un miliardo di token senza scadenza e un miliardo di token in 90 giorni sono prodotti molto diversi, e il secondo dovrebbe cambiare il tuo ordine di rollout: dare priorità al traffico costoso invece di salvare la sovvenzione per dopo.
Se la sovvenzione è limitata a specifici modelli. Nulla indica se i token possono essere spesi sul modello di punta attuale o solo su modelli più vecchi, il che fa la differenza tra circa $2.300 e poche centinaia di dollari di valore equivalente. Chiedi prima di pianificare un budget attorno al numero più alto.
Il livello gratuito per i nuovi utenti. Si dice che i nuovi account Z.ai ricevano 5 milioni di token gratuiti più un credito API di 100 yuan. Si tratta di un rapporto di terze parti, non confermato nelle pagine di Z.ai, quindi trattalo come non verificato e non includerlo in una previsione.
Separatamente, e anch'esso riportato piuttosto che confermato, Baseten ha aggiunto GLM-5.3 alle sue API di modelli alla fine di agosto 2026 e una variante più veloce all'inizio di settembre. La tabella dei prezzi di Baseten elenca l'input GLM-5.3 a $1,40 per milione, corrispondente alla tariffa di Z.ai, ma la cifra di output è stata visualizzata in modo incoerente tra le richieste, quindi verificala direttamente sulla pagina dei prezzi di Baseten prima di farvi affidamento. L'offerta standard per i nuovi spazi di lavoro di Baseten è riportata come $30 in crediti di prova, che è un credito di iscrizione generale piuttosto che qualcosa di specifico per GLM.
Una sovvenzione denominata in token ha un'area di superficie non documentata maggiore di una denominata in dollari, poiché i dollari portano la propria definizione e i token no. Poni le domande sulla scadenza e sull'ambito del modello nello stesso messaggio, prima di progettare attorno alla risposta.

Domande Frequenti
Quanti token gratuiti offre il Programma Z.ai Startups?
Fino a 1 miliardo di token gratuiti per l'API GLM per startup approvate, più prezzi all'ingrosso, limiti di velocità prioritari e supporto tecnico. Alle tariffe di listino di GLM-5.3, ciò vale circa $1.400 - $4.400 a seconda del mix di input e output. Le condizioni attuali sono tracciate su getaiperks.com.
Quanto costa l'API GLM-5.3?
$1,40 per milione di token di input, $4,40 per milione di token di output e $0,26 per milione di token di input memorizzati nella cache, secondo la documentazione ufficiale sui prezzi di Z.ai. GLM-5.3-Flash costa molto meno a $0,15 di input e $0,50 di output per milione, circa un decimo della tariffa di punta.
GLM è open source?
GLM-5.2 è completamente open source con una semplice licenza MIT, e GLM-5.1 è stato rilasciato come modello di punta open-source. La licenza è impostata per rilascio, tuttavia, quindi non presumere che MIT si estenda a una versione più recente. Apri il file di licenza nel repository dei pesi per il modello esatto che intendi rilasciare.
Qual è il modello GLM più economico?
Tra i modelli con prezzi confermati, GLM-5.3-Flash è il più economico a $0,15 per milione di token di input e $0,50 per milione di token di output, con input memorizzato nella cache a $0,03. Questo è circa un decimo della tariffa di punta, il che lo rende la scelta predefinita sensata per la prototipazione, le esecuzioni di valutazione e i lavori di background. Confrontalo con altri fornitori su getaiperks.com.
I token startup di Z.ai scadono?
Z.ai non ha pubblicato una finestra di scadenza o una restrizione sui modelli per la sovvenzione di token startup. Entrambe cambierebbero sostanzialmente il valore della sovvenzione, quindi non presumere nulla finché il fornitore non lo dichiara. AI Perks tiene traccia dei termini del programma man mano che i fornitori li confermano.
Come si confronta Z.ai con i crediti di OpenAI e Anthropic?
Z.ai denomina la sua sovvenzione in token anziché in dollari, quindi non si allinea chiaramente con i programmi denominati in dollari su un foglio di calcolo. Convertito ai prezzi di listino di Z.ai, un miliardo di token equivale a circa $2.300 di valore per un carico di lavoro misto. Se possa essere combinato con il programma di un altro fornitore dipende dai termini di tale fornitore, che vale la pena leggere individualmente piuttosto che presumere.
Una sovvenzione denominata in token è più difficile da confrontare di una denominata in dollari, motivo per cui poche persone si preoccupano di richiederla.