Con cosa inizia un nuovo spazio di lavoro Baseten?
È stato segnalato che i nuovi spazi di lavoro Baseten iniziano con un credito di prova di $30, e questo viene presentato come un'offerta permanente anziché una promozione di lancio limitata.
Quella frase contiene una riserva che la maggior parte delle coperture omette. La cifra di $30 proviene dai resoconti sui prezzi di Baseten e dalle pagine del registro delle modifiche anziché da un'offerta principale riproposta in un unico luogo ovvio, e la pagina dei prezzi non è stata visualizzata in modo coerente tra i controlli ripetuti. Quindi: segnalato, non confermato dal fornitore. Controlla il saldo effettivo mostrato dal tuo spazio di lavoro.
A cosa si applica il credito è più chiaro del numero. Si applica alle API di Modello Baseten, lo strato di endpoint condiviso che ospita modelli a peso aperto come Kimi K3, GLM-5.3 e DeepSeek V4.1 Flash, la stessa superficie che un carico di lavoro di produzione chiamerebbe. Il credito acquista un test reale, non una sandbox. AI Perks tiene traccia dei termini attuali insieme a $7,7 milioni in crediti attraverso 194 aziende.

Cosa ha rilasciato Baseten tra luglio e settembre 2026
Baseten ha trascorso il trimestre facendo due cose contemporaneamente: aggiungendo modelli all'avanguardia a peso aperto alle sue API di Modello e costruendo prodotti per i laboratori che creano tali modelli.
| Data | Cosa è stato rilasciato | Per chi è? |
|---|---|---|
| 27 luglio 2026 | API Kimi K3 il giorno del lancio | Sviluppatori |
| 29 luglio 2026 | Baseten per Model Labs | Laboratori di modelli |
| 28 agosto 2026 | GLM-5.3 su API di Modello | Sviluppatori |
| 29 agosto 2026 | Frontier Gateway | Laboratori di modelli |
| 3 settembre 2026 | GLM-5.3-Flash su capacità veloce | Sviluppatori |
| 10 settembre 2026 | DeepSeek V4.1 Flash | Sviluppatori |
| 13 settembre 2026 | Annunciate sei deprecazioni di modelli | Tutti |
Il lancio di Kimi K3 è quello che vale la pena capire. Moonshot AI ha rilasciato un modello mixture-of-experts a peso aperto, segnalato tra 2,8 trilioni e 3 trilioni di parametri con visione nativa e una finestra di contesto da 1 milione di token, e Fireworks AI, Modal e Baseten hanno ciascuno rilasciato un'API ospitata lo stesso giorno. Fireworks e Baseten hanno rilasciato API di addestramento insieme a quelle di inferenza. Una gara a tre vie il giorno del lancio significa che gli stessi pesi provengono da tre fornitori su tre modelli di fatturazione, quindi la scelta del provider è una questione di prezzo, non di capacità.
Prezzi delle API di Modello Baseten: Solo metà della tabella è chiara
Baseten pubblica un prezzo di input per milione di token per ogni API di Modello. Il lato output non è qualcosa che questa pagina può citare con certezza.
| Modello | Input per 1 milione di token | Output per 1 milione di token | Note |
|---|---|---|---|
| Kimi K3 | $3.00 | Non leggibile in modo affidabile | Peso aperto, visione nativa, contesto 1M |
| GLM-5.3 | $1.40 | Non leggibile in modo affidabile | Contesto da 1 milione di token |
| DeepSeek V4.1 Flash | $0.30 | Non leggibile in modo affidabile | 552 miliardi di parametri, multimodale |
| GLM-5.3-Flash | Non confermato | Non confermato | Capacità di servizio veloce dedicata |
Queste tariffe di input sono ciò che la tabella dei prezzi di Baseten elencava al momento del controllo. La colonna di output non è stata visualizzata in modo coerente tra i recuperi, motivo per cui non appare qui alcuna tariffa di output di Baseten.
Per avere un'idea della metà mancante, guarda l'unico provider che pubblica tutto. Fireworks AI elenca Kimi K3 a $3.00 di input, $0.30 di input memorizzato nella cache e $15.00 di output per milione di token nel suo livello Standard. L'output costa cinque volte l'input lì. Qualsiasi modello di costo Baseten costruito solo sulla tariffa di input di $3.00 è sbagliato per un multiplo sconosciuto, e sui carichi di lavoro ad alta generazione quel multiplo costituisce la maggior parte della fattura. Tratta qualsiasi articolo che stampi un prezzo di output di Baseten senza un'avvertenza come una supposizione. AI Perks tiene traccia dei prezzi dei provider man mano che cambiano.

Sei modelli lasciano le API di Modello Baseten il 25 settembre 2026
Baseten ha annunciato il 13 settembre 2026 che GLM-4.7, Kimi K2.7, Kimi K2.6, Inkling, Inkling-Small e DeepSeek V4 Pro verranno ritirati dalle API di Modello il 25 settembre 2026.
Questa è la parte che silenziosamente causa problemi. Tre tipi di lettori sono interessati.
Chiunque abbia uno slug di modello codificato in produzione. Un endpoint compatibile con OpenAI fallisce allo stesso modo, sia che il modello sia stato rinominato o rimosso. Fissa una sostituzione prima del 25, non dopo.
Chiunque mantenga un post di confronto. Ogni listicle che indica DeepSeek V4 Pro o la linea Kimi K2.x su Baseten risulterà errato dal 25 settembre, e la maggior parte non verrà mai aggiornata. Presumi che un riassunto pre-settembre abbia righe vuote.
Chiunque valuti su benchmark obsoleti. Se il tuo sistema di riferimento punta a Kimi K2.7 o K2.6, il successore nel catalogo è Kimi K3 a un punto di prezzo diverso, quindi il confronto del mese scorso non è più valido.
Tratta questi abbinamenti come giudizio editoriale piuttosto che come percorso di migrazione pubblicato dal fornitore: GLM-4.7 a GLM-5.3, la linea Kimi K2.x a Kimi K3, DeepSeek V4 Pro a DeepSeek V4.1 Flash. I prezzi si muovono in entrambe le direzioni attraverso questi salti, che è esattamente quando un credito di prova si dimostra utile. Scopri cosa è attualmente disponibile su AI Perks.
Dove eseguire Kimi K3: Baseten, Fireworks o Modal
Tre provider hanno rilasciato Kimi K3 il giorno del lancio, e solo uno pubblica un prezzo completo per token su cui si può pianificare.
| Provider | Kimi K3 input per 1 milione di token | Prezzi completi dei token pubblicati | Punto di ingresso gratuito |
|---|---|---|---|
| Fireworks AI | $3.00 Standard, $4.50 Fast | Sì | Livello gratuito Fire Pass, con Kimi K3 Fast |
| Baseten | $3.00 | No, l'output non è leggibile | Credito di prova, segnalato a $30, una tantum |
| Modal | Non pubblicato | No | $30 al mese di calcolo generale per nuovi spazi di lavoro |
Fireworks pubblica l'intera immagine: $3.00 di input, $0.30 di input memorizzato nella cache e $15.00 di output per milione sul livello Standard, il livello Fast a $4.50, $0.45 e $22.50, e una variante ospitata negli Stati Uniti a un sovrapprezzo di circa il 10%. Il suo livello gratuito, Fire Pass, è passato a Kimi K3 Fast come modello gratuito in primo piano con la finestra di contesto completa da 1 milione di token, il modo più economico per scoprire se il modello è adatto al tuo compito. Il prezzo di input di Baseten corrisponde a $3.00. Modal ha confermato il prezzo basato sui token nel suo post di lancio senza pubblicare una tariffa per milione.
Le due cifre di $30 sono una coincidenza degna di un'attenta lettura: non sono la stessa offerta. Quella di Modal è un'allocazione di calcolo mensile ricorrente che copre il calcolo in generale piuttosto che un'API di modello. Quella di Baseten è un credito di prova una tantum su uno spazio di lavoro. Su una valutazione di tre mesi, si tratta di $90 contro $30. Entrambi valgono la pena di essere conservati: AI Perks esiste perché i crediti a diversi livelli sono migliori di un unico grande credito presso un singolo fornitore.

Spiegazione di Baseten per Model Labs e Frontier Gateway
Questi due lanci del 2026 sono quelli che la maggior parte degli sviluppatori troverà irrilevanti, e sapere perché fa risparmiare una settimana di valutazione.
Baseten for Model Labs, annunciato il 29 luglio 2026, è una linea di prodotti per laboratori di modelli a peso chiuso che desiderano distribuire e monetizzare i propri modelli tramite l'infrastruttura di Baseten. Inverte la relazione abituale: invece che Baseten ospiti modelli a peso aperto per gli sviluppatori, il laboratorio è il cliente e gli utenti del laboratorio sono il traffico.
Frontier Gateway, annunciato il 29 agosto 2026, è un gateway API gestito e multi-tenant che consente a un laboratorio di creare un'API di inferenza di livello di produzione sullo stack di Baseten anziché costruire da solo uno strato di servizio.
Nessuno dei due ha prezzi pubblicati, entrambi sono rivolti ai laboratori piuttosto che agli sviluppatori, e un credito di prova non si applica a nessuno dei due. Le informazioni su entrambi sono scarse e di media confidenza, quindi tratta qualsiasi elenco di funzionalità dettagliato o benchmark di latenza trovato altrove come non confermato fino a quando il fornitore non lo dichiara. Per uno sviluppatore che chiama modelli, la conseguenza è indiretta: se i laboratori adottano questa strada, più modelli a peso chiuso diventeranno raggiungibili tramite endpoint simili a quelli che già chiami. Vale la pena monitorare su AI Perks.
Come far durare un credito iniziale
Conferma i prezzi di output prima di estrapolare qualsiasi cosa. Le tariffe di input da sole sottovalutano il costo reale sui carichi di lavoro ad alta generazione, e la colonna di output di Baseten è l'unica cifra che questa pagina non può fornirti. Un budget costruito su $3.00 per milione per Kimi K3 è un budget costruito su metà della fattura.
Effettua il debug sui modelli del livello Flash. GLM-5.3-Flash e la linea DeepSeek Flash esistono per latenza e costo piuttosto che per qualità di punta. Il "prompt plumbing", la logica di ripetizione dei tentativi e i bug dello schema non richiedono un modello all'avanguardia per emergere, e la sostituzione dello slug in seguito è una modifica di una sola riga.
Fissa le versioni del tuo modello. Sei modelli verranno ritirati il 25 settembre 2026. Gli slug datati impediscono a una deprecazione di diventare un'interruzione, e un credito di prova è più utile mentre riesamini le sostituzioni.
Conserva crediti a più livelli. Inferenza, calcolo generale e accesso ai modelli all'avanguardia vengono fatturati separatamente. Baseten copre il primo, Modal o un hyperscaler il secondo, un laboratorio all'avanguardia il terzo.

Domande frequenti
Quanto valgono i crediti gratuiti di Baseten?
È stato segnalato che i nuovi spazi di lavoro iniziano con un credito di prova di $30, descritto come un'offerta permanente anziché una promozione. La cifra proviene da segnalazioni piuttosto che da un titolo chiaro del fornitore, quindi considera $30 come segnalato e conferma il saldo mostrato dal tuo spazio di lavoro. I termini attuali sono tracciati su getaiperks.com.
Quanto addebita Baseten per token?
Le tariffe di input sono chiare: Kimi K3 a $3.00 per milione di token, GLM-5.3 a $1.40 e DeepSeek V4.1 Flash a $0.30. Le tariffe di output non sono leggibili in modo affidabile dalla tabella dei prezzi pubblica, e questa pagina non le indovinerà. Conferma i prezzi di output nella console prima di modellare una bolletta mensile.
Quali modelli Baseten sta deprecando a settembre 2026?
GLM-4.7, Kimi K2.7, Kimi K2.6, Inkling, Inkling-Small e DeepSeek V4 Pro verranno ritirati dalle API di Modello Baseten il 25 settembre 2026, come annunciato il 13 settembre. Le sostituzioni più vicine nel catalogo sono GLM-5.3, Kimi K3 e DeepSeek V4.1 Flash, sebbene tale abbinamento sia editoriale piuttosto che un percorso di migrazione pubblicato dal fornitore.
Baseten è più economico di Fireworks per Kimi K3?
Per i token di input, entrambi elencano $3.00 per milione, quindi sono alla pari sull'unica cifra che si confronta in modo pulito. Fireworks pubblica anche $0.30 di input memorizzato nella cache e $15.00 di output per milione nel suo livello Standard. Finché la tariffa di output di Baseten non sarà confermata, un confronto completo dei costi non è possibile in nessuna delle due direzioni.
Cos'è Kimi K3 e perché tre provider lo hanno lanciato contemporaneamente?
Kimi K3 è il modello mixture-of-experts a peso aperto di Moonshot AI, segnalato tra 2,8 trilioni e 3 trilioni di parametri con visione nativa e una finestra di contesto da 1 milione di token, rilasciato il 27 luglio 2026. Fireworks AI, Modal e Baseten hanno ciascuno rilasciato un'API ospitata lo stesso giorno. I pesi aperti rendono ciò possibile: nessun provider ha bisogno di autorizzazione, quindi il giorno del lancio diventa una gara di prezzi invece di un'esclusiva.
Posso combinare i crediti Baseten con altri crediti AI?
Sì, ed è l'approccio normale. Inferenza, calcolo generale e crediti per l'accesso a modelli all'avanguardia sono tre fatture separate con tre fornitori separati, e detenerne uno non ne blocca un altro. Baseten copre lo strato di inferenza, Modal o un hyperscaler copre il calcolo e un laboratorio all'avanguardia copre le chiamate dirette ai modelli. AI Perks traccia $7,7 milioni attraverso 194 aziende su getaiperks.com.
Fissa le versioni del tuo modello. Lascia che qualcun altro paghi per i token.