Mistral Small 4 Prezzi 2026: Costi Reali e Percorsi Gratuiti

Mistral Small 4 costa $0,15 per milione di token di input e $0,60 per milione di output. Specifiche Apache 2.0, calcoli sul carico di lavoro reale e i modi gratuiti per eseguirlo.

Mistral Small 4Mistral AILLM PricingOpen WeightsAI Perks
Author Avatar
Andrew
AI Perks Team
7,793

Quick Answer

Mistral Small 4 costa $0.15 per milione di token di input e $0.60 per milione di token di output sull'API Mistral. I pesi sono Apache 2.0, quindi l'auto-hosting non comporta costi di licenza. Esistono percorsi gratuiti tramite la prototipazione NVIDIA e il credito API di $10 al mese su Mistral Free. I programmi di credito sono monitorati su getaiperks.com.

Quanto costa Mistral Small 4?

Mistral Small 4 è stato lanciato il 16 marzo 2026 a $0,15 per milione di token di input e $0,60 per milione di token di output sull'API di Mistral. I pesi sono distribuiti sotto licenza Apache 2.0, quindi l'auto-hosting non comporta alcun costo di licenza.

Questa combinazione è l'intero punto. Un modello così economico sull'API è solitamente chiuso, e un modello così aperto di solito non ha un endpoint proprietario degno di nota. Small 4 ha entrambi.

Ecco cosa ha pubblicato Mistral al momento del lancio:

AttributoMistral Small 4
Data di lancio16 marzo 2026
Parametri totali119B
Finestra di contesto256K token
LicenzaApache 2.0
ModalitàMultimodale, tramite la capacità Pixtral integrata nei pesi
Prezzo API, input$0,15 per milione di token
Prezzo API, output$0,60 per milione di token

Ogni dato sopra riportato proviene dal post di lancio di Mistral. AI Perks traccia ciò che gli stessi provider offrono in crediti oltre al prezzo di listino.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Cosa cambia effettivamente la fusione di Magistral, Pixtral e Devstral

Small 4 è il primo modello Mistral a integrare ragionamento, multimodalità e codifica agentiva in un unico set di pesi. Mistral lo descrive come l'unificazione di Magistral per il ragionamento, Pixtral per il multimodale e Devstral per la codifica agentiva.

L'effetto pratico riguarda la vostra architettura, non il vostro foglio di calcolo dei benchmark. Prima di ciò, un team che si occupava di analisi di documenti, generazione di codice e ragionamento utilizzava tre famiglie di modelli, tre set di prompt e tre righe di fatturazione.

Tre cose collassano in una:

Un endpoint per carichi di lavoro misti. La capacità multimodale che prima risiedeva in Pixtral ora si trova negli stessi pesi, quindi il lavoro con media misti non richiede più un secondo modello dietro un secondo endpoint.

Un set di pesi da ospitare. Se effettuate l'auto-hosting, in precedenza scaricavate e servivate checkpoint separati. Ora è uno solo.

Un prezzo da modellare. La previsione dei costi per una pipeline mista non richiede più una miscela ponderata di tre tariffe.

La finestra di contesto da 256K è ciò che rende utilizzabile il consolidamento. Fornire un lungo documento e una codebase nella stessa richiesta è interessante solo se la finestra li contiene entrambi.


Prezzi di Mistral Small 4: Quanto costano i carichi di lavoro reali

A $0,15 di input e $0,60 di output, un carico di lavoro di produzione serio si aggira sulle decine di dollari al mese, non sulle migliaia. L'aritmetica seguente è il prezzo di listino moltiplicato per il volume, niente di più.

Carico di lavoro mensileToken di inputToken di outputCosto al prezzo di listino
Prototipo o progetto secondario5M1M$1,35
Chatbot di supporto50M10M$13,50
Pipeline di analisi di documenti300M15M$54,00
Agente di codifica, un sviluppatore500M100M$135,00
RAG in produzione su larga scala2B200M$420,00

Il moltiplicatore di output è il numero da tenere d'occhio. L'output costa 4 volte l'input, quindi un agente loquace che narra il suo ragionamento costa multipli di uno conciso che svolge lo stesso lavoro identico.

Quel rapporto è anche il motivo per cui il contesto lungo costa meno di quanto sembri. Inserire 200K token di documenti in un prompt costa $0,03. È la risposta che viene fatturata.

I crediti cambiano questa matematica, e i percorsi gratuiti nella sezione successiva coprono i primi milioni di token in modo diretto.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Percorsi gratuiti a Mistral Small 4

Non esiste un piano API gratuito dedicato per Mistral Small 4. Esistono tre percorsi separati, gratuiti o quasi gratuiti, per eseguirlo, e sono adatti a diverse fasi.

PercorsoCosa costaCosa si ottiene
Prototipazione per sviluppatori NVIDIAGratuitoPrototipazione gratuita su computing accelerato NVIDIA, citato nel post di lancio di Mistral
Piano consumatori Mistral Gratuito$0$10 al mese in crediti API
Pesi open-source auto-ospitatiIl proprio computeApache 2.0, nessun costo per token
Programmi di crediti dei providerGratuito da detenereTracciato su AI Perks

Mistral non ha pubblicato le indennità di credito per i piani a pagamento oltre la cifra di $10, quindi qualsiasi tabella di crediti per piano trovata altrove è una ricostruzione di qualcuno piuttosto che un numero del fornitore.

I $10 al mese di credito sul piano consumatori gratuito sono quello sottovalutato. Eseguendolo rispetto al prezzo di listino sopra, acquista circa 66 milioni di token di input se speso esclusivamente per l'input. Assumendo un rapporto lettura/scrittura di 5:1, si avvicina a 44 milioni di token. Entrambi sono calcoli sul tasso pubblicato, non un'indennità di token pubblicata, ma per un sistema di valutazione o uno strumento interno a basso volume è un budget reale piuttosto che un gesto simbolico.

Un avvertimento che vale la pena dichiarare chiaramente: si tratta di crediti per piani consumer, e Mistral non ha pubblicato garanzie su come si comporta l'indennità sotto carico sostenuto. Consideratelo un budget di valutazione, non capacità di produzione.


Apache 2.0: Cosa cambia realmente l'auto-hosting

Apache 2.0 significa che è possibile eseguire, modificare, ottimizzare e distribuire commercialmente Mistral Small 4 senza costi di licenza e senza segnalazione di utilizzo. Non significa che eseguirlo sia gratuito.

La fattura si sposta anziché scomparire. I pesi open-source vengono eseguiti sullo stack di inferenza che già operate, e ognuno di questi stack funziona su hardware per cui qualcuno paga. Mistral non ha pubblicato un modello di costo di distribuzione per Small 4, quindi il confronto qui sotto riguarda il vostro ciclo di lavoro piuttosto che una cifra del fornitore.

Il punto di pareggio è stabilito dal ciclo di lavoro, non dal prezzo di listino:

  • Traffico a raffica o a basso volume favorisce l'API, poiché le GPU inattive vengono fatturate a tariffa piena mentre una chiamata API inattiva non costa nulla.
  • Traffico sostenuto ad alto volume favorisce l'auto-hosting, poiché il prezzo per token scala linearmente mentre una GPU riservata non lo fa.
  • Requisiti di residenza dei dati o air-gap decidono in modo definitivo, e il prezzo non è la variabile.

La parte veramente utile di una release Apache 2.0 non è risparmiare $0,15 per milione di token. È che nessuno può deprecate il modello sotto di voi. Un modello chiuso su cui avete costruito un prodotto può essere ritirato secondo la pianificazione del fornitore. Questo non può.

I crediti di calcolo sono ciò che rende economico l'auto-hosting, e sono una concessione separata dai crediti del modello. AI Perks copre entrambi i livelli.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Cosa Mistral non ha pubblicato

Tre cose su Small 4 e i suoi fratelli sono comunemente dichiarate online con più sicurezza di quanto il fornitore si sia guadagnato. Ecco cosa è effettivamente non confermato.

Crediti per startup. Mistral ha gestito un programma di crediti per startup, storicamente riportato fino a circa $30.000 in crediti La Plateforme. Questa cifra è riportata piuttosto che attualmente confermata: a metà 2026 non esiste una pagina self-service pubblica per il programma, quindi trattate qualsiasi numero specifico che vedete citato come non verificato finché Mistral non ne ripubblica uno. AI Perks traccia quali fornitori di modelli hanno attualmente programmi di crediti attivi.

Mistral OCR 4. Un modello di intelligence documentale datato 23 giugno 2026 è riportato ma non confermato su una pagina di prezzi versionati, quindi leggete il modello e la sua data come riportato piuttosto che definitivo. L'approccio generale di prezzo di Mistral per l'OCR è la fatturazione per 1.000 pagine, e l'esatta tariffa per 1.000 pagine per questa versione non è confermata. Chiunque citi un numero preciso per esso sta indovinando.

Limiti del piano gratuito. Non esiste un piano API gratuito dedicato per Small 4. L'indennità di $10 al mese si trova sul piano gratuito consumer, e Mistral non ha pubblicato limiti di velocità per esso, quindi non esiste un soffitto pubblicato contro cui progettare.

Se una pagina dichiara una cifra che il fornitore non ha mai pubblicato, sarà errata nel momento in cui il fornitore ne pubblicherà una.


Domande frequenti

Quanto costa Mistral Small 4 per milione di token?

Mistral Small 4 costa $0,15 per milione di token di input e $0,60 per milione di token di output sull'API di Mistral. L'output viene fatturato 4 volte l'input, quindi gli agenti prolissi costano considerevolmente di più di quelli concisi per un lavoro identico. L'auto-hosting dei pesi Apache 2.0 non comporta costi per token, solo costi di calcolo.

Esiste un piano gratuito dell'API Mistral AI nel 2026?

Non esiste un piano API gratuito dedicato per Mistral Small 4. Il piano gratuito consumer include $10 al mese in crediti API. Mistral non ha pubblicato limiti di velocità per tale indennità, né ha pubblicato indennità di credito per i suoi piani consumer a pagamento, quindi le citazioni per piano sono non verificate.

Posso eseguire Mistral Small 4 gratuitamente?

Sì, tramite tre percorsi. Il post di lancio di Mistral indirizza gli sviluppatori alla prototipazione gratuita su computing accelerato NVIDIA. Il piano gratuito consumer include $10 al mese in crediti API. E i pesi Apache 2.0 possono essere auto-ospitati sul proprio hardware senza costi di licenza.

Quali modelli ha sostituito Mistral Small 4?

Mistral descrive Small 4 come il primo modello che unifica Magistral per il ragionamento, Pixtral per il multimodale e Devstral per la codifica agentiva in un unico modello. È multimodale grazie alla capacità Pixtral integrata, ha una finestra di contesto di 256K e gestisce 119B parametri totali.

Mistral offre crediti per il programma startup?

Mistral ha gestito un programma di crediti per startup riportato storicamente fino a circa $30.000 in crediti La Plateforme. Questa è una cifra riportata, non una attualmente confermata: non esiste una pagina self-service pubblica per il programma a metà 2026, quindi trattate qualsiasi importo citato come non verificato. AI Perks traccia quali fornitori hanno programmi attivi e quanto valgono attualmente.

L'auto-hosting di Mistral Small 4 è più economico dell'API?

Dipende dal ciclo di lavoro, non dal prezzo di listino. Il traffico a raffica o a basso volume favorisce l'API, poiché le GPU inattive vengono fatturate mentre le chiamate API inattive no. L'alto volume sostenuto favorisce l'auto-hosting. I crediti di calcolo spostano questo punto di pareggio in modo netto, e sono una concessione separata dai crediti del modello.


Iscriviti su AI Perks →

Il token più economico è quello che qualcun altro ha già pagato. Trovali su AI Perks.

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.