Quel est le coût de Mistral Small 4 ?
Mistral Small 4 a été lancé le 16 mars 2026 au prix de 0,15 $ par million de jetons d'entrée et 0,60 $ par million de jetons de sortie sur l'API Mistral. Les poids sont distribués sous licence Apache 2.0, donc l'auto-hébergement n'entraîne aucun frais de licence.
Cette combinaison fait toute la différence. Un modèle aussi bon marché sur l'API est généralement fermé, et un modèle aussi ouvert n'a généralement pas de point de terminaison de premier plan qui vaille la peine d'être utilisé. Small 4 a les deux.
Voici ce que Mistral a publié lors du lancement :
| Attribut | Mistral Small 4 |
|---|---|
| Date de lancement | 16 mars 2026 |
| Paramètres totaux | 119B |
| Fenêtre de contexte | 256K jetons |
| Licence | Apache 2.0 |
| Modalité | Multimodale, via la capacité Pixtral intégrée aux poids |
| Prix API, entrée | 0,15 $ par million de jetons |
| Prix API, sortie | 0,60 $ par million de jetons |
Chaque chiffre ci-dessus provient du propre article de lancement de Mistral. AI Perks suit ce que les mêmes fournisseurs offrent en crédits en plus du prix catalogue.

Ce que la fusion de Magistral, Pixtral et Devstral change réellement
Small 4 est le premier modèle Mistral à intégrer le raisonnement, le multimodal et le codage agentique dans un seul ensemble de poids. Mistral le décrit comme l'unification de Magistral pour le raisonnement, Pixtral pour le multimodal et Devstral pour le codage agentique.
L'effet pratique concerne votre architecture, pas votre feuille de calcul de benchmarks. Avant cela, une équipe effectuant l'analyse de documents, la génération de code et le raisonnement utilisait trois familles de modèles, trois ensembles d'invites et trois lignes de facturation.
Trois choses se transforment en une seule :
Un point de terminaison pour les charges de travail mixtes. La capacité multimodale qui se trouvait auparavant dans Pixtral réside maintenant dans les mêmes poids, de sorte que le travail multimédia mixte ne nécessite plus un second modèle derrière un second point de terminaison.
Un ensemble de poids à héberger. Si vous auto-hébergez, vous téléchargiez et serviez auparavant des points de contrôle distincts. Maintenant, c'est un seul.
Un seul prix à modéliser. La prévision des coûts pour un pipeline mixte n'exige plus un mélange pondéré de trois grilles tarifaires.
La fenêtre de contexte de 256K est ce qui rend la consolidation utilisable. Alimenter un long document et une base de code dans la même requête n'est intéressant que si la fenêtre contient les deux.
Tarification de Mistral Small 4 : le coût des charges de travail réelles
À 0,15 $ en entrée et 0,60 $ en sortie, une charge de travail de production sérieuse se chiffre en dizaines de dollars par mois, pas en milliers. L'arithmétique ci-dessous est le prix catalogue multiplié par le volume, rien de plus.
| Charge de travail mensuelle | Jetons d'entrée | Jetons de sortie | Coût au prix catalogue |
|---|---|---|---|
| Prototype ou projet parallèle | 5M | 1M | 1,35 $ |
| Chatbot de support | 50M | 10M | 13,50 $ |
| Pipeline d'analyse de documents | 300M | 15M | 54,00 $ |
| Agent de codage, un développeur | 500M | 100M | 135,00 $ |
| Production RAG à grande échelle | 2B | 200M | 420,00 $ |
Le multiplicateur de sortie est le chiffre à surveiller. La sortie coûte 4 fois plus cher que l'entrée, donc un agent bavard qui narre son raisonnement coûte plusieurs fois plus cher qu'un agent concis effectuant le même travail.
Ce ratio explique également pourquoi le contexte long coûte moins cher qu'il n'y paraît. Insérer 200K jetons de documents dans une invite coûte 0,03 $. C'est la réponse qui est facturée.
Les crédits modifient ce calcul, et les voies gratuites dans la section suivante couvrent les premiers millions de jetons directement.

Les voies gratuites vers Mistral Small 4
Il n'y a pas de niveau API gratuit dédié pour Mistral Small 4. Il existe trois voies distinctes, gratuites ou quasi gratuites, pour l'exécuter, et elles conviennent à différentes étapes.
| Voie | Coût | Ce que vous obtenez |
|---|---|---|
| Prototypage développeur NVIDIA | Gratuit | Prototypage gratuit sur l'informatique accélérée NVIDIA, mentionné dans l'article de lancement de Mistral |
| Plan gratuit consommateur Mistral | 0 $ | 10 $ par mois en crédits API |
| Poids ouverts auto-hébergés | Votre propre calcul | Apache 2.0, pas de frais par jeton |
| Programmes de crédits fournisseurs | Gratuit à conserver | Suivi sur AI Perks |
Mistral n'a pas publié d'allocations de crédits pour les plans payants au-delà de ce chiffre de 10 $, donc toute table de crédits par niveau que vous trouvez ailleurs est une reconstruction de quelqu'un plutôt qu'un chiffre du fournisseur.
Les 10 $ de crédits par mois sur le plan consommateur gratuit sont sous-estimés. Exécutez-les selon le prix catalogue ci-dessus et cela représente environ 66 millions de jetons d'entrée si vous les dépensez uniquement en entrée. En supposant un ratio lecture/écriture de 5:1, cela tombe à près de 44 millions de jetons. Les deux sont des calculs basés sur le tarif publié, pas une allocation de jetons publiée, mais pour un outil d'évaluation ou un outil interne à faible volume, c'est un véritable budget plutôt qu'un geste symbolique.
Une mise en garde qui mérite d'être clairement énoncée : il s'agit de crédits du plan consommateur, et Mistral n'a pas publié de garanties sur la façon dont l'allocation se comporte sous une charge soutenue. Traitez-la comme un budget d'évaluation, pas comme une capacité de production.
Apache 2.0 : ce que l'auto-hébergement change réellement
Apache 2.0 signifie que vous pouvez exécuter, modifier, affiner et déployer commercialement Mistral Small 4 sans frais de licence ni rapport d'utilisation. Cela ne signifie pas que son exécution est gratuite.
La facture se déplace plutôt que de disparaître. Les poids ouverts s'exécutent sur n'importe quelle pile d'inférence que vous utilisez déjà, et chacune de ces piles s'exécute sur du matériel payé par quelqu'un. Mistral n'a pas publié de modèle de coût de déploiement pour Small 4, donc la comparaison ci-dessous concerne votre propre cycle d'utilisation plutôt qu'un chiffre du fournisseur.
Le seuil de rentabilité est déterminé par le cycle d'utilisation, pas par le prix catalogue :
- Trafic ponctuel ou à faible volume favorise l'API, car les GPU inactifs sont facturés au plein tarif tandis qu'un appel API inactif ne coûte rien.
- Trafic soutenu à volume élevé favorise l'auto-hébergement, car la tarification par jeton évolue linéairement tandis qu'un GPU réservé ne le fait pas.
- Les exigences de résidence des données ou d'air-gap décident directement, et le prix n'est pas la variable.
La partie réellement utile d'une publication sous licence Apache 2.0 n'est pas d'économiser 0,15 $ par million de jetons. C'est que personne ne peut déprécier le modèle sous vous. Un modèle fermé sur lequel vous avez construit un produit peut être retiré selon le calendrier du fournisseur. Celui-ci ne le peut pas.
Les crédits de calcul sont ce qui rend l'auto-hébergement bon marché, et ils constituent une subvention distincte des crédits de modèle. AI Perks couvre les deux couches.

Ce que Mistral n'a pas publié
Trois choses concernant Small 4 et ses frères et sœurs sont couramment affirmées en ligne avec plus de confiance que ce que le fournisseur n'a mérité. Voici ce qui n'est pas encore confirmé.
Crédits de démarrage. Mistral a géré un programme de crédits pour startups, historiquement rapporté jusqu'à environ 30 000 $ en crédits La Plateforme. Ce chiffre est rapporté plutôt que confirmé actuellement : à la mi-2026, il n'y a pas de page libre-service publique pour le programme, alors traitez tout chiffre spécifique que vous voyez cité comme non vérifié jusqu'à ce que Mistral en republie un. AI Perks suit quels fournisseurs de modèles ont actuellement des programmes de crédits actifs.
Mistral OCR 4. Un modèle d'intelligence documentaire daté du 23 juin 2026 est rapporté mais non confirmé sur une page de tarification versionnée, alors lisez le modèle et sa date comme rapportés plutôt que comme définitifs. L'approche générale de tarification de Mistral pour l'OCR est la facturation par 1 000 pages, et le taux exact par 1 000 pages pour cette version n'est pas confirmé. Quiconque cite un chiffre précis pour cela est en train de deviner.
Limites du niveau gratuit. Il n'y a pas de niveau API gratuit dédié pour Small 4. L'allocation de 10 $ par mois se trouve sur le plan gratuit consommateur, et Mistral n'a pas publié de limites de débit pour celle-ci, il n'y a donc pas de plafond publié sur lequel baser sa conception.
Si une page indique un chiffre que le fournisseur n'a jamais publié, il sera erroné au moment où le fournisseur en publiera un.
Questions fréquemment posées
Quel est le coût de Mistral Small 4 par million de jetons ?
Mistral Small 4 coûte 0,15 $ par million de jetons d'entrée et 0,60 $ par million de jetons de sortie sur l'API Mistral. La sortie est facturée 4 fois plus cher que l'entrée, donc les agents verbeux coûtent considérablement plus cher que les agents concis pour le même travail. L'auto-hébergement des poids Apache 2.0 n'entraîne aucun frais par jeton, uniquement des coûts de calcul.
Existe-t-il un niveau gratuit de l'API Mistral AI en 2026 ?
Il n'y a pas de niveau API gratuit dédié pour Mistral Small 4. Le plan gratuit consommateur comprend 10 $ de crédits API par mois. Mistral n'a pas publié de limites de débit pour cette allocation, et n'a pas non plus publié d'allocations de crédits pour ses niveaux consommateurs payants, donc les chiffres cités par niveau ne sont pas vérifiés.
Puis-je exécuter Mistral Small 4 gratuitement ?
Oui, via trois voies. L'article de lancement de Mistral oriente les développeurs vers le prototypage gratuit sur l'informatique accélérée NVIDIA. Le plan gratuit consommateur offre 10 $ de crédits API par mois. Et les poids Apache 2.0 peuvent être auto-hébergés sur votre propre matériel sans frais de licence.
Quels modèles Mistral Small 4 a-t-il remplacés ?
Mistral décrit Small 4 comme le premier modèle unifiant Magistral pour le raisonnement, Pixtral pour le multimodal et Devstral pour le codage agentique en un seul modèle. Il est multimodal grâce à la capacité Pixtral intégrée, dispose d'une fenêtre de contexte de 256K et exécute 119B de paramètres totaux.
Mistral propose-t-il des crédits de programme pour startups ?
Mistral a géré un programme de crédits pour startups rapporté historiquement jusqu'à environ 30 000 $ en crédits La Plateforme. Il s'agit d'un chiffre rapporté, pas d'un chiffre actuellement confirmé : il n'y a pas de page libre-service publique pour le programme à la mi-2026, alors traitez tout montant cité comme non vérifié. AI Perks suit quels fournisseurs ont des programmes actifs et ce qu'ils valent actuellement.
L'auto-hébergement de Mistral Small 4 est-il moins cher que l'API ?
Cela dépend du cycle d'utilisation, pas du prix catalogue. Le trafic ponctuel ou à faible volume favorise l'API, car les GPU inactifs sont facturés alors que les appels API inactifs ne le sont pas. Le volume élevé et soutenu favorise l'auto-hébergement. Les crédits de calcul déplacent ce seuil de rentabilité de manière significative, et ils constituent une subvention distincte des crédits de modèle.
Le jeton le moins cher est celui que quelqu'un d'autre a déjà payé. Trouvez-les sur AI Perks.