Mistral Small 4 Preise 2026: Reale Kosten und kostenlose Routen

Mistral Small 4 kostet $0,15 pro Million Eingabetokens und $0,60 pro Million Ausgabetokens. Apache 2.0-Spezifikationen, reale Arbeitslast-Mathematik und kostenlose Möglichkeiten, es auszuführen.

Mistral Small 4Mistral AILLM PricingOpen WeightsAI Perks
Author Avatar
Andrew
AI Perks Team
7,782

Quick Answer

Mistral Small 4 kostet $0,15 pro Million Eingabe-Tokens und $0,60 pro Million Ausgabe-Tokens über die Mistral API. Die Gewichte sind unter Apache 2.0 lizenziert, daher fallen bei Self-Hosting keine Lizenzgebühren an. Kostenlose Routen sind über NVIDIA-Prototyping und das API-Guthaben von 10 USD pro Monat auf Mistral Free verfügbar. Kreditprogramme werden auf getaiperks.com verfolgt.

Was kostet Mistral Small 4?

Mistral Small 4 wurde am 16. März 2026 zu einem Preis von 0,15 $ pro Million Input-Tokens und 0,60 $ pro Million Output-Tokens über die Mistral API eingeführt. Die Gewichte werden unter Apache 2.0 vertrieben, sodass das Self-Hosting keinerlei Lizenzgebühren verursacht.

Diese Kombination ist die ganze Geschichte. Ein so günstiges Modell über die API ist normalerweise proprietär, und ein so offenes Modell hat normalerweise keinen First-Party-Endpunkt, der die Nutzung wert wäre. Small 4 bietet beides.

Hier ist, was Mistral bei der Einführung veröffentlicht hat:

AttributMistral Small 4
Startdatum16. März 2026
Gesamtparameter119B
Kontextfenster256K Tokens
LizenzApache 2.0
ModalitätMultimodal, über die Pixtral-Fähigkeit, die in die Gewichte integriert ist
API-Preis, Input0,15 $ pro Million Tokens
API-Preis, Output0,60 $ pro Million Tokens

Jede der oben genannten Zahlen stammt aus dem ursprünglichen Veröffentlichungsbeitrag von Mistral. AI Perks verfolgt, was dieselben Anbieter zusätzlich zum Listenpreis als Gutschriften verschenken.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Was das Zusammenführen von Magistral, Pixtral und Devstral tatsächlich verändert

Small 4 ist das erste Mistral-Modell, das Reasoning, Multimodalität und agentengesteuerte Codierung in einem Satz von Gewichten vereint. Mistral beschreibt es als die Vereinigung von Magistral für Reasoning, Pixtral für Multimodalität und Devstral für agentengesteuerte Codierung.

Der praktische Effekt liegt auf Ihrer Architektur, nicht auf Ihrer Benchmark-Tabelle. Zuvor verwendete ein Team, das Dokumentenanalyse, Codeerstellung und Reasoning durchführte, drei Modellfamilien, drei Prompt-Sets und drei Abrechnungszeilen.

Drei Dinge werden auf eins reduziert:

Ein Endpunkt für gemischte Workloads. Die multimodale Fähigkeit, die früher in Pixtral angesiedelt war, befindet sich jetzt in denselben Gewichten, sodass für gemischte Medienarbeiten kein zweites Modell hinter einem zweiten Endpunkt mehr erforderlich ist.

Ein Satz von Gewichten zum Hosten. Wenn Sie selbst hosten, mussten Sie zuvor separate Checkpoints herunterladen und bereitstellen. Jetzt ist es eins.

Ein Preis für die Modellierung. Die Kostenschätzung für eine gemischte Pipeline erfordert keine gewichtete Mischung aus drei Tarifkarten mehr.

Das 256K-Kontextfenster macht die Konsolidierung nutzbar. Das Einspeisen eines langen Dokuments und einer Codebasis in dieselbe Anfrage ist nur dann interessant, wenn das Fenster beides aufnehmen kann.


Mistral Small 4 Preisgestaltung: Was reale Workloads kosten

Bei 0,15 $ Input und 0,60 $ Output landet ein ernsthafter Produktionsworkload bei einigen zehn Dollar pro Monat, nicht bei tausenden. Die untenstehende Berechnung ist der Listenpreis multipliziert mit dem Volumen, nichts weiter.

Monatlicher WorkloadInput-TokensOutput-TokensKosten zum Listenpreis
Prototyp oder Nebenprojekt5 Mio.1 Mio.1,35 $
Support-Chatbot50 Mio.10 Mio.13,50 $
Dokumentenanalyse-Pipeline300 Mio.15 Mio.54,00 $
Coding-Agent, ein Entwickler500 Mio.100 Mio.135,00 $
Produktives RAG im großen Stil2 Mrd.200 Mio.420,00 $

Der Output-Multiplikator ist die Zahl, auf die Sie achten müssen. Output kostet 4x so viel wie Input, daher kostet ein gesprächiger Agent, der sein Reasoning erklärt, ein Vielfaches eines knappen Agenten, der identische Arbeit leistet.

Dieses Verhältnis ist auch der Grund, warum langer Kontext billiger ist, als er klingt. Das Einfügen von 200.000 Token an Dokumenten in einen Prompt kostet 0,03 $. Die Antwort verursacht die Kosten.

Gutschriften ändern diese Rechnung, und die kostenlosen Routen im nächsten Abschnitt decken die ersten paar Millionen Token vollständig ab.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Die kostenlosen Routen zu Mistral Small 4

Es gibt keine dedizierte kostenlose API-Stufe für Mistral Small 4. Es gibt drei separate kostenlose oder nahezu kostenlose Routen, um es auszuführen, und sie eignen sich für verschiedene Phasen.

RouteWas es kostetWas Sie bekommen
NVIDIA Developer PrototypingKostenlosKostenloses Prototyping auf NVIDIA beschleunigter Computer-Hardware, wie in Mistrals Veröffentlichungsbeitrag erwähnt
Mistral Kostenloser Consumer-Plan0 $10 $ API-Guthaben pro Monat
Self-hosted Open WeightsIhre eigene RechenleistungApache 2.0, keine Gebühr pro Token
Anbieter-GutschriftprogrammeKostenlos zu haltenVerfolgt bei AI Perks

Mistral hat keine bezahlten Plan-Gutschriftkontingente über die 10-Dollar-Marke hinaus veröffentlicht, daher ist jede Gutschrifttabelle, die Sie anderswo finden, eine Rekonstruktion von jemandem und kein Anbieterwert.

Die 10 $ pro Monat Gutschrift auf dem kostenlosen Consumer-Plan ist der unterschätzte. Wenn Sie diese auf den obigen Listenpreis anwenden, kauft sie ungefähr 66 Millionen Input-Tokens, wenn Sie sie rein für Input ausgeben. Bei einem Verhältnis von 5:1 Lese zu Schreib landen Sie näher bei 44 Millionen Tokens. Beides sind Berechnungen auf Basis des veröffentlichten Preises, nicht ein veröffentlichtes Token-Kontingent, aber für ein Evaluierungs-Framework oder ein internes Tool mit geringem Volumen ist es ein reales Budget und keine reine Geste.

Eine Anmerkung, die klar erwähnt werden sollte: Dies sind Gutschriften für den Consumer-Plan, und Mistral hat keine Garantien darüber veröffentlicht, wie sich das Kontingent bei anhaltender Auslastung verhält. Betrachten Sie es als Evaluierungsbudget, nicht als Produktionskapazität.


Apache 2.0: Was Self-Hosting tatsächlich verändert

Apache 2.0 bedeutet, dass Sie Mistral Small 4 ausführen, modifizieren, feinabstimmen und kommerziell einsetzen können, ohne Lizenzgebühren oder Nutzungsberichte. Es bedeutet nicht, dass die Ausführung kostenlos ist.

Die Rechnung verschiebt sich, anstatt zu verschwinden. Open Weights laufen auf jedem beliebigen Inferenz-Stack, den Sie bereits betreiben, und jeder dieser Stacks läuft auf Hardware, für die jemand bezahlt. Mistral hat kein Kostenmodell für die Bereitstellung von Small 4 veröffentlicht, daher bezieht sich der Vergleich unten auf Ihren eigenen Duty Cycle und nicht auf einen Anbieterwert.

Der Break-Even wird durch den Duty Cycle bestimmt, nicht durch den Listenpreis:

  • Bursty oder geringes Volumen begünstigt die API, da ungenutzte GPUs voll berechnet werden, während ein ungenutzter API-Aufruf nichts kostet.
  • Anhaltend hohes Volumen begünstigt Self-Hosting, da die pro-Token-Preise linear skalieren, während eine reservierte GPU dies nicht tut.
  • Datenresidenz oder Air-Gap-Anforderungen entscheiden dies eindeutig, und der Preis ist nicht die Variable.

Der wirklich nützliche Teil einer Apache 2.0-Veröffentlichung ist nicht das Sparen von 0,15 $ pro Million Tokens. Es ist die Tatsache, dass niemand das Modell unter Ihnen abwerten kann. Ein geschlossenes Modell, auf dem Sie ein Produkt aufgebaut haben, kann nach dem Zeitplan des Anbieters eingestellt werden. Dieses nicht.

Compute-Gutschriften machen Self-Hosting billig und sind eine separate Zuteilung von Modell-Gutschriften. AI Perks deckt beide Ebenen ab.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Was Mistral nicht veröffentlicht hat

Drei Dinge über Small 4 und seine Geschwister werden online häufiger mit mehr Zuversicht genannt, als der Anbieter verdient hat. Hier ist, was tatsächlich unbestätigt ist.

Startup-Gutschriften. Mistral hat ein Startup-Gutschriften-Programm betrieben, das historisch mit bis zu rund 30.000 $ an La Plateforme-Gutschriften angegeben wurde. Diese Zahl ist berichtet und nicht aktuell bestätigt: Mitte 2026 gibt es keine öffentliche Self-Service-Seite für das Programm, daher sollten Sie jede spezifische Zahl, die Sie zitieren, als unbestätigt betrachten, bis Mistral eine neu veröffentlicht. AI Perks verfolgt, welche Modell-Anbieter derzeit Live-Gutschriftprogramme haben.

Mistral OCR 4. Ein Dokumenten-Intelligenz-Modell vom 23. Juni 2026 wird berichtet, aber nicht auf einer preisgestuften Seite bestätigt, daher lesen Sie das Modell und sein Datum als berichtet und nicht als endgültig. Mistrals allgemeiner Preisansatz für OCR ist die Abrechnung pro 1.000 Seiten, und der genaue Preis pro 1.000 Seiten für diese Version ist nicht bestätigt. Jeder, der eine genaue Zahl dafür angibt, rät.

Limits der kostenlosen Stufe. Es gibt keine dedizierte kostenlose API-Stufe für Small 4. Das Kontingent von 10 $ pro Monat befindet sich auf dem kostenlosen Consumer-Plan, und Mistral hat keine Ratenlimits dafür veröffentlicht, daher gibt es keine veröffentlichte Obergrenze, gegen die man entwerfen könnte.

Wenn eine Seite eine Zahl angibt, die der Anbieter nie veröffentlicht hat, wird sie in dem Moment falsch sein, in dem der Anbieter eine veröffentlicht.


Häufig gestellte Fragen

Wie viel kostet Mistral Small 4 pro Million Tokens?

Mistral Small 4 kostet 0,15 $ pro Million Input-Tokens und 0,60 $ pro Million Output-Tokens auf der Mistral API. Output wird mit dem 4-fachen von Input berechnet, daher kosten gesprächige Agenten erheblich mehr als knappe für identische Arbeit. Das Self-Hosting der Apache 2.0-Gewichte verursacht keine Gebühr pro Token, nur Rechenkosten.

Gibt es 2026 eine kostenlose API-Stufe von Mistral AI?

Es gibt keine dedizierte kostenlose API-Stufe für Mistral Small 4. Der kostenlose Consumer-Plan beinhaltet 10 $ API-Guthaben pro Monat. Mistral hat für dieses Kontingent keine Ratenlimits veröffentlicht und auch keine Gutschriften für seine bezahlten Consumer-Stufen, daher sind zitierte pro-Stufe-Zahlen unbestätigt.

Kann ich Mistral Small 4 kostenlos ausführen?

Ja, über drei Routen. Mistrals Veröffentlichungsbeitrag verweist Entwickler auf kostenloses Prototyping auf NVIDIA beschleunigter Computer-Hardware. Der kostenlose Consumer-Plan beinhaltet 10 $ API-Guthaben pro Monat. Und die Apache 2.0-Gewichte können auf Ihrer eigenen Hardware ohne Lizenzkosten selbst gehostet werden.

Welche Modelle hat Mistral Small 4 ersetzt?

Mistral beschreibt Small 4 als das erste Modell, das Magistral für Reasoning, Pixtral für Multimodalität und Devstral für agentengesteuerte Codierung in einem Modell vereint. Es ist multimodal durch die integrierte Pixtral-Fähigkeit, verfügt über ein 256K-Kontextfenster und läuft mit insgesamt 119B Parametern.

Bietet Mistral Startup-Programm-Gutschriften an?

Mistral hat ein Startup-Gutschriften-Programm betrieben, das historisch mit bis zu rund 30.000 $ an La Plateforme-Gutschriften angegeben wurde. Dies ist eine gemeldete Zahl, keine aktuell bestätigte: Es gibt Mitte 2026 keine öffentliche Self-Service-Seite für das Programm, daher sollten Sie jeden zitierten Betrag als unbestätigt betrachten. AI Perks verfolgt, welche Anbieter Live-Programme haben und wie viel sie derzeit wert sind.

Ist das Self-Hosting von Mistral Small 4 günstiger als die API?

Das hängt vom Duty Cycle ab, nicht vom Listenpreis. Bursty oder geringes Volumen begünstigt die API, da ungenutzte GPUs berechnet werden, während ungenutzte API-Aufrufe nichts kosten. Anhaltend hohes Volumen begünstigt Self-Hosting. Compute-Gutschriften verschieben diesen Break-Even stark, und sie sind eine separate Zuteilung von Modell-Gutschriften.


Abonnieren Sie bei AI Perks →

Das günstigste Token ist das, für das jemand anderes bereits bezahlt hat. Finden Sie sie unter AI Perks.

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.