Mistral Small 4 料金 2026:実際のコストと無料ルート

Mistral Small 4 は、入力トークン100万件あたり$0.15、出力トークン100万件あたり$0.60です。Apache 2.0 の仕様、実際のワークロードでの計算、および実行するための無料の方法。

Mistral Small 4Mistral AILLM PricingOpen WeightsAI Perks
Author Avatar
Andrew
AI Perks Team
6,262

Quick Answer

Mistral Small 4は、Mistral APIで100万入力トークンあたり$0.15、100万出力トークンあたり$0.60です。重みはApache 2.0ライセンスのため、セルフホスティングにはライセンス料はかかりません。NVIDIAのプロトタイピングやMistral Freeの月額$10のAPIクレジットを通じて無料のルートが存在します。クレジットプログラムはgetaiperks.comで確認できます。

Mistral Small 4 の価格は?

Mistral Small 4 は 2026年3月16日に、Mistral API で入力トークン 100万件あたり $0.15、出力トークン 100万件あたり $0.60 でローンチされました。重みは Apache 2.0 の下で提供されるため、セルフホスティングにはライセンス料は一切かかりません。

この組み合わせこそが全てです。API でこれほど安価なモデルは通常クローズドであり、これほどオープンなモデルは通常、使用する価値のあるファーストパーティのエンドポイントがありません。Small 4 はその両方を備えています。

Mistral がローンチ時に公開した情報は以下の通りです。

属性Mistral Small 4
ローンチ日2026年3月16日
総パラメータ数119B
コンテキストウィンドウ256K トークン
ライセンスApache 2.0
モダリティPixtral の機能を重みに組み込んだマルチモーダル
API 価格(入力)トークン 100万件あたり $0.15
API 価格(出力)トークン 100万件あたり $0.60

上記のすべての数値は Mistral 自身のローンチ投稿によるものです。AI Perks は、同じプロバイダーがリスト価格に加えてどのようなクレジットを提供しているかを追跡しています。


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Magistral, Pixtral, Devstral の統合が実際に変えること

Small 4 は、推論、マルチモーダル、エージェントコーディングを1つの重みセットに統合した初の Mistral モデルです。Mistral はこれを、推論のための Magistral、マルチモーダルのための Pixtral、エージェントコーディングのための Devstral の統合と説明しています。

実質的な効果は、ベンチマークのスプレッドシートではなく、アーキテクチャにあります。これ以前は、ドキュメント解析、コード生成、推論を行うチームは、3つのモデルファミリー、3つのプロンプトセット、3つの請求項目を扱っていました。

3つのことが1つに集約されます。

混合ワークロードに対応する単一のエンドポイント。 かつて Pixtral にあったマルチモーダル機能が同じ重みに搭載されたため、混合メディアの作業では、セカンドエンドポイントの背後にあるセカンドモデルが不要になりました。

ホストする単一の重みセット。 セルフホスティングする場合、以前は個別のチェックポイントをプルして提供していました。今ではそれが1つになりました。

モデル化する単一の価格。 混合パイプライン全体のコスト予測は、3つのレートカードの加重平均を必要としなくなりました。

256K のコンテキストウィンドウは、この統合を実用的なものにしています。長いドキュメントとコードベースを同じリクエストにフィードすることは、ウィンドウが両方を保持できる場合にのみ意味があります。


Mistral Small 4 の価格設定:実際のワークロードのコスト

入力 $0.15、出力 $0.60 で、本格的な本番ワークロードのコストは、数千ドルではなく、月あたり数十ドルになります。以下の計算は、リスト価格にボリュームを乗じたもので、それ以上の gì もありません。

月間ワークロード入力トークン出力トークンリスト価格でのコスト
プロトタイプまたはサイドプロジェクト5M1M$1.35
サポートチャットボット50M10M$13.50
ドキュメント解析パイプライン300M15M$54.00
コーディングエージェント(開発者1名)500M100M$135.00
本番 RAG (大規模)2B200M$420.00

出力の倍率が注目すべき数字です。出力は入力の 4 倍のコストがかかるため、同じ作業を行っても、理由を逐一説明するチャット型エージェントは、簡潔なエージェントの倍以上のコストがかかります。

この比率が、ロングコンテキストが思っているほど高価ではない理由でもあります。200K トークンのドキュメントをプロンプトに詰め込むコストは $0.03 です。課金されるのは応答です。

クレジットはこの計算を変えます。次のセクションの無料ルートは、最初の数百万トークンを直接カバーします。


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Mistral Small 4 への無料アクセスルート

Mistral Small 4 専用の無料 API ティアはありません。実行するための 3 つの個別の無料またはほぼ無料のルートがあり、それぞれ異なる段階に適しています。

ルートコスト内容
NVIDIA Developer Prototyping無料NVIDIA アクセラレーテッドコンピューティングでの無料プロトタイピング(Mistral のローンチ投稿で言及)
Mistral Free Consumer Plan$0月額 $10 の API クレジット
セルフホスト型オープンウェイトお客様のコンピューティングリソースApache 2.0、トークンあたりの料金なし
プロバイダー クレジットプログラム保有は無料AI Perks で追跡

Mistral は、この $10 という金額を超える有料プランのクレジット枠を公開していないため、他で見つかるティアごとのクレジット表は、ベンダーの数値ではなく、誰かの再構築によるものです。

無料コンシューマープランの月額 $10 クレジットは、見過ごされがちです。上記のリスト価格で計算すると、入力にのみ使用した場合、約 6600 万入力トークン分になります。読み込みと書き込みの比率を 5:1 と仮定すると、約 4400 万トークンになります。どちらも公開レートに基づく計算であり、公開されたトークン枠ではありませんが、評価ハーネスや低ボリュームの内部ツールとしては、トークンのおまけではなく、実際の予算となります。

はっきりと述べておくべき注意点があります。これらはコンシューマープランのクレジットであり、Mistral はこの枠が持続的な負荷の下でどのように動作するかについて保証を公開していません。これを本番容量ではなく、評価予算として扱ってください。


Apache 2.0:セルフホスティングが実際に変えること

Apache 2.0 は、Mistral Small 4 をライセンス料や使用状況の報告なしに、実行、変更、ファインチューニング、商用展開できることを意味します。実行が無料になるわけではありません。

請求書は消えるのではなく、移動します。オープンウェイトは、既存の推論スタックで実行され、これらのスタックはすべて誰かが費用を負担するハードウェアで実行されます。Mistral は Small 4 のデプロイメントコストモデルを公開していないため、以下の比較はベンダーの数値ではなく、お客様自身の稼働サイクルに関するものです。

損益分岐点は、リスト価格ではなく、稼働サイクルによって設定されます。

  • バーストまたは低ボリュームのトラフィックは API に有利です。アイドル状態の GPU はフルレートで請求されますが、アイドル状態の API コールは請求されません。
  • 持続的な高ボリュームのトラフィックはセルフホスティングに有利です。トークンあたりの価格設定は線形にスケールしますが、予約された GPU はそうではありません。
  • データレジデンシーまたはエアギャップの要件は、これを直接決定し、価格は変数ではありません。

Apache 2.0 リリースで真に有用なのは、100万トークンあたり $0.15 を節約することではありません。それは、誰かがあなたのモデルを廃止できないことです。製品を構築したクローズドモデルは、ベンダーのスケジュールで廃止される可能性があります。このモデルはそうではありません。

コンピューティングクレジットはセルフホスティングを安価にし、モデルクレジットとは別の付与です。AI Perks は両方のレイヤーをカバーしています。


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Mistral が公開していないこと

Small 4 とその兄弟モデルに関する3つの事柄は、ベンダーが獲得した以上の自信を持ってオンラインで一般的に述べられています。ここに、実際に確認されていないことがあります。

スタートアップ クレジット。 Mistral はスタートアップ クレジット プログラムを実施しており、歴史的には La Plateforme クレジットで最大約 $30,000 と報告されています。この金額は報告されたものであり、現在確認されているものではありません。2026年半ば現在、プログラムのセルフサービスページは公開されていないため、引用されている具体的な数値は、Mistral が再公開するまで未検証として扱ってください。AI Perks は、現在どのモデルプロバイダーがクレジット プログラムを実施しているかを追跡しています。

Mistral OCR 4。 2026年6月23日付のドキュメントインテリジェンス モデルが報告されていますが、バージョン管理された価格設定ページでは確認されていません。そのため、モデルとその日付は確定事項としてではなく、報告されたものとして読んでください。Mistral の OCR に対する一般的な価格設定アプローチは、1,000 ページあたりの課金であり、このバージョンの正確な 1,000 ページあたりの料金は確認されていません。正確な数値を引用している人は推測しています。

無料ティアの制限。 Small 4 専用の無料 API ティアはありません。月額 $10 の枠は、コンシューマー Free プランにあり、Mistral はそれに対するレート制限を公開していないため、設計の対象となる公開された上限はありません。

ベンダーが公開したことのない数値を記載したページは、ベンダーが公開した瞬間に間違ったものになります。


よくある質問

Mistral Small 4 のトークン 100万件あたりの価格は?

Mistral Small 4 は、Mistral API で入力トークン 100万件あたり $0.15、出力トークン 100万件あたり $0.60 です。出力は入力の 4 倍で課金されるため、冗長なエージェントは、同じ作業を行う簡潔なエージェントよりも大幅にコストがかかります。Apache 2.0 重みをセルフホスティングする場合、トークンあたりの料金はかからず、コンピューティングコストのみがかかります。

2026 年に Mistral AI API の無料ティアはありますか?

Mistral Small 4 専用の無料 API ティアはありません。コンシューマー Free プランには、月額 $10 の API クレジットが含まれています。Mistral はその枠のレート制限を公開しておらず、有料コンシューマーティアのクレジット枠も公開していないため、ティアごとの引用数値は未検証です。

Mistral Small 4 を無料で実行できますか?

はい、3つのルートがあります。Mistral のローンチ投稿では、NVIDIA アクセラレーテッドコンピューティングでの無料プロトタイピングに開発者を紹介しています。コンシューマー Free プランには、月額 $10 の API クレジットが付いています。そして Apache 2.0 重みは、お客様のハードウェアでライセンス料なしでセルフホスティングできます。

Mistral Small 4 はどのモデルに取って代わりましたか?

Mistral は Small 4 を、推論のための Magistral、マルチモーダルのための Pixtral、エージェントコーディングのための Devstral を単一のモデルに統合した最初のモデルと説明しています。組み込まれた Pixtral 機能を通じてマルチモーダルであり、256K のコンテキストウィンドウを持ち、合計 119B のパラメータを実行します。

Mistral はスタートアップ プログラムのクレジットを提供していますか?

Mistral はスタートアップ クレジット プログラムを実施しており、歴史的には La Plateforme クレジットで最大約 $30,000 と報告されています。これは報告された数値であり、現在確認されているものではありません。2026年半ば現在、プログラムのセルフサービスページは公開されていないため、引用されている金額は未検証として扱ってください。AI Perks は、現在どのプロバイダーがプログラムを実施しているか、およびその現在の価値を追跡しています。

Mistral Small 4 をセルフホスティングするのは API よりも安価ですか?

リスト価格ではなく、稼働サイクルによります。バーストまたは低ボリュームのトラフィックは API に有利です。アイドル状態の GPU は課金されますが、アイドル状態の API コールは課金されないためです。持続的な高ボリュームはセルフホスティングに有利です。コンピューティングクレジットは、その損益分岐点を大きくシフトさせ、モデルクレジットとは別の付与です。


AI Perks で購読 →

最も安価なトークンは、誰かがすでに支払ったものです。AI Perks で見つけてください。

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.