Berapa Biaya Mistral Small 4?
Mistral Small 4 diluncurkan pada 16 Maret 2026 dengan harga $0,15 per juta token input dan $0,60 per juta token output di API Mistral. Bobotnya didistribusikan di bawah Apache 2.0, sehingga hosting mandiri tidak dikenakan biaya lisensi sama sekali.
Kombinasi itulah keseluruhan ceritanya. Model yang sangat murah di API biasanya tertutup, dan model yang sangat terbuka biasanya tidak memiliki endpoint pihak pertama yang layak digunakan. Small 4 memiliki keduanya.
Berikut adalah apa yang diterbitkan Mistral saat peluncuran:
| Atribut | Mistral Small 4 |
|---|---|
| Tanggal peluncuran | 16 Maret 2026 |
| Total parameter | 119B |
| Jendela konteks | 256K token |
| Lisensi | Apache 2.0 |
| Modalitas | Multimodal, melalui kemampuan Pixtral yang dilipat ke dalam bobot |
| Harga API, input | $0,15 per juta token |
| Harga API, output | $0,60 per juta token |
Setiap angka di atas berasal dari postingan peluncuran Mistral sendiri. AI Perks melacak apa yang diberikan oleh penyedia yang sama dalam bentuk kredit di atas harga daftar.

Apa Perubahan Nyata dari Penggabungan Magistral, Pixtral, dan Devstral
Small 4 adalah model Mistral pertama yang menggabungkan penalaran, multimodal, dan pengkodean agenik ke dalam satu set bobot. Mistral menggambarkannya sebagai penyatuan Magistral untuk penalaran, Pixtral untuk multimodal, dan Devstral untuk pengkodean agenik.
Efek praktisnya adalah pada arsitektur Anda, bukan pada spreadsheet benchmark Anda. Sebelum ini, tim yang melakukan penguraian dokumen ditambah pembuatan kode ditambah penalaran menjalankan tiga keluarga model, tiga set prompt, dan tiga baris penagihan.
Tiga hal menyatu menjadi satu:
Satu endpoint untuk beban kerja campuran. Kemampuan multimodal yang sebelumnya ada di Pixtral kini berada dalam bobot yang sama, sehingga pekerjaan media campuran tidak lagi memerlukan model kedua di belakang endpoint kedua.
Satu set bobot untuk di-host. Jika Anda melakukan hosting mandiri, sebelumnya Anda menarik dan melayani checkpoint terpisah. Sekarang hanya satu.
Satu harga untuk model. Peramalan biaya di seluruh pipeline campuran berhenti memerlukan campuran tertimbang dari tiga kartu tarif.
Jendela konteks 256K adalah yang membuat konsolidasi dapat digunakan. Memberi makan dokumen panjang dan basis kode ke dalam permintaan yang sama hanya menarik jika jendela dapat menampung keduanya.
Harga Mistral Small 4: Berapa Biaya Beban Kerja Nyata
Dengan input $0,15 dan output $0,60, beban kerja produksi yang serius akan memakan biaya puluhan dolar per bulan, bukan ribuan. Aritmatika di bawah ini adalah harga daftar dikalikan volume, tidak lebih.
| Beban kerja bulanan | Token input | Token output | Biaya pada harga daftar |
|---|---|---|---|
| Prototipe atau proyek sampingan | 5 juta | 1 juta | $1,35 |
| Chatbot dukungan | 50 juta | 10 juta | $13,50 |
| Pipeline penguraian dokumen | 300 juta | 15 juta | $54,00 |
| Agen pengkodean, satu pengembang | 500 juta | 100 juta | $135,00 |
| Produksi RAG dalam skala besar | 2 miliar | 200 juta | $420,00 |
Pengganda output adalah angka yang perlu diperhatikan. Output berharga 4x input, sehingga agen yang cerewet yang menjelaskan penalarannya akan berharga berkali-kali lipat dari agen yang ringkas yang melakukan pekerjaan yang sama.
Rasio itu juga sebabnya konteks panjang lebih murah daripada kedengarannya. Memasukkan 200 ribu token dokumen ke dalam prompt berharga $0,03. Responslah yang ditagih.
Kredit mengubah matematika ini, dan rute gratis di bagian berikutnya mencakup beberapa juta token pertama secara langsung.

Rute Gratis ke Mistral Small 4
Tidak ada tingkatan API gratis khusus untuk Mistral Small 4. Ada tiga rute terpisah yang gratis atau mendekati gratis untuk menjalankannya, dan semuanya cocok untuk tahap yang berbeda.
| Rute | Berapa biayanya | Apa yang Anda dapatkan |
|---|---|---|
| Prototyping pengembang NVIDIA | Gratis | Prototyping gratis pada komputasi akselerasi NVIDIA, disebutkan dalam postingan peluncuran Mistral |
| Paket konsumen gratis Mistral | $0 | Kredit API $10 per bulan |
| Bobot terbuka yang di-host mandiri | Komputasi Anda sendiri | Apache 2.0, tanpa biaya per token |
| Program kredit penyedia | Gratis untuk disimpan | Dilacak di AI Perks |
Mistral belum menerbitkan tunjangan kredit paket berbayar di luar angka $10 tersebut, jadi tabel per tingkatan kredit apa pun yang Anda temukan di tempat lain adalah rekonstruksi seseorang, bukan angka vendor.
Kredit $10 per bulan pada paket konsumen gratis adalah yang diremehkan. Jalankan melalui harga daftar di atas dan itu membeli sekitar 66 juta token input jika Anda menghabiskannya murni untuk input. Asumsikan rasio baca terhadap tulis 5:1 dan itu mendarat lebih dekat ke 44 juta token. Keduanya adalah aritmatika pada tarif yang dipublikasikan, bukan tunjangan token yang dipublikasikan, tetapi untuk harness evaluasi atau alat internal bervolume rendah, itu adalah anggaran nyata daripada sekadar token.
Satu peringatan yang patut dinyatakan dengan jelas: ini adalah kredit paket konsumen, dan Mistral belum menerbitkan jaminan tentang bagaimana tunjangan tersebut berperilaku di bawah beban berkelanjutan. Anggaplah sebagai anggaran evaluasi, bukan kapasitas produksi.
Apache 2.0: Apa yang Sebenarnya Berubah dengan Hosting Mandiri
Apache 2.0 berarti Anda dapat menjalankan, memodifikasi, menyempurnakan, dan menyebarkan Mistral Small 4 secara komersial tanpa biaya lisensi dan tanpa pelaporan penggunaan. Itu tidak berarti menjalankannya gratis.
Tagihan berpindah tempat, bukan menghilang. Bobot terbuka berjalan pada tumpukan inferensi apa pun yang sudah Anda operasikan, dan setiap tumpukan itu berjalan pada perangkat keras yang dibayar oleh seseorang. Mistral belum menerbitkan model biaya penyebaran untuk Small 4, jadi perbandingan di bawah ini adalah tentang siklus tugas Anda sendiri, bukan angka vendor.
Titik impas ditentukan oleh siklus tugas, bukan oleh harga daftar:
- Lalu lintas yang berfluktuasi atau bervolume rendah lebih menyukai API, karena GPU yang menganggur ditagih dengan tarif penuh sementara panggilan API yang menganggur tidak ditagih.
- Lalu lintas bervolume tinggi yang berkelanjutan lebih menyukai hosting mandiri, karena penetapan harga per token diskalakan secara linier sementara GPU yang dipesan tidak.
- Persyaratan residensi data atau udara menentukannya secara langsung, dan harga bukanlah variabelnya.
Bagian yang benar-benar berguna dari rilis Apache 2.0 bukanlah menghemat $0,15 per juta token. Itu adalah bahwa tidak ada yang dapat menghentikan model tersebut dari Anda. Model tertutup yang Anda jadikan dasar produk dapat dihentikan sesuai jadwal vendor. Yang ini tidak bisa.
Kredit komputasi membuat hosting mandiri murah, dan itu adalah hibah terpisah dari kredit model. AI Perks mencakup kedua lapisan tersebut.

Apa yang Belum Diterbitkan oleh Mistral
Tiga hal tentang Small 4 dan saudara-saudaranya umumnya dinyatakan secara online dengan lebih percaya diri daripada yang diperoleh vendor. Berikut adalah apa yang sebenarnya belum dikonfirmasi.
Kredit startup. Mistral telah menjalankan program kredit startup, dilaporkan secara historis hingga sekitar $30.000 dalam kredit La Plateforme. Angka itu dilaporkan daripada dikonfirmasi saat ini: pada pertengahan 2026 tidak ada halaman swalayan publik untuk program tersebut, jadi anggap angka spesifik apa pun yang Anda lihat dikutip sebagai belum diverifikasi sampai Mistral menerbitkannya kembali. AI Perks melacak penyedia model mana yang saat ini memiliki program kredit aktif.
Mistral OCR 4. Model kecerdasan dokumen tertanggal 23 Juni 2026 dilaporkan tetapi tidak dikonfirmasi pada halaman penetapan harga yang diberi versi, jadi baca model dan tanggalnya seperti yang dilaporkan, bukan sudah pasti. Pendekatan penetapan harga umum Mistral untuk OCR adalah penagihan per 1.000 halaman, dan tarif per 1.000 halaman yang tepat untuk versi ini tidak dikonfirmasi. Siapa pun yang mengutip angka yang tepat untuk itu menebak.
Batas tingkatan gratis. Tidak ada tingkatan API gratis khusus untuk Small 4. Tunjangan $10 per bulan berada di Paket Gratis konsumen, dan Mistral belum menerbitkan batas tarif untuknya, jadi tidak ada langit-langit yang dipublikasikan untuk dijadikan acuan desain.
Jika sebuah halaman menyatakan angka yang tidak pernah diterbitkan oleh vendor, itu akan salah pada saat vendor menerbitkannya.
Pertanyaan yang Sering Diajukan
Berapa biaya Mistral Small 4 per juta token?
Mistral Small 4 berharga $0,15 per juta token input dan $0,60 per juta token output di API Mistral. Output ditagih 4x input, sehingga agen yang bertele-tele berharga jauh lebih mahal daripada yang ringkas untuk pekerjaan yang sama. Hosting mandiri bobot Apache 2.0 tidak dikenakan biaya per token, hanya biaya komputasi.
Apakah ada tingkatan gratis API Mistral AI di tahun 2026?
Tidak ada tingkatan API gratis khusus untuk Mistral Small 4. Paket Konsumen Gratis mencakup kredit API $10 per bulan. Mistral belum menerbitkan batas tarif untuk tunjangan tersebut, dan juga belum menerbitkan tunjangan kredit untuk tingkatan konsumen berbayarnya, jadi angka per tingkatan yang dikutip belum diverifikasi.
Bisakah saya menjalankan Mistral Small 4 secara gratis?
Ya, melalui tiga rute. Postingan peluncuran Mistral mengarahkan pengembang ke prototyping gratis pada komputasi akselerasi NVIDIA. Paket Konsumen Gratis membawa kredit API $10 per bulan. Dan bobot Apache 2.0 dapat di-host mandiri di perangkat keras Anda sendiri tanpa biaya lisensi.
Model apa yang digantikan oleh Mistral Small 4?
Mistral menggambarkan Small 4 sebagai model pertama yang menyatukan Magistral untuk penalaran, Pixtral untuk multimodal, dan Devstral untuk pengkodean agenik ke dalam satu model. Model ini multimodal melalui kemampuan Pixtral yang dilipat, memiliki jendela konteks 256K, dan menjalankan total 119 miliar parameter.
Apakah Mistral menawarkan kredit program startup?
Mistral telah menjalankan program kredit startup yang dilaporkan secara historis hingga sekitar $30.000 dalam kredit La Plateforme. Itu adalah angka yang dilaporkan, bukan angka yang dikonfirmasi saat ini: tidak ada halaman swalayan publik untuk program tersebut pada pertengahan 2026, jadi anggap jumlah apa pun yang dikutip sebagai belum diverifikasi. AI Perks melacak penyedia mana yang memiliki program aktif dan berapa nilainya saat ini.
Apakah hosting mandiri Mistral Small 4 lebih murah daripada API?
Itu tergantung pada siklus tugas, bukan harga daftar. Lalu lintas yang berfluktuasi atau bervolume rendah lebih menyukai API, karena GPU yang menganggur ditagih sementara panggilan API yang menganggur tidak. Volume tinggi yang berkelanjutan lebih menyukai hosting mandiri. Kredit komputasi menggeser titik impas tersebut secara tajam, dan itu adalah hibah terpisah dari kredit model.
Token termurah adalah token yang sudah dibayar orang lain. Temukan di AI Perks.