هزینه Mistral Small 4 چقدر است؟
Mistral Small 4 در تاریخ ۱۶ مارس ۲۰۲۶ با قیمت ۰.۱۵ دلار به ازای هر میلیون توکن ورودی و ۰.۶۰ دلار به ازای هر میلیون توکن خروجی در API Mistral عرضه شد. وزنها تحت مجوز Apache 2.0 منتشر میشوند، بنابراین خود میزبانی (self-hosting) هیچ هزینه لایسنس ندارد.
این ترکیب، تمام داستان است. مدلی که در API اینقدر ارزان است، معمولاً بسته (closed) است و مدلی که اینقدر باز (open) است، معمولاً نقطه پایانی (endpoint) اولیهای ندارد که ارزش استفاده داشته باشد. Small 4 هر دو را دارد.
در اینجا چیزی است که Mistral در زمان عرضه منتشر کرده است:
| ویژگی | Mistral Small 4 |
|---|---|
| تاریخ عرضه | ۱۶ مارس ۲۰۲۶ |
| پارامترهای کل | ۱۱۹ میلیارد |
| پنجره زمینه (Context window) | ۲۵۶ هزار توکن |
| مجوز | Apache 2.0 |
| چندوجهی (Modality) | چندوجهی، از طریق قابلیت Pixtral که در وزنها گنجانده شده است |
| قیمت API، ورودی | ۰.۱۵ دلار به ازای هر میلیون توکن |
| قیمت API، خروجی | ۰.۶۰ دلار به ازای هر میلیون توکن |
هر عدد بالا از پست عرضه خود Mistral آمده است. AI Perks میزان اعتباری را که همین ارائهدهندگان علاوه بر قیمت لیست ارائه میدهند، پیگیری میکند.

ادغام Magistral، Pixtral و Devstral چه تغییری ایجاد میکند؟
Small 4 اولین مدل Mistral است که استدلال، چندوجهی و کدنویسی عامل (agentic coding) را در یک مجموعه وزن ادغام میکند. Mistral آن را به عنوان ادغام Magistral برای استدلال، Pixtral برای چندوجهی و Devstral برای کدنویسی عامل توصیف میکند.
تأثیر عملی آن بر معماری شماست، نه بر صفحه گسترده معیار (benchmark spreadsheet) شما. قبل از این، تیمی که تجزیه و تحلیل اسناد، تولید کد و استدلال را انجام میداد، سه خانواده مدل، سه مجموعه درخواست (prompt) و سه خط صورتحساب را اجرا میکرد.
سه چیز در یک چیز خلاصه میشود:
یک نقطه پایانی برای بارهای کاری ترکیبی. قابلیت چندوجهی که قبلاً در Pixtral قرار داشت، اکنون در همان وزنها قرار دارد، بنابراین کار رسانهای ترکیبی دیگر نیازی به مدل دوم در پشت یک نقطه پایانی دوم ندارد.
یک مجموعه وزن برای میزبانی. اگر خود میزبانی (self-host) میکنید، قبلاً چکپوینتهای جداگانه را دانلود و سرویس میدادید. اکنون فقط یکی است.
یک قیمت برای مدل. پیشبینی هزینه در یک خط لوله ترکیبی دیگر نیازی به ترکیب وزندار سه کارت نرخ ندارد.
پنجره زمینه ۲۵۶ هزار توکنی همان چیزی است که ادغام را قابل استفاده میکند. ارسال یک سند طولانی و یک پایگاه کد به درخواست یکسان تنها در صورتی جالب است که پنجره هر دو را در خود جای دهد.
قیمتگذاری Mistral Small 4: هزینههای بارهای کاری واقعی
با ورودی ۰.۱۵ دلار و خروجی ۰.۶۰ دلار، یک بار کاری جدی تولیدی در حد دهها دلار در ماه است، نه هزاران دلار. محاسبات زیر قیمت لیست ضربدر حجم است، چیزی بیشتر از این نیست.
| بار کاری ماهانه | توکن ورودی | توکن خروجی | هزینه در قیمت لیست |
|---|---|---|---|
| نمونه اولیه یا پروژه جانبی | ۵ میلیون | ۱ میلیون | ۱.۳۵ دلار |
| چتبات پشتیبانی | ۵۰ میلیون | ۱۰ میلیون | ۱۳.۵۰ دلار |
| خط لوله تجزیه اسناد | ۳۰۰ میلیون | ۱۵ میلیون | ۵۴.۰۰ دلار |
| عامل کدنویس، یک توسعهدهنده | ۵۰۰ میلیون | ۱۰۰ میلیون | ۱۳۵.۰۰ دلار |
| تولید RAG در مقیاس | ۲ میلیارد | ۲۰۰ میلیون | ۴۲۰.۰۰ دلار |
ضریب خروجی عددی است که باید به آن توجه کنید. خروجی ۴ برابر ورودی هزینه دارد، بنابراین یک عامل پرحرف که استدلال خود را روایت میکند، چندین برابر یک عامل مختصر که کار یکسانی انجام میدهد، هزینه دارد.
این نسبت همچنین دلیل ارزانتر بودن زمینه طولانی (long context) نسبت به آنچه به نظر میرسد، است. ارسال ۲۰۰ هزار توکن سند در یک درخواست ۰.۰۳ دلار هزینه دارد. این پاسخ است که صورتحساب را تعیین میکند.
اعتبارات این محاسبات را تغییر میدهند و مسیرهای رایگان در بخش بعدی، چند میلیون توکن اول را کاملاً پوشش میدهند.

مسیرهای رایگان به Mistral Small 4
هیچ سطح API رایگان اختصاصی برای Mistral Small 4 وجود ندارد. سه مسیر جداگانه رایگان یا تقریباً رایگان برای اجرای آن وجود دارد و آنها برای مراحل مختلف مناسب هستند.
| مسیر | هزینه آن چقدر است؟ | چه چیزی دریافت میکنید؟ |
|---|---|---|
| نمونهسازی توسعهدهندگان NVIDIA | رایگان | نمونهسازی رایگان بر روی محاسبات شتابداده شده NVIDIA، که در پست عرضه Mistral ذکر شده است |
| طرح مصرفکننده رایگان Mistral | ۰ دلار | ۱۰ دلار اعتبار API در ماه |
| وزنهای باز خود میزبانی شده | محاسبات خودتان | Apache 2.0، بدون هزینه به ازای هر توکن |
| برنامههای اعتباری ارائهدهنده | رایگان برای نگهداری | در AI Perks پیگیری میشود |
Mistral هیچ اعتبار پلن پولی را فراتر از ۱۰ دلار منتشر نکرده است، بنابراین هر گونه جدول اعتباری سطح به سطح که در جای دیگری پیدا میکنید، بازسازی کسی است تا یک عدد فروشنده.
۱۰ دلار اعتبار در ماه در طرح مصرفکننده رایگان، اعتبار دستکم گرفته شده است. آن را از طریق قیمت لیست بالا اجرا کنید و اگر فقط برای ورودی هزینه شود، تقریباً ۶۶ میلیون توکن ورودی خریداری میکند. با فرض نسبت خواندن به نوشتن ۵:۱، به حدود ۴۴ میلیون توکن میرسد. هر دو محاسباتی بر اساس نرخ منتشر شده هستند، نه یک سهمیه توکن منتشر شده، اما برای یک ابزار ارزیابی یا یک ابزار داخلی با حجم کم، یک بودجه واقعی است تا یک ژست توکنی.
یک شرط که ارزش بیان صریح دارد: اینها اعتبارات طرح مصرفکننده هستند و Mistral هیچ تضمینی در مورد رفتار سهمیه تحت بار پایدار منتشر نکرده است. آن را بودجه ارزیابی در نظر بگیرید، نه ظرفیت تولید.
Apache 2.0: خود میزبانی (Self-Hosting) چه تغییری ایجاد میکند؟
Apache 2.0 به این معنی است که شما میتوانید Mistral Small 4 را بدون هزینه لایسنس و بدون گزارش استفاده، اجرا، اصلاح، تنظیم دقیق (fine-tune) و تجاری مستقر کنید. این به معنای رایگان بودن اجرای آن نیست.
صورتحساب جابجا میشود نه اینکه ناپدید شود. وزنهای باز بر روی هر پشته استنتاجی (inference stack) که از قبل اجرا میکنید، اجرا میشوند و هر یک از این پشتهها بر روی سختافزاری اجرا میشوند که کسی برای آن پول پرداخت میکند. Mistral مدل هزینه استقرار برای Small 4 منتشر نکرده است، بنابراین مقایسه زیر مربوط به چرخه وظیفه (duty cycle) خود شما است تا یک عدد فروشنده.
نقطه سربه سر (break-even) توسط چرخه وظیفه تعیین میشود، نه قیمت لیست:
- ترافیک پرشتاب یا کم حجم به نفع API است، زیرا GPU های بیکار با نرخ کامل صورتحساب میگیرند در حالی که تماس API بیکار هیچ صورتحسابی ندارد.
- ترافیک پایدار با حجم بالا به نفع خود میزبانی است، زیرا قیمتگذاری به ازای هر توکن به صورت خطی مقیاس میگیرد در حالی که GPU رزرو شده اینطور نیست.
- الزامات اقامت داده یا هوای جدا شده (air-gapped) مستقیماً آن را تعیین میکنند و قیمت متغیر نیست.
بخش واقعاً مفید یک انتشار Apache 2.0، صرفهجویی ۰.۱۵ دلار به ازای هر میلیون توکن نیست. این است که هیچکس نمیتواند مدل را از زیر پای شما بردارد. مدلی بسته که محصولی بر اساس آن ساختهاید، میتواند طبق برنامه فروشنده بازنشسته شود. این یکی نمیتواند.
اعتبارات محاسباتی (Compute credits) همان چیزی است که خود میزبانی را ارزان میکند و آنها یک اعطای جداگانه از اعتبارات مدل هستند. AI Perks هر دو لایه را پوشش میدهد.

آنچه Mistral منتشر نکرده است
سه مورد در مورد Small 4 و خواهران آن به طور معمول با اطمینان بیشتری نسبت به آنچه فروشنده کسب کرده است، به صورت آنلاین بیان میشود. در اینجا آنچه در واقع تأیید نشده است:
اعتبارات استارتآپ. Mistral یک برنامه اعتبارات استارتآپ اجرا کرده است، که به طور تاریخی تا حدود ۳۰,۰۰۰ دلار اعتبار La Plateforme گزارش شده است. این رقم گزارش شده است نه تأیید شده فعلی: از اواسط سال ۲۰۲۶، هیچ صفحه خود سرویس عمومی برای این برنامه وجود ندارد، بنابراین هر عدد مشخصی را که نقل شده است، تا زمانی که Mistral آن را مجدداً منتشر کند، غیرقابل تأیید در نظر بگیرید. AI Perks پیگیری میکند که کدام ارائهدهندگان مدل در حال حاضر برنامههای اعتباری زنده دارند.
Mistral OCR 4. یک مدل هوش اسناد با تاریخ ۲۳ ژوئن ۲۰۲۶ گزارش شده است اما در یک صفحه قیمتگذاری نسخهبندی شده تأیید نشده است، بنابراین مدل و تاریخ آن را به صورت گزارش شده بخوانید نه قطعی. رویکرد کلی قیمتگذاری Mistral برای OCR، صورتحساب به ازای هر ۱۰۰۰ صفحه است و نرخ دقیق به ازای هر ۱۰۰۰ صفحه برای این نسخه تأیید نشده است. هر کسی که عدد دقیقی برای آن نقل میکند، حدس میزند.
محدودیتهای سطح رایگان. هیچ سطح API رایگان اختصاصی برای Small 4 وجود ندارد. سهمیه ۱۰ دلاری در ماه در طرح رایگان مصرفکننده قرار دارد و Mistral محدودیتهای نرخ برای آن منتشر نکرده است، بنابراین سقفی منتشر شده برای طراحی وجود ندارد.
اگر صفحهای عددی را بیان کند که فروشنده هرگز منتشر نکرده است، در لحظهای که فروشنده آن را منتشر کند، اشتباه خواهد بود.
سوالات متداول
هزینه Mistral Small 4 به ازای هر میلیون توکن چقدر است؟
Mistral Small 4 در API Mistral، ۰.۱۵ دلار به ازای هر میلیون توکن ورودی و ۰.۶۰ دلار به ازای هر میلیون توکن خروجی هزینه دارد. خروجی ۴ برابر ورودی هزینه دارد، بنابراین عوامل پرحرف برای کار یکسان، بسیار بیشتر از عوامل مختصر هزینه دارند. خود میزبانی وزنهای Apache 2.0 هیچ هزینه به ازای هر توکن ندارد، فقط هزینه محاسبات.
آیا در سال ۲۰۲۶ سطح رایگان API Mistral AI وجود دارد؟
هیچ سطح API رایگان اختصاصی برای Mistral Small 4 وجود ندارد. طرح رایگان مصرفکننده شامل ۱۰ دلار اعتبار API در ماه است. Mistral محدودیتهای نرخ برای آن سهمیه منتشر نکرده است، و همچنین اعتبارات پلنهای پولی مصرفکننده خود را منتشر نکرده است، بنابراین اعداد نقل شده به ازای هر سطح تأیید نشده هستند.
آیا میتوانم Mistral Small 4 را به صورت رایگان اجرا کنم؟
بله، از طریق سه مسیر. پست عرضه Mistral توسعهدهندگان را به نمونهسازی رایگان بر روی محاسبات شتابداده شده NVIDIA هدایت میکند. طرح رایگان مصرفکننده ۱۰ دلار اعتبار API در ماه دارد. و وزنهای Apache 2.0 را میتوان بر روی سختافزار خودتان با هیچ هزینه لایسنس، خود میزبانی کرد.
Mistral Small 4 چه مدلهایی را جایگزین کرد؟
Mistral Small 4 را به عنوان اولین مدل ادغامکننده Magistral برای استدلال، Pixtral برای چندوجهی و Devstral برای کدنویسی عامل در یک مدل توصیف میکند. این مدل از طریق قابلیت Pixtral گنجانده شده، چندوجهی است، پنجره زمینه ۲۵۶ هزار توکنی دارد و مجموع ۱۱۹ میلیارد پارامتر را اجرا میکند.
آیا Mistral اعتبارات برنامه استارتآپ ارائه میدهد؟
Mistral یک برنامه اعتبارات استارتآپ اجرا کرده است که به طور تاریخی تا حدود ۳۰,۰۰۰ دلار اعتبار La Plateforme گزارش شده است. این یک رقم گزارش شده است، نه یک رقم تأیید شده فعلی: از اواسط سال ۲۰۲۶، هیچ صفحه خود سرویس عمومی برای این برنامه وجود ندارد، بنابراین هر مبلغ نقل شده را تا زمانی که Mistral آن را منتشر نکند، غیرقابل تأیید در نظر بگیرید. AI Perks پیگیری میکند که کدام ارائهدهندگان برنامههای زنده دارند و ارزش فعلی آنها چقدر است.
آیا خود میزبانی Mistral Small 4 ارزانتر از API است؟
بستگی به چرخه وظیفه دارد، نه قیمت لیست. ترافیک پرشتاب یا کم حجم به نفع API است، زیرا GPU های بیکار صورتحساب میگیرند در حالی که تماسهای API بیکار صورتحساب نمیگیرند. حجم بالا و پایدار به نفع خود میزبانی است. اعتبارات محاسباتی آن نقطه سربه سر را به شدت تغییر میدهند و آنها یک اعطای جداگانه از اعتبارات مدل هستند.
ارزانترین توکن، توکنی است که شخص دیگری قبلاً برای آن پول پرداخت کرده است. آنها را در AI Perks بیابید.