Mistral Small 4 Có Giá Bao Nhiêu?
Mistral Small 4 ra mắt vào ngày 16 tháng 3 năm 2026 với giá 0,15 đô la cho mỗi triệu token đầu vào và 0,60 đô la cho mỗi triệu token đầu ra trên API của Mistral. Các trọng số được phát hành theo giấy phép Apache 2.0, do đó việc tự lưu trữ hoàn toàn không mất phí bản quyền.
Sự kết hợp đó là toàn bộ câu chuyện. Một mô hình rẻ như vậy trên API thường là đóng, và một mô hình mở như vậy thường không có điểm cuối chính thức nào đáng sử dụng. Small 4 có cả hai.
Đây là những gì Mistral đã công bố khi ra mắt:
| Thuộc tính | Mistral Small 4 |
|---|---|
| Ngày ra mắt | Ngày 16 tháng 3 năm 2026 |
| Tổng số tham số | 119 tỷ |
| Cửa sổ ngữ cảnh | 256K token |
| Giấy phép | Apache 2.0 |
| Đa phương thức | Đa phương thức, thông qua khả năng Pixtral được tích hợp vào các trọng số |
| Giá API, đầu vào | 0,15 đô la cho mỗi triệu token |
| Giá API, đầu ra | 0,60 đô la cho mỗi triệu token |
Mọi số liệu trên đều đến từ bài đăng ra mắt của Mistral. AI Perks theo dõi những gì các nhà cung cấp tương tự cung cấp dưới dạng tín dụng ngoài giá niêm yết.

Việc Hợp Nhất Magistral, Pixtral và Devstral Thực Sự Thay Đổi Điều Gì
Small 4 là mô hình Mistral đầu tiên tích hợp khả năng suy luận, đa phương thức và mã hóa tác tử vào một bộ trọng số duy nhất. Mistral mô tả nó là sự hợp nhất Magistral cho suy luận, Pixtral cho đa phương thức và Devstral cho mã hóa tác tử.
Hiệu quả thực tế nằm ở kiến trúc của bạn, chứ không phải ở bảng tính điểm chuẩn. Trước đây, một nhóm thực hiện phân tích tài liệu cộng với tạo mã cộng với suy luận sẽ chạy ba dòng mô hình, ba bộ nhắc và ba dòng thanh toán.
Ba thứ này được hợp nhất thành một:
Một điểm cuối cho các khối lượng công việc hỗn hợp. Khả năng đa phương thức từng nằm trong Pixtral giờ đây nằm trong cùng một bộ trọng số, vì vậy công việc đa phương tiện hỗn hợp không còn yêu cầu mô hình thứ hai phía sau một điểm cuối thứ hai nữa.
Một bộ trọng số để lưu trữ. Nếu bạn tự lưu trữ, trước đây bạn phải tải xuống và phục vụ các checkpoint riêng biệt. Bây giờ chỉ còn một.
Một mức giá để định giá. Dự báo chi phí trên một quy trình làm việc hỗn hợp sẽ không còn yêu cầu sự pha trộn trọng số của ba bảng giá nữa.
Cửa sổ ngữ cảnh 256K chính là yếu tố làm cho việc hợp nhất này trở nên khả dụng. Việc cung cấp một tài liệu dài và một cơ sở mã vào cùng một yêu cầu chỉ có ý nghĩa nếu cửa sổ có thể chứa cả hai.
Giá Mistral Small 4: Chi Phí Thực Tế Cho Các Khối Lượng Công Việc
Với 0,15 đô la cho đầu vào và 0,60 đô la cho đầu ra, một khối lượng công việc sản xuất nghiêm túc sẽ chỉ tốn vài chục đô la mỗi tháng, chứ không phải hàng nghìn đô la. Các phép tính dưới đây chỉ đơn giản là giá niêm yết nhân với khối lượng, không hơn không kém.
| Khối lượng công việc hàng tháng | Token đầu vào | Token đầu ra | Chi phí theo giá niêm yết |
|---|---|---|---|
| Dự án mẫu hoặc dự án phụ | 5 triệu | 1 triệu | 1,35 đô la |
| Chatbot hỗ trợ | 50 triệu | 10 triệu | 13,50 đô la |
| Quy trình phân tích tài liệu | 300 triệu | 15 triệu | 54,00 đô la |
| Tác tử mã hóa, một nhà phát triển | 500 triệu | 100 triệu | 135,00 đô la |
| Sản xuất RAG quy mô lớn | 2 tỷ | 200 triệu | 420,00 đô la |
Hệ số đầu ra là con số cần chú ý. Chi phí đầu ra gấp 4 lần đầu vào, vì vậy một tác tử nói nhiều, giải thích lý do của nó sẽ tốn kém gấp nhiều lần một tác tử ngắn gọn thực hiện công việc tương tự.
Tỷ lệ đó cũng là lý do tại sao ngữ cảnh dài lại rẻ hơn bạn nghĩ. Việc đưa 200K token tài liệu vào một lời nhắc tốn 0,03 đô la. Chính phản hồi mới là thứ tính phí.
Tín dụng sẽ thay đổi phép toán này, và các phương thức miễn phí ở phần tiếp theo sẽ bao gồm vài triệu token đầu tiên.

Các Phương Thức Miễn Phí Để Sử Dụng Mistral Small 4
Không có bậc miễn phí API chuyên dụng cho Mistral Small 4. Có ba tuyến đường miễn phí hoặc gần như miễn phí riêng biệt để chạy nó, và chúng phù hợp với các giai đoạn khác nhau.
| Tuyến đường | Chi phí | Những gì bạn nhận được |
|---|---|---|
| Tạo mẫu cho nhà phát triển NVIDIA | Miễn phí | Tạo mẫu miễn phí trên nền tảng điện toán tăng tốc của NVIDIA, được đề cập trong bài đăng ra mắt của Mistral |
| Gói tiêu dùng miễn phí của Mistral | 0 đô la | 10 đô la tín dụng API mỗi tháng |
| Trọng số mở tự lưu trữ | Tự cung cấp tài nguyên tính toán của bạn | Apache 2.0, không có phí mỗi token |
| Các chương trình tín dụng của nhà cung cấp | Miễn phí đăng ký | Theo dõi tại AI Perks |
Mistral chưa công bố các khoản tín dụng cho gói trả phí vượt quá con số 10 đô la đó, vì vậy bất kỳ bảng tín dụng theo bậc nào bạn tìm thấy ở nơi khác đều là sự tái cấu trúc của ai đó chứ không phải số liệu của nhà cung cấp.
Khoản tín dụng 10 đô la mỗi tháng trên gói tiêu dùng miễn phí là một khoản không được đánh giá đúng mức. Chạy nó theo giá niêm yết trên sẽ mua được khoảng 66 triệu token đầu vào nếu bạn chi tiêu hoàn toàn cho đầu vào. Giả sử tỷ lệ đọc/ghi là 5:1, nó sẽ tương đương khoảng 44 triệu token. Cả hai đều là phép toán dựa trên tỷ giá đã công bố, chứ không phải là hạn ngạch token đã công bố, nhưng đối với một công cụ đánh giá hoặc một công cụ nội bộ có khối lượng thấp thì đây là một ngân sách thực tế chứ không phải là một cử chỉ nhỏ.
Một lưu ý cần nói rõ ràng: đây là tín dụng cho gói tiêu dùng, và Mistral chưa công bố đảm bảo về cách hạn mức này hoạt động dưới tải liên tục. Hãy coi nó như ngân sách đánh giá, không phải năng lực sản xuất.
Apache 2.0: Việc Tự Lưu Trữ Thực Sự Thay Đổi Điều Gì
Apache 2.0 có nghĩa là bạn có thể chạy, sửa đổi, tinh chỉnh và triển khai thương mại Mistral Small 4 mà không mất phí bản quyền và không cần báo cáo sử dụng. Điều đó không có nghĩa là việc chạy nó là miễn phí.
Hóa đơn sẽ chuyển sang nơi khác chứ không biến mất. Các trọng số mở chạy trên bất kỳ ngăn xếp suy luận nào bạn đang vận hành, và mỗi ngăn xếp trong số đó đều chạy trên phần cứng mà ai đó phải trả tiền. Mistral chưa công bố mô hình chi phí triển khai cho Small 4, vì vậy so sánh dưới đây là về chu kỳ hoạt động của bạn chứ không phải là số liệu của nhà cung cấp.
Điểm hòa vốn được xác định bởi chu kỳ hoạt động, chứ không phải bởi giá niêm yết:
- Lưu lượng truy cập đột xuất hoặc khối lượng thấp sẽ ưu tiên API, vì GPU nhàn rỗi sẽ tính phí theo giá đầy đủ trong khi lệnh gọi API nhàn rỗi sẽ không tính phí gì.
- Lưu lượng truy cập ổn định khối lượng cao sẽ ưu tiên tự lưu trữ, vì giá mỗi token tỷ lệ tuyến tính trong khi GPU được đặt trước thì không.
- Yêu cầu về nơi lưu trữ dữ liệu hoặc yêu cầu cách ly sẽ quyết định hoàn toàn, và giá cả không phải là biến số.
Phần thực sự hữu ích của bản phát hành Apache 2.0 không phải là tiết kiệm 0,15 đô la cho mỗi triệu token. Đó là việc không ai có thể loại bỏ mô hình đó khỏi hệ thống của bạn. Một mô hình đóng mà bạn xây dựng sản phẩm dựa trên đó có thể bị ngừng hoạt động theo lịch trình của nhà cung cấp. Mô hình này thì không.
Tín dụng tính toán là yếu tố làm cho việc tự lưu trữ trở nên rẻ, và chúng là một khoản cấp riêng biệt với tín dụng mô hình. AI Perks bao gồm cả hai lớp.

Mistral Chưa Công Bố Những Gì
Ba điều về Small 4 và các phiên bản tương tự của nó thường được nói trên mạng với sự tự tin hơn so với những gì nhà cung cấp đã đạt được. Dưới đây là những gì thực sự chưa được xác nhận.
Tín dụng khởi nghiệp. Mistral đã có một chương trình tín dụng khởi nghiệp, theo báo cáo lịch sử lên tới khoảng 30.000 đô la tín dụng trên La Plateforme. Con số đó là được báo cáo chứ không phải được xác nhận hiện tại: tính đến giữa năm 2026, không có trang tự phục vụ công khai nào cho chương trình này, vì vậy hãy coi bất kỳ con số cụ thể nào bạn thấy được trích dẫn là chưa được xác minh cho đến khi Mistral công bố lại. AI Perks theo dõi những nhà cung cấp mô hình nào hiện có các chương trình tín dụng trực tiếp.
Mistral OCR 4. Một mô hình nhận dạng ký tự quang học (OCR) tài liệu ngày 23 tháng 6 năm 2026 đã được báo cáo nhưng chưa được xác nhận trên trang định giá có phiên bản, vì vậy hãy đọc mô hình và ngày của nó như đã báo cáo chứ không phải đã chốt. Phương pháp định giá chung của Mistral cho OCR là tính phí theo 1.000 trang, và tỷ lệ chính xác cho mỗi 1.000 trang cho phiên bản này chưa được xác nhận. Bất kỳ ai đưa ra một con số chính xác cho nó đều đang đoán.
Giới hạn bậc miễn phí. Không có bậc miễn phí API chuyên dụng cho Small 4. Hạn mức 10 đô la mỗi tháng nằm trên gói Tiêu dùng Miễn phí, và Mistral chưa công bố giới hạn tốc độ cho nó, vì vậy không có trần đã công bố để thiết kế theo.
Nếu một trang đưa ra một con số mà nhà cung cấp chưa bao giờ công bố, nó sẽ sai ngay khi nhà cung cấp công bố.
Câu Hỏi Thường Gặp
Mistral Small 4 tốn bao nhiêu chi phí cho mỗi triệu token?
Mistral Small 4 có giá 0,15 đô la cho mỗi triệu token đầu vào và 0,60 đô la cho mỗi triệu token đầu ra trên API của Mistral. Đầu ra tính phí gấp 4 lần đầu vào, vì vậy các tác tử dài dòng sẽ tốn kém hơn đáng kể so với các tác tử ngắn gọn thực hiện công việc giống hệt nhau. Việc tự lưu trữ các trọng số Apache 2.0 không tính phí mỗi token, chỉ tính chi phí tính toán.
Mistral AI có cung cấp bậc miễn phí API vào năm 2026 không?
Không có bậc miễn phí API chuyên dụng cho Mistral Small 4. Gói tiêu dùng Miễn phí bao gồm 10 đô la tín dụng API mỗi tháng. Mistral chưa công bố giới hạn tốc độ cho hạn mức đó, và họ cũng chưa công bố hạn mức tín dụng cho các bậc tiêu dùng trả phí của mình, vì vậy các số liệu được trích dẫn theo bậc đều chưa được xác minh.
Tôi có thể chạy Mistral Small 4 miễn phí không?
Có, thông qua ba tuyến đường. Bài đăng ra mắt của Mistral giới thiệu các nhà phát triển đến việc tạo mẫu miễn phí trên nền tảng điện toán tăng tốc của NVIDIA. Gói tiêu dùng Miễn phí mang lại 10 đô la tín dụng API mỗi tháng. Và các trọng số Apache 2.0 có thể được tự lưu trữ trên phần cứng của riêng bạn mà không mất phí bản quyền.
Mistral Small 4 đã thay thế những mô hình nào?
Mistral mô tả Small 4 là mô hình đầu tiên hợp nhất Magistral cho suy luận, Pixtral cho đa phương thức và Devstral cho mã hóa tác tử vào một mô hình duy nhất. Nó là đa phương thức thông qua khả năng Pixtral được tích hợp, có cửa sổ ngữ cảnh 256K và chạy 119 tỷ tham số tổng.
Mistral có cung cấp tín dụng chương trình khởi nghiệp không?
Mistral đã có một chương trình tín dụng khởi nghiệp được báo cáo lịch sử lên tới khoảng 30.000 đô la tín dụng trên La Plateforme. Đó là một con số được báo cáo, không phải là con số được xác nhận hiện tại: không có trang tự phục vụ công khai nào cho chương trình này tính đến giữa năm 2026, vì vậy hãy coi bất kỳ số tiền nào được trích dẫn là chưa được xác minh. AI Perks theo dõi những nhà cung cấp nào có các chương trình trực tiếp và giá trị hiện tại của chúng.
Tự lưu trữ Mistral Small 4 có rẻ hơn API không?
Nó phụ thuộc vào chu kỳ hoạt động, chứ không phải giá niêm yết. Lưu lượng truy cập đột xuất hoặc khối lượng thấp ưu tiên API, vì GPU nhàn rỗi tính phí trong khi các lệnh gọi API nhàn rỗi thì không. Lưu lượng truy cập ổn định khối lượng cao ưu tiên tự lưu trữ. Tín dụng tính toán sẽ làm thay đổi điểm hòa vốn này đáng kể, và chúng là một khoản cấp riêng biệt với tín dụng mô hình.
Token rẻ nhất là token mà người khác đã trả tiền. Tìm chúng tại AI Perks.