Mistral Small 4 的成本是多少?
Mistral Small 4 于 2026 年 3 月 16 日推出,在 Mistral API 上的价格为每百万输入 token 0.15 美元,每百万输出 token 0.60 美元。其模型权重采用 Apache 2.0 许可,因此自托管没有任何许可费用。
这种组合就是全部。API 上的模型如此便宜,通常是闭源的;而如此开放的模型通常没有值得使用的第一方端点。Small 4 则兼具两者的优势。
以下是 Mistral 在发布时公布的信息:
| 属性 | Mistral Small 4 |
|---|---|
| 发布日期 | 2026 年 3 月 16 日 |
| 总参数 | 119B |
| 上下文窗口 | 256K token |
| 许可 | Apache 2.0 |
| 模态 | 多模态,通过折叠到权重中的 Pixtral 功能实现 |
| API 价格,输入 | 每百万 token 0.15 美元 |
| API 价格,输出 | 每百万 token 0.60 美元 |
以上所有数字均来自 Mistral 自己的发布帖子。AI Perks 会跟踪同一供应商在标价基础上赠送的积分。

合并 Magistral、Pixtral 和 Devstral 实际上改变了什么
Small 4 是 Mistral 首个将推理、多模态和代理编码整合到一组权重中的模型。Mistral 将其描述为整合了用于推理的 Magistral、用于多模态的 Pixtral 和用于代理编码的 Devstral。
实际效果体现在您的架构上,而不是您的基准测试电子表格。在此之前,一个团队若要进行文档解析、代码生成和推理,就需要运行三个模型系列、三组提示和三个计费项目。
三者合并为一:
混合工作负载的单一端点。 过去在 Pixtral 中的多模态功能现在包含在相同的权重中,因此混合媒体工作不再需要第二个端点后面的第二个模型。
单一权重集进行托管。 如果您自托管,之前需要拉取和部署单独的检查点。现在只需一个。
单一价格进行建模。 跨混合管道的成本预测不再需要混合三种费率卡。
256K 的上下文窗口使得这种整合变得可用。将长文档和代码库输入到同一请求中才具有意义,前提是窗口能够容纳两者。
Mistral Small 4 定价:实际工作负载的成本
输入 0.15 美元,输出 0.60 美元,一项严肃的生产工作负载每月成本在几十美元,而不是几千美元。下方的计算是标价乘以体积,仅此而已。
| 每月工作负载 | 输入 token | 输出 token | 标价成本 |
|---|---|---|---|
| 原型或边项目 | 5M | 1M | 1.35 美元 |
| 支持聊天机器人 | 50M | 10M | 13.50 美元 |
| 文档解析管道 | 300M | 15M | 54.00 美元 |
| 编码代理,一名开发者 | 500M | 100M | 135.00 美元 |
| 大规模生产 RAG | 2B | 200M | 420.00 美元 |
输出乘数是需要关注的数字。输出成本是输入的 4 倍,因此一个喋喋不休地叙述其推理过程的代理,其成本是进行相同工作的简洁代理的数倍。
该比例也是为什么长上下文比听起来便宜的原因。将 200K token 的文档填入提示的成本为 0.03 美元。计费的是响应。
积分可以改变这种计算方式,下一节的免费途径可以完全涵盖最初的数百万 token。

获得 Mistral Small 4 的免费途径
Mistral Small 4 没有专门的免费 API 层。有三种单独的免费或接近免费的途径可以运行它,它们适合不同的阶段。
| 途径 | 成本 | 内容 |
|---|---|---|
| NVIDIA 开发者原型制作 | 免费 | 在 NVIDIA 加速计算上免费制作原型,在 Mistral 的发布帖子中提到 |
| Mistral 免费消费者计划 | 0 美元 | 每月 10 美元的 API 积分 |
| 自托管开放权重 | 您自己的计算资源 | Apache 2.0,无每 token 费用 |
| 提供商积分计划 | 持有免费 | 在 AI Perks 上跟踪 |
Mistral 未公布超过 10 美元的付费计划积分额度,因此您在其他地方找到的任何分级积分表都是他人的重构,而非供应商数据。
免费消费者计划每月 10 美元的积分是被低估的。将其与上述标价结合计算,如果完全用于输入,大约可购买 6600 万个输入 token。假设读写比例为 5:1,则大约为 4400 万个 token。两者都是基于已公布费率的计算,而非已公布的 token 额度,但对于评估套件或低流量内部工具而言,这是一个真实的预算,而非象征性的 token。
值得明确说明的是:这些是消费者计划积分,Mistral 未公布在持续负载下该额度如何表现的保证。将其视为评估预算,而非生产容量。
Apache 2.0:自托管实际改变了什么
Apache 2.0 意味着您可以运行、修改、微调和商业部署 Mistral Small 4,无需许可费,也无需使用情况报告。但这并不意味着运行它是免费的。
费用只是转移而不是消失。开放权重运行在您已有的任何推理栈上,而这些栈都运行在有人付费的硬件上。Mistral 未公布 Small 4 的部署成本模型,因此下方的比较是关于您自己的占空比,而不是供应商数据。
盈亏平衡点由占空比决定,而非标价:
- 突发或低流量 倾向于 API,因为空闲的 GPU 按全价收费,而空闲的 API 调用则不收费。
- 持续高流量 倾向于自托管,因为每 token 定价是线性扩展的,而保留的 GPU 则不是。
- 数据驻留或气隙要求 直接决定了选择,价格不是变量。
Apache 2.0 版本真正有用的部分不是节省每百万 token 0.15 美元。而是没有人可以随意停用模型。您基于闭源模型构建的产品可能会在供应商的计划下被淘汰。而这个模型不会。
计算积分使得自托管变得便宜,它们是独立于模型积分的赠款。AI Perks 同时涵盖了这两个层面。

Mistral 未公布的信息
关于 Small 4 及其同系列模型,有三点信息在网上被传播得比供应商声称的更确定。以下是尚未确认的信息。
创业公司积分。 Mistral 曾有一个创业公司积分计划,历史上报道称在 La Plateforme 积分上高达约 30,000 美元。该数字是报道的,而非当前确认的:截至 2026 年中期,该计划没有公开的自助服务页面,因此在 Mistral 重新发布之前,任何具体的引述数字都应视为未经核实。AI Perks 会跟踪哪些模型供应商当前拥有有效的积分计划。
Mistral OCR 4。 据报道,一款发布于 2026 年 6 月 23 日的文档智能模型,但在版本化定价页面上未得到确认,因此请将该模型及其日期视为报道内容,而非已确定。Mistral OCR 的总体定价方法是按每千页收费,而此版本的具体每千页费率尚未确认。任何引用精确数字的人都在猜测。
免费层级限制。 Small 4 没有专门的免费 API 层。每月 10 美元的额度在免费消费者计划中,Mistral 未公布其费率限制,因此没有已公布的上限可供设计。
如果某页面陈述了供应商从未公布的数字,那么在供应商发布该数字时,该页面就会出错。
常见问题解答
Mistral Small 4 每百万 token 的成本是多少?
Mistral Small 4 在 Mistral API 上的价格为每百万输入 token 0.15 美元,每百万输出 token 0.60 美元。输出计费是输入的 4 倍,因此冗长的代理比进行相同工作的简洁代理成本更高。自托管 Apache 2.0 权重不收取每 token 费用,仅计算计算成本。
2026 年有 Mistral AI API 免费层级吗?
Mistral Small 4 没有专门的免费 API 层。免费消费者计划包含每月 10 美元的 API 积分。Mistral 未公布该额度的费率限制,也未公布其付费消费者层级的积分额度,因此引用的按层级数字未经核实。
我可以免费运行 Mistral Small 4 吗?
是的,有三种途径。Mistral 的发布帖子将开发者引向 NVIDIA 加速计算上的免费原型制作。免费消费者计划包含每月 10 美元的 API 积分。而 Apache 2.0 权重可以在您自己的硬件上自托管,无需许可费用。
Mistral Small 4 取代了哪些模型?
Mistral 将 Small 4 描述为首个将用于推理的 Magistral、用于多模态的 Pixtral 和用于代理编码的 Devstral 整合到单一模型中的模型。它通过内置的 Pixtral 功能实现多模态,拥有 256K 的上下文窗口,总共拥有 119B 参数。
Mistral 是否提供创业公司计划积分?
Mistral 曾有一个创业公司积分计划,历史上报道称在 La Plateforme 积分上高达约 30,000 美元。这是报道的数字,并非当前确认的:截至 2026 年中期,该计划没有公开的自助服务页面,因此任何引用的金额都应视为未经核实。AI Perks 会跟踪哪些提供商拥有实时计划以及它们当前的价值。
自托管 Mistral Small 4 比 API 更便宜吗?
这取决于占空比,而非标价。突发或低流量更倾向于 API,因为空闲的 GPU 会计费,而空闲的 API 调用则不会。持续高流量则更倾向于自托管。计算积分会显著改变盈亏平衡点,并且它们是独立于模型积分的赠款。
最便宜的 token 是别人已经付费的那个。在 AI Perks 上找到它们。