Mistral Small 4 Preço 2026: Custos Reais e Rotas Gratuitas

Mistral Small 4 custa $0,15 por milhão de tokens de entrada e $0,60 por milhão de saída. Especificações Apache 2.0, matemática de carga de trabalho real e as formas gratuitas de executá-lo.

Mistral Small 4Mistral AILLM PricingOpen WeightsAI Perks
Author Avatar
Andrew
AI Perks Team
10,061

Quick Answer

Mistral Small 4 custa $0,15 por milhão de tokens de entrada e $0,60 por milhão de tokens de saída na API Mistral. Os pesos são Apache 2.0, portanto, a auto-hospedagem não acarreta taxa de licença. Existem rotas gratuitas através de prototipagem NVIDIA e do crédito de API de $10 por mês no Mistral Free. Programas de crédito são rastreados em getaiperks.com.

Quanto Custa o Mistral Small 4?

O Mistral Small 4 foi lançado em 16 de março de 2026 a US$ 0,15 por milhão de tokens de entrada e US$ 0,60 por milhão de tokens de saída na API da Mistral. Os pesos são distribuídos sob a licença Apache 2.0, portanto, a auto-hospedagem não tem custo de licença.

Essa combinação é a história toda. Um modelo tão barato na API geralmente é fechado, e um modelo tão aberto geralmente não tem um endpoint de primeira parte que valha a pena usar. O Small 4 tem ambos.

Aqui está o que a Mistral publicou no lançamento:

AtributoMistral Small 4
Data de lançamento16 de março de 2026
Parâmetros totais119B
Janela de contexto256K tokens
LicençaApache 2.0
ModalidadeMultimodal, via capacidade Pixtral incorporada aos pesos
Preço da API, entradaUS$ 0,15 por milhão de tokens
Preço da API, saídaUS$ 0,60 por milhão de tokens

Todos os números acima vêm da própria postagem de lançamento da Mistral. O AI Perks rastreia o que os mesmos provedores oferecem em créditos além do preço de lista.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

O Que a Mesclagem de Magistral, Pixtral e Devstral Realmente Muda

O Small 4 é o primeiro modelo da Mistral a incorporar raciocínio, multimodalidade e codificação agenética em um único conjunto de pesos. A Mistral descreve isso como a unificação do Magistral para raciocínio, Pixtral para multimodalidade e Devstral para codificação agenética.

O efeito prático é na sua arquitetura, não na sua planilha de benchmarks. Antes disso, uma equipe que fizesse análise de documentos, geração de código e raciocínio utilizava três famílias de modelos, três conjuntos de prompts e três linhas de faturamento.

Três coisas se fundem em uma:

Um endpoint para cargas de trabalho mistas. A capacidade multimodal que antes ficava no Pixtral agora reside nos mesmos pesos, então o trabalho com mídia mista não precisa mais de um segundo modelo atrás de um segundo endpoint.

Um conjunto de pesos para hospedar. Se você optar pela auto-hospedagem, anteriormente baixava e servia checkpoints separados. Agora é apenas um.

Um preço para modelar. A previsão de custos em um pipeline misto para de exigir uma combinação ponderada de três listas de preços.

A janela de contexto de 256K é o que torna a consolidação utilizável. Alimentar um documento longo e uma base de código em uma única solicitação só é interessante se a janela comportar ambos.


Preços do Mistral Small 4: Quanto Custam Cargas de Trabalho Reais

A US$ 0,15 de entrada e US$ 0,60 de saída, uma carga de trabalho de produção séria chega a dezenas de dólares por mês, não a milhares. A aritmética abaixo é o preço de lista multiplicado pelo volume, nada mais.

Carga de trabalho mensalTokens de entradaTokens de saídaCusto ao preço de lista
Protótipo ou projeto paralelo5M1MUS$ 1,35
Chatbot de suporte50M10MUS$ 13,50
Pipeline de análise de documentos300M15MUS$ 54,00
Agente de codificação, um desenvolvedor500M100MUS$ 135,00
Produção RAG em escala2B200MUS$ 420,00

O multiplicador de saída é o número a ser observado. A saída custa 4 vezes a entrada, então um agente falante que narra seu raciocínio custa múltiplos de um agente conciso fazendo o mesmo trabalho.

Essa proporção também explica por que o contexto longo é mais barato do que parece. Colocar 200 mil tokens de documentos em um prompt custa US$ 0,03. É a resposta que é faturada.

Os créditos mudam essa matemática, e as rotas gratuitas na próxima seção cobrem os primeiros milhões de tokens integralmente.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Rotas Gratuitas para o Mistral Small 4

Não há um nível de API gratuito dedicado para o Mistral Small 4. Existem três rotas separadas, gratuitas ou quase gratuitas, para executá-lo, e elas se adequam a diferentes estágios.

RotaQuanto custaO que você obtém
Prototipagem para desenvolvedores NVIDIAGratuitoPrototipagem gratuita em computação acelerada pela NVIDIA, mencionada na postagem de lançamento da Mistral
Plano gratuito para consumidores MistralUS$ 0US$ 10 por mês em créditos de API
Pesos abertos auto-hospedadosSeu próprio poder de processamentoApache 2.0, sem taxa por token
Programas de crédito de provedoresGratuito para manterRastreado em AI Perks

A Mistral não publicou alocações de crédito para planos pagos além dessa cifra de US$ 10, portanto, qualquer tabela de níveis de crédito que você encontrar em outro lugar é uma reconstrução de alguém, em vez de um número do fornecedor.

Os US$ 10 por mês em créditos no plano gratuito para consumidores são subestimados. Execute-os com base no preço de lista acima e eles compram aproximadamente 66 milhões de tokens de entrada se você os gastar puramente em entrada. Assumindo uma proporção de leitura para escrita de 5:1, eles chegam mais perto de 44 milhões de tokens. Ambos são cálculos baseados na taxa publicada, não em uma alocação de tokens publicada, mas para uma ferramenta de avaliação ou uma ferramenta interna de baixo volume, é um orçamento real em vez de um gesto de token.

Uma ressalva que vale a pena declarar claramente: esses são créditos do plano de consumidor, e a Mistral não publicou garantias sobre como a alocação se comporta sob carga sustentada. Trate isso como orçamento de avaliação, não capacidade de produção.


Apache 2.0: O Que a Auto-Hospedagem Realmente Muda

O Apache 2.0 significa que você pode executar, modificar, ajustar e implantar comercialmente o Mistral Small 4 sem taxa de licença e sem relatórios de uso. Isso não significa que executá-lo seja gratuito.

A conta se move em vez de desaparecer. Os pesos abertos são executados em qualquer pilha de inferência que você já opere, e cada uma dessas pilhas é executada em hardware pelo qual alguém paga. A Mistral não publicou um modelo de custo de implantação para o Small 4, portanto, a comparação abaixo é sobre seu próprio ciclo de trabalho em vez de um número do fornecedor.

O ponto de equilíbrio é definido pelo ciclo de trabalho, não pelo preço de lista:

  • Tráfego intermitente ou de baixo volume favorece a API, porque GPUs ociosas são cobradas à taxa máxima, enquanto uma chamada de API ociosa não custa nada.
  • Tráfego sustentado de alto volume favorece a auto-hospedagem, porque o preço por token escala linearmente, enquanto uma GPU reservada não.
  • Requisitos de residência de dados ou air-gapped decidem isso completamente, e o preço não é a variável.

A parte genuinamente útil de uma liberação do Apache 2.0 não é economizar US$ 0,15 por milhão de tokens. É que ninguém pode depreciar o modelo sob você. Um modelo fechado no qual você construiu um produto pode ser desativado no cronograma do fornecedor. Este não pode.

Créditos de computação são o que tornam a auto-hospedagem barata, e eles são uma concessão separada dos créditos de modelo. O AI Perks cobre ambas as camadas.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

O Que a Mistral Não Publicou

Três coisas sobre o Small 4 e seus irmãos são comumente afirmadas online com mais confiança do que o fornecedor conquistou. Aqui está o que é realmente não confirmado.

Créditos para startups. A Mistral executou um programa de créditos para startups, historicamente relatado em até cerca de US$ 30.000 em créditos na La Plateforme. Essa cifra é relatada em vez de atualmente confirmada: a partir de meados de 2026, não há página pública de autoatendimento para o programa, portanto, trate qualquer número específico que você veja citado como não verificado até que a Mistral republique um. O AI Perks rastreia quais provedores de modelos têm programas de crédito ativos.

Mistral OCR 4. Um modelo de inteligência de documentos datado de 23 de junho de 2026 é relatado, mas não confirmado em uma página de preços com versão, portanto, leia o modelo e sua data como relatados em vez de estabelecidos. A abordagem geral de preços da Mistral para OCR é a cobrança por 1.000 páginas, e a taxa exata por 1.000 páginas para esta versão não é confirmada. Qualquer um que cite um número preciso para isso está adivinhando.

Limites do nível gratuito. Não há um nível de API gratuito dedicado para o Small 4. A alocação de US$ 10 por mês está no plano gratuito para consumidores, e a Mistral não publicou limites de taxa para ele, portanto, não há um teto publicado para projetar.

Se uma página declara um número que o fornecedor nunca publicou, ele estará incorreto no momento em que o fornecedor publicar um.


Perguntas Frequentes

Quanto custa o Mistral Small 4 por milhão de tokens?

O Mistral Small 4 custa US$ 0,15 por milhão de tokens de entrada e US$ 0,60 por milhão de tokens de saída na API da Mistral. A saída é cobrada 4x a entrada, portanto, agentes verbosos custam consideravelmente mais do que concisos para o mesmo trabalho. A auto-hospedagem dos pesos Apache 2.0 não tem taxa por token, apenas custo de computação.

Existe um nível gratuito da API Mistral AI em 2026?

Não há um nível de API gratuito dedicado para o Mistral Small 4. O plano gratuito para consumidores inclui US$ 10 por mês em créditos de API. A Mistral não publicou limites de taxa para essa alocação, nem publicou alocações de crédito para seus níveis pagos de consumidor, portanto, os números citados por nível não são verificados.

Posso executar o Mistral Small 4 gratuitamente?

Sim, através de três rotas. A postagem de lançamento da Mistral direciona os desenvolvedores para prototipagem gratuita em computação acelerada pela NVIDIA. O plano gratuito para consumidores oferece US$ 10 por mês em créditos de API. E os pesos Apache 2.0 podem ser auto-hospedados em seu próprio hardware sem custo de licença.

Quais modelos o Mistral Small 4 substituiu?

A Mistral descreve o Small 4 como o primeiro modelo a unificar Magistral para raciocínio, Pixtral para multimodalidade e Devstral para codificação agenética em um único modelo. Ele é multimodal através da capacidade Pixtral incorporada, tem uma janela de contexto de 256K e executa um total de 119B de parâmetros.

A Mistral oferece créditos para programas de startups?

A Mistral executou um programa de créditos para startups relatado historicamente em até cerca de US$ 30.000 em créditos na La Plateforme. Esse é um valor relatado, não um valor atualmente confirmado: não há página pública de autoatendimento para o programa a partir de meados de 2026, portanto, trate qualquer valor citado como não verificado. O AI Perks rastreia quais provedores têm programas ativos e o que eles valem atualmente.

A auto-hospedagem do Mistral Small 4 é mais barata que a API?

Depende do ciclo de trabalho, não do preço de lista. Tráfego intermitente ou de baixo volume favorece a API, pois GPUs ociosas são cobradas enquanto chamadas de API ociosas não são. Tráfego sustentado de alto volume favorece a auto-hospedagem. Créditos de computação mudam esse ponto de equilíbrio drasticamente, e eles são uma concessão separada dos créditos de modelo.


Inscreva-se no AI Perks →

O token mais barato é aquele que alguém já pagou. Encontre-os em AI Perks.

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.