Mistral Small 4 Precios 2026: Costos Reales y Rutas Gratuitas

Mistral Small 4 cuesta $0.15 por millón de tokens de entrada y $0.60 por millón de salida. Especificaciones Apache 2.0, matemáticas de carga de trabajo real y formas gratuitas de ejecutarlo.

Mistral Small 4Mistral AILLM PricingOpen WeightsAI Perks
Author Avatar
Andrew
AI Perks Team
12,694

Quick Answer

Mistral Small 4 cuesta $0.15 por millón de tokens de entrada y $0.60 por millón de tokens de salida en la API de Mistral. Los pesos tienen licencia Apache 2.0, por lo que el autoalojamiento no conlleva ninguna tarifa de licencia. Existen rutas gratuitas a través de la prototipación de NVIDIA y el crédito de API de $10 por mes en Mistral Free. Los programas de crédito se rastrean en getaiperks.com.

¿Cuánto Cuesta Mistral Small 4?

Mistral Small 4 se lanzó el 16 de marzo de 2026 a $0.15 por millón de tokens de entrada y $0.60 por millón de tokens de salida en la API de Mistral. Los pesos se distribuyen bajo la licencia Apache 2.0, por lo que el auto-alojamiento no tiene ninguna tarifa de licencia.

Esa combinación es toda la historia. Un modelo tan barato en la API suele ser cerrado, y un modelo tan abierto suele no tener un punto final de primer nivel que valga la pena usar. Small 4 tiene ambos.

Esto es lo que Mistral publicó en el lanzamiento:

AtributoMistral Small 4
Fecha de lanzamiento16 de marzo de 2026
Parámetros totales119B
Ventana de contexto256K tokens
LicenciaApache 2.0
ModalidadMultimodal, a través de la capacidad Pixtral integrada en los pesos
Precio de API, entrada$0.15 por millón de tokens
Precio de API, salida$0.60 por millón de tokens

Cada cifra anterior proviene de la propia publicación de lanzamiento de Mistral. AI Perks rastrea lo que los mismos proveedores ofrecen en créditos además del precio de lista.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Qué Cambia Realmente la Fusión de Magistral, Pixtral y Devstral

Small 4 es el primer modelo de Mistral en integrar razonamiento, multimodalidad y codificación de agentes en un único conjunto de pesos. Mistral lo describe como la unificación de Magistral para el razonamiento, Pixtral para la multimodalidad y Devstral para la codificación de agentes.

El efecto práctico es en tu arquitectura, no en tu hoja de cálculo de benchmarks. Antes de esto, un equipo que realizaba análisis de documentos, generación de código y razonamiento utilizaba tres familias de modelos, tres conjuntos de indicaciones y tres líneas de facturación.

Tres cosas colapsan en una:

Un punto final para cargas de trabajo mixtas. La capacidad multimodal que antes estaba en Pixtral ahora reside en los mismos pesos, por lo que el trabajo con medios mixtos ya no necesita un segundo modelo detrás de un segundo punto final.

Un conjunto de pesos para alojar. Si te auto-alojas, anteriormente descargabas y servías puntos de control separados. Ahora es uno solo.

Un precio para modelar. La previsión de costos en una canalización mixta deja de requerir una combinación ponderada de tres listas de tarifas.

La ventana de contexto de 256K es lo que hace que la consolidación sea útil. Alimentar un documento largo y una base de código en la misma solicitud solo es interesante si la ventana contiene ambos.


Precios de Mistral Small 4: Cuánto Cuestan las Cargas de Trabajo Reales

A $0.15 de entrada y $0.60 de salida, una carga de trabajo de producción seria se sitúa en la decena de dólares al mes, no en los miles. La aritmética a continuación es el precio de lista multiplicado por el volumen, nada más.

Carga de trabajo mensualTokens de entradaTokens de salidaCosto al precio de lista
Prototipo o proyecto paralelo5M1M$1.35
Chatbot de soporte50M10M$13.50
Canalización de análisis de documentos300M15M$54.00
Agente de codificación, un desarrollador500M100M$135.00
RAG de producción a escala2B200M$420.00

El multiplicador de salida es el número a tener en cuenta. La salida cuesta 4 veces la entrada, por lo que un agente locuaz que narra su razonamiento cuesta múltiplos de uno conciso que realiza el mismo trabajo.

Esa relación también es la razón por la que el contexto largo es más barato de lo que parece. Poner 200K tokens de documentos en una indicación cuesta $0.03. Es la respuesta la que se factura.

Los créditos cambian esta matemática, y las rutas gratuitas en la siguiente sección cubren los primeros millones de tokens directamente.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Las Rutas Gratuitas a Mistral Small 4

No existe un nivel gratuito dedicado de API para Mistral Small 4. Hay tres rutas separadas, gratuitas o casi gratuitas, para ejecutarlo, y se adaptan a diferentes etapas.

RutaCuánto cuestaQué obtienes
Prototipado para desarrolladores de NVIDIAGratisPrototipado gratuito en computación acelerada por NVIDIA, mencionado en la publicación de lanzamiento de Mistral
Plan gratuito para consumidores de Mistral$0$10 al mes en créditos de API
Pesos abiertos auto-alojadosTu propia computaciónApache 2.0, sin tarifa por token
Programas de crédito de proveedoresGratis de mantenerRastreado en AI Perks

Mistral no ha publicado asignaciones de crédito de planes de pago más allá de esa cifra de $10, por lo que cualquier tabla de créditos por nivel que encuentres en otro lugar es una reconstrucción de alguien en lugar de un número del proveedor.

Los $10 al mes de crédito en el plan gratuito para consumidores es el infravalorado. Ejecútalo a través del precio de lista anterior y compra aproximadamente 66 millones de tokens de entrada si lo gastas puramente en entrada. Supongamos una proporción de lectura/escritura de 5:1 y se acerca a 44 millones de tokens. Ambos son cálculos sobre la tarifa publicada, no una asignación de tokens publicada, pero para un marco de evaluación o una herramienta interna de bajo volumen es un presupuesto real en lugar de un gesto de tokens.

Una advertencia que vale la pena mencionar claramente: estos son créditos del plan de consumidor, y Mistral no ha publicado garantías sobre cómo se comporta la asignación bajo carga sostenida. Trátalo como presupuesto de evaluación, no como capacidad de producción.


Apache 2.0: Qué Cambia Realmente el Auto-Alojamiento

Apache 2.0 significa que puedes ejecutar, modificar, ajustar y desplegar comercialmente Mistral Small 4 sin tarifa de licencia ni informe de uso. No significa que ejecutarlo sea gratis.

La factura se mueve en lugar de desaparecer. Los pesos abiertos se ejecutan en cualquier pila de inferencia que ya operes, y cada una de esas pilas se ejecuta en hardware por el que alguien paga. Mistral no ha publicado un modelo de costos de implementación para Small 4, por lo que la comparación a continuación trata sobre tu propio ciclo de trabajo en lugar de una cifra del proveedor.

El punto de equilibrio lo establece el ciclo de trabajo, no el precio de lista:

  • Tráfico intermitente o de bajo volumen favorece la API, porque las GPUs inactivas facturan a tarifa completa mientras que una llamada inactiva a la API no factura nada.
  • Tráfico sostenido de alto volumen favorece el auto-alojamiento, porque el precio por token escala linealmente mientras que una GPU reservada no lo hace.
  • Requisitos de residencia de datos o air-gapped lo deciden directamente, y el precio no es la variable.

La parte genuinamente útil de una versión de Apache 2.0 no es ahorrar $0.15 por millón de tokens. Es que nadie puede depreciar el modelo debajo de ti. Un modelo cerrado en el que construiste un producto puede ser retirado según el calendario del proveedor. Este no.

Los créditos de computación son lo que hacen que el auto-alojamiento sea barato, y son una subvención separada de los créditos del modelo. AI Perks cubre ambas capas.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Qué No Ha Publicado Mistral

Tres cosas sobre Small 4 y sus hermanos se afirman comúnmente en línea con más confianza de la que el proveedor se ha ganado. Esto es lo que realmente no está confirmado.

Créditos para startups. Mistral ha ejecutado un programa de créditos para startups, reportado históricamente hasta alrededor de $30,000 en créditos de La Plateforme. Esa cifra se reporta en lugar de confirmarse actualmente: a mediados de 2026 no hay una página pública de autoservicio para el programa, por lo que cualquier número específico que veas citado debe considerarse no verificado hasta que Mistral republique uno. AI Perks rastrea qué proveedores de modelos tienen programas de crédito activos.

Mistral OCR 4. Se informa de un modelo de inteligencia de documentos con fecha 23 de junio de 2026, pero no se ha confirmado en una página de precios con versiones, por lo que se debe leer el modelo y su fecha como reportados en lugar de definitivos. El enfoque general de precios de Mistral para OCR es la facturación por cada 1,000 páginas, y la tarifa exacta por cada 1,000 páginas para esta versión no está confirmada. Cualquiera que cite un número preciso está adivinando.

Límites del nivel gratuito. No existe un nivel gratuito dedicado de API para Small 4. La asignación de $10 al mes se encuentra en el Plan Gratuito para consumidores, y Mistral no ha publicado límites de velocidad para él, por lo que no hay un techo publicado contra el cual diseñar.

Si una página muestra una cifra que el proveedor nunca publicó, será incorrecta en el momento en que el proveedor publique una.


Preguntas Frecuentes

¿Cuánto cuesta Mistral Small 4 por millón de tokens?

Mistral Small 4 cuesta $0.15 por millón de tokens de entrada y $0.60 por millón de tokens de salida en la API de Mistral. La salida se factura a 4x la entrada, por lo que los agentes verbosos cuestan considerablemente más que los concisos para el mismo trabajo. El auto-alojamiento de los pesos Apache 2.0 no tiene tarifa por token, solo costo de computación.

¿Hay un nivel gratuito de API de Mistral AI en 2026?

No existe un nivel gratuito dedicado de API para Mistral Small 4. El Plan Gratuito para consumidores incluye $10 al mes en créditos de API. Mistral no ha publicado límites de velocidad para esa asignación, y tampoco ha publicado asignaciones de crédito para sus niveles de pago para consumidores, por lo que las cifras por nivel citadas no están verificadas.

¿Puedo ejecutar Mistral Small 4 gratis?

Sí, a través de tres rutas. La publicación de lanzamiento de Mistral dirige a los desarrolladores al prototipado gratuito en computación acelerada por NVIDIA. El Plan Gratuito para consumidores ofrece $10 al mes en créditos de API. Y los pesos Apache 2.0 se pueden auto-alojar en tu propio hardware sin costo de licencia.

¿Qué modelos reemplazó Mistral Small 4?

Mistral describe Small 4 como el primer modelo que unifica Magistral para el razonamiento, Pixtral para la multimodalidad y Devstral para la codificación de agentes en un solo modelo. Es multimodal a través de la capacidad Pixtral integrada, tiene una ventana de contexto de 256K y ejecuta 119B parámetros totales.

¿Ofrece Mistral créditos para programas de startups?

Mistral ha ejecutado un programa de créditos para startups reportado históricamente hasta alrededor de $30,000 en créditos de La Plateforme. Esa es una cifra reportada, no una confirmada actualmente: no hay una página pública de autoservicio para el programa a mediados de 2026, por lo que cualquier cantidad citada debe considerarse no verificada. AI Perks rastrea qué proveedores tienen programas activos y cuánto valen actualmente.

¿Es más barato auto-alojar Mistral Small 4 que usar la API?

Depende del ciclo de trabajo, no del precio de lista. El tráfico intermitente o de bajo volumen favorece la API, ya que las GPUs inactivas se facturan mientras que las llamadas inactivas a la API no. El alto volumen sostenido favorece el auto-alojamiento. Los créditos de computación cambian drásticamente ese punto de equilibrio, y son una subvención separada de los créditos del modelo.


Suscríbete en AI Perks →

El token más barato es el que alguien más ya pagó. Encuéntralos en AI Perks.

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.