¿Con qué empieza un nuevo espacio de trabajo de Baseten?
Se informa que los nuevos espacios de trabajo de Baseten comienzan con un crédito de prueba de $30, y se lee como una oferta permanente en lugar de una promoción de lanzamiento limitada.
Esa frase contiene una advertencia que la mayoría de las coberturas omiten. La cifra de $30 proviene de informes sobre los precios y los registros de cambios de Baseten, en lugar de una oferta destacada reiterada en un lugar obvio, y la página de precios no se representaba de manera consistente en verificaciones repetidas. Por lo tanto: informado, no confirmado por el proveedor. Verifique el saldo que muestra realmente su espacio de trabajo.
A qué se aplica el crédito está más claro que el número. Se aplica a las API de Modelos de Baseten, la capa de punto final compartida que aloja modelos de peso abierto como Kimi K3, GLM-5.3 y DeepSeek V4.1 Flash, la misma superficie a la que llamaría una carga de trabajo de producción. El crédito permite una prueba real, no un sandbox. AI Perks rastrea los términos actuales junto con $7.7M en créditos en 194 empresas.

¿Qué lanzó Baseten entre julio y septiembre de 2026?
Baseten dedicó el trimestre a hacer dos cosas a la vez: agregar modelos de peso abierto de vanguardia a sus API de Modelos y construir productos para los laboratorios que crean esos modelos.
| Fecha | Qué se lanzó | Para quién es |
|---|---|---|
| 27 de julio de 2026 | API de Kimi K3 del día cero | Desarrolladores |
| 29 de julio de 2026 | Baseten para Laboratorios de Modelos | Laboratorios de modelos |
| 28 de agosto de 2026 | GLM-5.3 en API de Modelos | Desarrolladores |
| 29 de agosto de 2026 | Frontier Gateway | Laboratorios de modelos |
| 3 de septiembre de 2026 | GLM-5.3-Flash con capacidad rápida | Desarrolladores |
| 10 de septiembre de 2026 | DeepSeek V4.1 Flash | Desarrolladores |
| 13 de septiembre de 2026 | Se anunciaron seis deprecaciones de modelos | Todos |
El lanzamiento de Kimi K3 es el que vale la pena entender. Moonshot AI lanzó un modelo de mezcla de expertos de peso abierto, informado en 2.8 billones a 3 billones de parámetros con visión nativa y una ventana de contexto de 1M de tokens, y Fireworks AI, Modal y Baseten enviaron cada uno una API alojada el mismo día. Fireworks y Baseten enviaron API de entrenamiento junto con inferencia. Una carrera a tres bandas el día cero significa que los mismos pesos provienen de tres proveedores con tres modelos de facturación, por lo que la elección del proveedor es una cuestión de precios, no de capacidades.
Precios de las API de Modelos de Baseten: Solo la mitad de la tabla se lee claramente
Baseten publica un precio de entrada por millón de tokens para cada API de Modelo. El lado de salida no es algo que esta página pueda citar con confianza.
| Modelo | Entrada por 1M de tokens | Salida por 1M de tokens | Notas |
|---|---|---|---|
| Kimi K3 | $3.00 | No legible de forma fiable | Peso abierto, visión nativa, contexto de 1M |
| GLM-5.3 | $1.40 | No legible de forma fiable | Contexto de 1M de tokens |
| DeepSeek V4.1 Flash | $0.30 | No legible de forma fiable | 552B parámetros, multimodal |
| GLM-5.3-Flash | No confirmado | No confirmado | Capacidad de servicio rápido dedicada |
Esas tarifas de entrada son las que la tabla de precios de Baseten mostraba al verificar. La columna de salida no se representaba de manera consistente en las recuperaciones, por lo que no aparece ninguna tarifa de salida de Baseten arriba.
Para tener una idea de la mitad faltante, mire el único proveedor que publica todo. Fireworks AI enumera Kimi K3 a $3.00 de entrada, $0.30 de entrada en caché y $15.00 de salida por millón de tokens en su nivel Estándar. La salida allí cuesta cinco veces la entrada. Cualquier modelo de costos de Baseten construido solo sobre la tasa de entrada de $3.00 es incorrecto por un múltiplo desconocido, y en cargas de trabajo con mucha generación, ese múltiplo es la mayor parte de la factura. Considere cualquier artículo que imprima un precio de salida de Baseten sin una advertencia como una suposición. AI Perks rastrea los precios de los proveedores a medida que cambian.

Seis modelos abandonan las API de Modelos de Baseten el 25 de septiembre de 2026
Baseten anunció el 13 de septiembre de 2026 que GLM-4.7, Kimi K2.7, Kimi K2.6, Inkling, Inkling-Small y DeepSeek V4 Pro se retiran de las API de Modelos el 25 de septiembre de 2026.
Esta es la parte que rompe las cosas silenciosamente. Tres tipos de lectores se ven afectados.
Cualquiera con un identificador de modelo codificado en producción. Un punto final compatible con OpenAI falla de la misma manera, ya sea que el modelo haya sido renombrado o eliminado. Fije un reemplazo antes del día 25, no después.
Cualquiera que mantenga una publicación de comparación. Cada lista de precios que incluye DeepSeek V4 Pro o la línea Kimi K2.x en Baseten se vuelve incorrecta el 25 de septiembre, y la mayoría nunca se actualizará. Suponga que un resumen anterior a septiembre tiene filas obsoletas.
Cualquiera que evalúe con puntos de referencia antiguos. Si su sistema de evaluación se dirige a Kimi K2.7 o K2.6, el sucesor en el catálogo es Kimi K3 a un precio diferente, por lo que la comparación del mes pasado no se mantiene.
Trate estos emparejamientos como juicio editorial en lugar de una ruta de migración publicada por el proveedor: GLM-4.7 a GLM-5.3, la línea Kimi K2.x a Kimi K3, DeepSeek V4 Pro a DeepSeek V4.1 Flash. Los precios se mueven en ambas direcciones en esos saltos, que es exactamente cuando un crédito de prueba demuestra su utilidad. Vea lo que está disponible actualmente en AI Perks.
Dónde ejecutar Kimi K3: Baseten, Fireworks o Modal
Tres proveedores lanzaron Kimi K3 el día del lanzamiento, y solo uno publica un precio completo por token contra el cual se puede planificar.
| Proveedor | Kimi K3 entrada por 1M | Precios completos de tokens publicados | Punto de entrada gratuito |
|---|---|---|---|
| Fireworks AI | $3.00 Estándar, $4.50 Rápido | Sí | Nivel gratuito Fire Pass, con Kimi K3 Rápido |
| Baseten | $3.00 | No, la salida no es legible | Crédito de prueba, informado en $30, una vez |
| Modal | No publicado | No | $30 por mes de cómputo general para nuevos espacios de trabajo |
Fireworks publica la imagen completa: $3.00 de entrada, $0.30 de entrada en caché y $15.00 de salida por millón en Estándar, el nivel Rápido a $4.50, $0.45 y $22.50, y una variante alojada en EE. UU. a aproximadamente un 10% de prima. Su nivel gratuito, Fire Pass, cambió a Kimi K3 Rápido como su modelo gratuito destacado con la ventana de contexto completa de 1M de tokens, la forma más económica de saber si el modelo se adapta a su tarea. El precio de entrada de Baseten coincide en $3.00. Modal confirmó precios basados en tokens en su publicación de lanzamiento sin publicar una tarifa por millón.
Las dos cifras de $30 son una coincidencia que vale la pena leer cuidadosamente: no son la misma oferta. El de Modal es una asignación de cómputo mensual recurrente que cubre el cómputo en general en lugar de una API de modelo. El de Baseten es un crédito de prueba único en un espacio de trabajo. A lo largo de una evaluación de tres meses, eso son $90 frente a $30. Ambos valen la pena: AI Perks existe porque los créditos en varias capas superan a uno grande en un solo proveedor.

Explicación de Baseten para Laboratorios de Modelos y Frontier Gateway
Estos dos lanzamientos de 2026 son los que la mayoría de los desarrolladores encontrarán irrelevantes, y saber por qué ahorra una semana de evaluación.
Baseten para Laboratorios de Modelos, anunciado el 29 de julio de 2026, es una línea de productos para laboratorios de modelos de peso cerrado que desean distribuir y monetizar sus modelos a través de la infraestructura de Baseten. Invierte la relación habitual: en lugar de que Baseten aloje modelos de peso abierto para desarrolladores, el laboratorio es el cliente y los usuarios del laboratorio son el tráfico.
Frontier Gateway, anunciado el 29 de agosto de 2026, es una puerta de enlace API administrada y multiusuario que permite a un laboratorio configurar una API de inferencia de grado de producción en la pila de Baseten en lugar de crear su propia capa de servicio.
Ninguno tiene precios publicados, ambos están orientados a laboratorios en lugar de desarrolladores, y un crédito de prueba no se aplica a ninguno de ellos. La información sobre ambos es escasa y de mediana confianza, por lo que cualquier lista detallada de funciones o punto de referencia de latencia que se encuentre en otro lugar debe considerarse no confirmada hasta que el proveedor lo indique. Para un desarrollador que llama a modelos, la consecuencia es indirecta: si los laboratorios adoptan esta ruta, más modelos de peso cerrado serán accesibles a través de puntos finales similares a los que ya llama. Vale la pena prestarle atención en AI Perks.
Cómo hacer que un crédito inicial dure
Confirme los precios de salida antes de extrapolar nada. Las tasas de entrada por sí solas subestiman el costo real en cargas de trabajo con mucha generación, y la columna de salida de Baseten es el único número que esta página no puede proporcionarle. Un presupuesto basado en $3.00 por millón para Kimi K3 es un presupuesto basado en la mitad de la factura.
Depure en los modelos de nivel Flash. GLM-5.3-Flash y la línea DeepSeek Flash existen para la latencia y el costo en lugar de la calidad máxima. La canalización de indicaciones, la lógica de reintentos y los errores de esquema no necesitan un modelo de vanguardia para aparecer, y cambiar el identificador después es un cambio de una sola línea.
Fije las versiones de sus modelos. Seis modelos se retiran el 25 de septiembre de 2026. Los identificadores con fecha evitan que una deprecación se convierta en una interrupción, y un crédito de prueba es más útil mientras se reevalúan los reemplazos.
Conserve créditos en más de una capa. Inferencia, cómputo general y acceso a modelos de vanguardia se facturan por separado. Baseten cubre el primero, Modal o un hiperescalador el segundo, un laboratorio de vanguardia el tercero.

Preguntas frecuentes
¿Cuánto valen los créditos gratuitos de Baseten?
Se informa que los nuevos espacios de trabajo comienzan con un crédito de prueba de $30, descrito como una oferta permanente en lugar de una promoción. La cifra proviene de informes en lugar de un titular de proveedor claramente establecido, por lo que considere $30 como informado y confirme el saldo que muestra su espacio de trabajo. Los términos actuales se rastrean en getaiperks.com.
¿Cuánto cobra Baseten por token?
Las tasas de entrada se leen claramente: Kimi K3 a $3.00 por millón de tokens, GLM-5.3 a $1.40 y DeepSeek V4.1 Flash a $0.30. Las tasas de salida no son confiablemente legibles en la tabla de precios pública, y esta página no intentará adivinarlas. Confirme los precios de salida en la consola antes de modelar una factura mensual.
¿Qué modelos está deprecando Baseten en septiembre de 2026?
GLM-4.7, Kimi K2.7, Kimi K2.6, Inkling, Inkling-Small y DeepSeek V4 Pro se retiran de las API de Modelos de Baseten el 25 de septiembre de 2026, anunciado el 13 de septiembre. Los reemplazos más cercanos en el catálogo son GLM-5.3, Kimi K3 y DeepSeek V4.1 Flash, aunque ese emparejamiento es editorial en lugar de una ruta de migración publicada por el proveedor.
¿Es Baseten más barato que Fireworks para Kimi K3?
En tokens de entrada, ambos listan $3.00 por millón, por lo que están igualados en el único número que se compara limpiamente. Fireworks también publica $0.30 de entrada en caché y $15.00 de salida por millón en su nivel Estándar. Hasta que se confirme la tasa de salida de Baseten, no es posible una comparación completa de costos en ninguna dirección.
¿Qué es Kimi K3 y por qué tres proveedores lo lanzaron al mismo tiempo?
Kimi K3 es el modelo de mezcla de expertos de peso abierto de Moonshot AI, informado en 2.8 billones a 3 billones de parámetros con visión nativa y una ventana de contexto de 1M de tokens, lanzado el 27 de julio de 2026. Fireworks AI, Modal y Baseten enviaron cada uno una API alojada el mismo día. Los pesos abiertos lo hacen posible: ningún proveedor necesita permiso, por lo que el día del lanzamiento se convierte en una carrera de precios en lugar de una exclusividad.
¿Puedo combinar créditos de Baseten con otros créditos de IA?
Sí, y es el enfoque normal. Los créditos de inferencia, cómputo general y acceso a modelos de vanguardia son tres facturas separadas con tres proveedores separados, y tener uno no bloquea a otro. Baseten cubre la capa de inferencia, Modal o un hiperescalador cubre el cómputo, y un laboratorio de vanguardia cubre las llamadas directas a modelos. AI Perks rastrea $7.7M en 194 empresas en getaiperks.com.
Suscríbase en getaiperks.com →
Fije las versiones de sus modelos. Deje que otra persona pague por los tokens.