Precios Flash de DeepSeek V4.1 y Puntos Finales de la API V4 Retirados

Precios de DeepSeek V4.1 Flash, la división entre horas pico y horas valle, el acierto y fallo de caché, y los nombres de los puntos finales deepseek-v4-flash que ahora fallan.

DeepSeekDeepSeek V4LLM PricingAI APIAI Perks
Author Avatar
Andrew
AI Perks Team
11,159

Quick Answer

DeepSeek V4.1 Flash cuesta $0.15 por millón de tokens de entrada con caché no acertado en horas no pico y $0.30 en horas pico, con entrada en caché a $0.003 en horas no pico. DeepSeek es el único proveedor importante que cobra por hora del día, y no ofrece ningún programa de crédito de inicio, a diferencia de las 194 empresas rastreadas en getaiperks.com.

¿Cuánto cuesta DeepSeek V4.1 Flash por millón de tokens?

DeepSeek V4.1 Flash cuesta $0.15 por millón de tokens de entrada con caché-miss fuera de horas pico y $0.30 en horas pico. Un token de entrada en caché cuesta $0.003 fuera de horas pico, lo que es 50 veces inferior a la propia tasa de caché-miss de Flash (derivada).

Flash llegó alrededor del 10 de septiembre de 2026 y aparece en la documentación oficial como DeepSeek-Flash. El modelo insignia DeepSeek-V4-Pro-0813 ha estado disponible de forma general desde el 13 de agosto de 2026.

Cada cifra a continuación es en USD por millón de tokens, tomada de api-docs.deepseek.com y confirmada en septiembre de 2026.

Modelo y ventanaEntrada, caché hitEntrada, caché missSalida
DeepSeek-V4-Pro-0813, fuera de horas pico$0.022$0.66$1.98
DeepSeek-V4-Pro-0813, en horas pico$0.044$1.32$3.96
DeepSeek-V4.1-Flash, fuera de horas pico$0.003$0.15No publicado
DeepSeek-V4.1-Flash, en horas pico$0.006$0.30No publicado

DeepSeek no ha publicado un precio de salida para V4.1 Flash que pueda confirmarse en la página oficial. Si ve uno citado en otro lugar, trátelo como no verificado hasta que aparezca en la tabla oficial.

DeepSeek es inusual en una segunda forma que importa más a los fundadores que el número por token: no ejecuta ningún programa de crédito para startups en absoluto. Esa brecha se cubre a continuación, y es por eso que AI Perks rastrea a los proveedores que sí ejecutan uno.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Por qué DeepSeek cobra dos precios diferentes por el mismo token

DeepSeek es el único proveedor de modelos importante que factura por hora del día. Las horas pico son de 01:00 a 04:00 y de 06:00 a 10:00 UTC entre semana, y todo lo que esté fuera de esas ventanas cuesta exactamente la mitad.

Lea esa lista de ventanas dos veces, porque hay un hueco en el medio. El tramo de 04:00 a 06:00 UTC se encuentra entre los dos bloques pico y se factura a la tarifa fuera de horas pico. No es un único bloque pico continuo de nueve horas.

Derivado de las ventanas publicadas: las horas pico cubren siete horas al día, solo entre semana, lo que equivale a 35 horas de las 168 de una semana. Aproximadamente el 79 por ciento del calendario ya está fuera de horas pico.

Eso reformula el problema. No estás tratando de encontrar la ventana barata, sino de evitar la cara. Tres cargas de trabajo en las que hacerlo es casi gratis:

  • Trabajos por lotes nocturnos. Un trabajo programado a las 08:00 UTC cae dentro de las horas pico. Moverlo a las 12:00 UTC reduce la factura a la mitad y no cambia nada más.
  • Ejecuciones de evaluación y regresión. Estas no tienen usuarios esperando, por lo que pertenecen fuera de los bloques pico por defecto.
  • Pasadas de incrustación y reindexación. Las grandes cargas de entrada únicas son lo más sensible a las horas pico que la mayoría de los equipos ejecutan.

El tráfico interactivo es la parte que no se puede mover, y debe tener un precio en horas pico en cualquier pronóstico que construya.


El caché hit es el multiplicador más grande

En DeepSeek-V4-Pro, un token de entrada en caché cuesta $0.022 por millón frente a $0.66 por un miss. Esa es una diferencia de 30 veces (derivada de la tabla anterior), y empequeñece el 2x que se obtiene por la hora.

Los dos multiplicadores se apilan, y ese apilamiento es toda la historia del perfil de costos de DeepSeek. Un token de entrada con caché-miss en horas pico a $1.32 frente a un token con caché hit fuera de horas pico a $0.022 es una brecha de 60x en el mismo modelo (derivada).

En V4.1 Flash, la relación de caché es aún más amplia: $0.15 por un miss frente a $0.003 por un hit es 50x (derivada).

Lo que esto significa en la práctica es que la estructura del prompt supera la elección del modelo. Pasar de V4-Pro a Flash reduce la entrada de caché-miss en 4.4x (derivada, $0.66 frente a $0.15). Conseguir que tu caché funcione en V4-Pro la reduce en 30x. El modelo más barato es la palanca más pequeña.

Los caché hits provienen de un prefijo estable, por lo que las reglas prácticas son aburridas y efectivas: mantenga el prompt del sistema byte a byte idéntico entre las llamadas, coloque las definiciones de herramientas y el contexto recuperado antes que cualquier cosa específica del usuario, y nunca interpola una marca de tiempo o un ID de sesión cerca de la parte superior de un prompt.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Los nombres de los endpoints que DeepSeek V4.1 Flash retiró

DeepSeek-V4.1-Flash retiró los nombres de modelo deepseek-v4-flash y deepseek-v4-flash-vision-exp. El código que aún envíe cualquiera de estas cadenas fallará.

Nombre de modelo retiradoEstado
deepseek-v4-flashRetirado con V4.1 Flash
deepseek-v4-flash-vision-expRetirado con V4.1 Flash

Este fue un cambio silencioso en lugar de una depreciación destacada, que es exactamente lo que lo hace costoso. La cadena del modelo suele ser la línea menos revisada en una integración de IA: se encuentra en una variable de entorno, un archivo de configuración, una plantilla de Terraform o un wrapper de SDK proporcionado por un tercero, y nadie la toca entre lanzamientos.

El problema más amplio es la cola larga de contenido. Los tutoriales, videos de YouTube, respuestas en foros y muestras de código generadas antes de septiembre de 2026 todavía hacen referencia a los nombres antiguos, y ninguno de ellos será corregido. Un asistente que aprendió de esas páginas seguirá sugiriéndolos.

Si ejecuta DeepSeek en producción, busque ambas cadenas en su repositorio, luego revise la configuración de su infraestructura y cualquier administrador de secretos por separado. Un nombre de modelo establecido hace seis meses en una variable de despliegue no aparecerá en una búsqueda de código.


¿Qué ha cambiado desde la guía de precios anterior de DeepSeek?

Tres cosas han invalidado partes de cada página de precios de DeepSeek escritas antes de mediados de agosto de 2026: la división entre horas pico y fuera de horas pico, la división entre V4-Pro y Flash, y los nombres de endpoints retirados.

FechaLanzamiento o cambioConfianza
24 de abril de 2026Vista previa de V4-Pro y V4-Flash: contexto de 1M de tokens, hasta 384K de salida, modos de pensamiento y sin pensamiento conmutablesMedio
31 de julio de 2026DeepSeek-V4-Flash-0731, lanzamiento estable de la línea FlashMedio
13 de agosto de 2026Disponibilidad general de DeepSeek-V4-Pro-0813Alto
16 de agosto de 2026Introducción de precios para horas pico y fuera de horas picoMedio
Alrededor del 10 de septiembre de 2026DeepSeek-V4.1-Flash, se retiraron los nombres de endpoints antiguos de FlashAlto

La cifra histórica que vale la pena conocer es el último precio conocido de Flash antes del cambio del 16 de agosto: $0.14 por millón de entrada con caché-miss y $0.28 por millón de salida. Ese es el número que la mayoría de las tablas de comparación de terceros todavía muestran. No es el precio actual y precede por completo al multiplicador de horas pico, por lo que cualquier pronóstico construido sobre él subestima una carga de trabajo con muchas horas pico en aproximadamente 2 veces (derivado: $0.14 frente a la tasa actual de $0.30 de caché-miss en horas pico es 2.1x).

Un único precio de entrada fijo para DeepSeek ahora es insignificante sin dos calificadores: qué lado de la caché y qué lado del reloj.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

DeepSeek no tiene nivel API gratuito ni programa de crédito para startups

La aplicación de chat de DeepSeek es gratuita. La API no lo es, y no hay un nivel gratuito indicado en la página oficial de precios. DeepSeek tampoco ejecuta ningún programa de crédito dedicado para startups.

Las afirmaciones de que las nuevas cuentas API reciben créditos gratuitos circulan ampliamente y se informan de manera inconsistente. No están confirmadas en la página oficial de precios, así que planifique su primer mes de gastos como si no existieran.

Los hosts de terceros son una ruta parcial para evitar esto, con la advertencia habitual de que sus precios y términos son suyos. Baseten lista la entrada de DeepSeek V4.1 Flash a $0.30 por millón y ofrece un crédito de prueba de espacio de trabajo nuevo de $30 (verifique ambos antes de presupuestar contra ellos). OpenRouter, Together y Fireworks también alojan modelos DeepSeek, y la elección entre ellos suele ser sobre enrutamiento, región y límites de tasa en lugar del precio principal.

La verdadera brecha para los fundadores es estructural. La mayoría de los proveedores de modelos e infraestructura en los que opera una startup operan alguna forma de programa de crédito, y las cantidades y términos actuales para cada uno son lo que AI Perks rastrea. DeepSeek no opera ninguno, lo que significa que DeepSeek es la única línea de su factura de IA que siempre paga en efectivo.

Ese es el argumento para tratarlo como el nivel predeterminado económico dentro de una pila en lugar de toda la pila. Enrute el trabajo de alto volumen, amigable con la caché y fuera de horas pico a DeepSeek, y enrute el trabajo que necesita razonamiento de vanguardia a un proveedor cuya factura alguien más está cubriendo. AI Perks rastrea $7.7M en créditos a través de 194 empresas, que es de donde proviene la segunda mitad.

Vea qué proveedores ejecutan programas de crédito en getaiperks.com →


Preguntas frecuentes

¿Cuánto cuesta DeepSeek V4.1 Flash?

DeepSeek V4.1 Flash cuesta $0.15 por millón de tokens de entrada con caché-miss fuera de horas pico y $0.30 en horas pico. La entrada en caché cuesta $0.003 fuera de horas pico y $0.006 en horas pico. DeepSeek no ha publicado un precio de salida confirmable para Flash, así que trate cualquier cifra de salida que encuentre en otro lugar como no verificada.

¿Cuáles son las horas pico y fuera de pico de DeepSeek?

Las horas pico son de 01:00 a 04:00 y de 06:00 a 10:00 UTC entre semana. Todo lo demás, incluido el intervalo de 04:00 a 06:00 UTC entre los dos bloques y todo el tráfico de fin de semana, está fuera de horas pico a mitad de precio. Derivado de esas ventanas, aproximadamente el 79 por ciento de la semana ya está fuera de horas pico.

¿Por qué mi llamada API deepseek-v4-flash falla de repente?

DeepSeek-V4.1-Flash retiró los nombres de modelo deepseek-v4-flash y deepseek-v4-flash-vision-exp. Cualquier código, tutorial o configuración que todavía envíe esas cadenas fallará. Revise sus variables de entorno y la configuración de despliegue, así como su código fuente, ya que los nombres de los modelos a menudo residen fuera del repositorio. El cambio se implementó silenciosamente alrededor del 10 de septiembre de 2026.

¿DeepSeek ofrece créditos API gratuitos a nuevas cuentas?

No hay un nivel API gratuito indicado en la página oficial de precios de DeepSeek. Los informes de créditos para nuevas cuentas son inconsistentes y no confirmados, así que presuspueste como si no existieran. La aplicación de chat es gratuita. Para los proveedores que sí publican programas de crédito, consulte AI Perks.

¿DeepSeek tiene un programa de crédito para startups?

No. DeepSeek no ejecuta ningún programa de crédito dedicado para startups, lo que lo convierte en una de las pocas APIs de modelos importantes que siempre paga en efectivo. La mayoría de los otros proveedores sí ejecutan uno, y AI Perks rastrea $7.7M en créditos a través de 194 empresas que los cubren.

¿Es DeepSeek V4-Pro o V4.1 Flash más barato?

Flash es más barato en todos los comparables publicados: $0.15 frente a $0.66 por millón de tokens de entrada con caché-miss fuera de horas pico, una brecha de 4.4x (derivada). Pero arreglar el caché de su prompt en V4-Pro es una palanca de 30x, por lo que la estructura del prompt importa más que la elección del modelo. Ninguno tiene un programa de crédito detrás, que es la parte que AI Perks rastrea para los proveedores que sí lo tienen.


Suscríbase en getaiperks.com →

DeepSeek es la línea más barata en su factura de IA. Obtenga las otras líneas cubiertas en getaiperks.com.

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.