DeepSeek Context Caching 2026: El Descuento de Entrada 30x

DeepSeek cobra 30 veces menos por entrada en caché que por un error de caché y reduce a la mitad cada precio en horas valle. Las tarifas V4-Pro y V4.1-Flash, explicadas correctamente.

DeepSeekContext CachingLLM PricingAI API CostsAI Perks
Author Avatar
Andrew
AI Perks Team
9,847

Quick Answer

Un acierto en caché de DeepSeek-V4-Pro cuesta $0.022 por millón de tokens de entrada fuera de horas pico frente a $0.66 por un fallo de caché, un descuento de 30 veces en el mismo modelo. DeepSeek también reduce a la mitad cada precio fuera de las horas pico, por lo que un token en caché fuera de horas pico es 60 veces más barato que un fallo de caché en horas pico. Los créditos de proveedores que ejecutan programas para startups se rastrean en getaiperks.com.

Cuánto Cuesta Realmente un Golpe de Caché de DeepSeek

En DeepSeek-V4-Pro, un token de entrada servido desde caché cuesta $0.022 por millón fuera de horas pico frente a $0.66 por un fallo de caché. Esto es un descuento de 30x por enviar el mismo prefijo dos veces.

La mayoría de las páginas de precios cotizan un número de entrada y siguen adelante. DeepSeek tiene cuatro, porque dos multiplicadores separados se aplican a cada llamada individual: si el prefijo golpeó la caché y a qué hora del día lo enviaste.

Modelo y ventanaEntrada con golpe de cachéEntrada con fallo de cachéSalida
DeepSeek-V4-Pro-0813, fuera de horas pico$0.022$0.66$1.98
DeepSeek-V4-Pro-0813, horas pico$0.044$1.32$3.96
DeepSeek-V4.1-Flash, fuera de horas pico$0.003$0.15no verificado
DeepSeek-V4.1-Flash, horas pico$0.006$0.30no verificado

Todas las cifras en USD por millón de tokens, de la documentación oficial de la API a partir de septiembre de 2026. Los precios de salida de V4.1-Flash no están verificados aquí, así que consulta la página oficial antes de presupuestar con ellos.

La relación de Flash es aún más amplia que la del buque insignia: $0.003 frente a $0.15 es una brecha de 50x (derivada de las tarifas anteriores). AI Perks rastrea este tipo de mecánica del proveedor junto con los programas de crédito que la compensan.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Horas Pico y Fuera de Horas Pico: El Único Proveedor que Cobra por Hora

Las horas pico de DeepSeek son de 01:00 a 04:00 y de 06:00 a 10:00 UTC entre semana. Todo lo demás, incluyendo todo el sábado y domingo, se factura exactamente a mitad de precio.

Ningún otro proveedor importante de modelos fija precios por hora del día, lo que lo convierte en la palanca más pasada por alto en el trabajo de costos de LLM. Ninguna guía de optimización escrita para OpenAI o Anthropic tiene ninguna razón para mencionarlo.

Derivado de esas ventanas: las horas pico son 7 horas al día durante 5 días laborables, es decir, 35 de las 168 horas de la semana. Aproximadamente el 79% del calendario ya está fuera de horas pico, por lo que la mayoría de los equipos obtienen el descuento por accidente y podrían obtener más de él a propósito.

Dónde te encuentras decide cuánto de tu jornada laboral está expuesta:

Ubicación del equipoVentanas pico, hora localExposición del día laborable
Costa Este de EE. UU. (UTC-4)21:00-00:00, 02:00-06:00Ninguna, toda la jornada laboral está fuera de horas pico
Costa Oeste de EE. UU. (UTC-7)18:00-21:00, 23:00-03:00Ninguna
Europa Central (UTC+2)03:00-06:00, 08:00-12:00Toda la mañana
India (UTC+5:30)06:30-09:30, 11:30-15:30La mayor parte de la jornada laboral
China (UTC+8)09:00-12:00, 14:00-18:00Casi toda

Las horas locales se convierten desde las ventanas UTC publicadas en los desplazamientos mostrados, y el horario de verano las mueve una hora. El patrón no es un accidente: las ventanas pico coinciden con la jornada laboral china, por lo que el tráfico interactivo de un equipo de EE. UU. aterriza en la mitad barata del reloj de forma gratuita.


Apilando Ambos Descuentos: Una Diferencia de 60x en un Solo Modelo

Un token de entrada en caché fuera de horas pico a $0.022 frente a un fallo de caché en horas pico a $1.32 es una diferencia de 60x en una salida idéntica del mismo modelo.

Así es como se ve en una carga de trabajo de agente realista: un contexto de 200.000 tokens reenviado 1.000 veces al día, es decir, 200 millones de tokens de entrada diarios en V4-Pro.

EscenarioTarifa por 1MCosto de entrada diario
Horas pico, cada llamada es un fallo de caché$1.32$264.00
Fuera de horas pico, cada llamada es un fallo de caché$0.66$132.00
Horas pico, cada llamada es un golpe de caché$0.044$8.80
Fuera de horas pico, cada llamada es un golpe de caché$0.022$4.40

Las cuatro filas se derivan multiplicando las tarifas publicadas por 200. La diferencia entre la fila superior y la inferior es aproximadamente $260 al día, o alrededor de $95,000 al año, en una carga de trabajo que no cambia en absoluto.

Dos cosas se derivan de ello que la mayoría de los análisis de costos pasan por alto:

Una insignia en caché supera a un modelo pequeño sin caché. La entrada en caché de V4-Pro a $0.022 fuera de horas pico es aproximadamente 7 veces más barata que la entrada sin caché de V4.1-Flash a $0.15 (derivado). Reducir el modelo para ahorrar dinero es el movimiento equivocado si el problema real es una caché que nunca calentaste.

La salida nunca se almacena en caché. A $1.98 fuera de horas pico, un token de salida cuesta aproximadamente 90 veces más que un token de entrada en caché (derivado). Una vez que la caché funciona, ya no tienes una factura de entrada, tienes una factura de salida, y cada ahorro adicional proviene de respuestas más cortas o presupuestos de pensamiento limitados. Los equipos que financian esa factura de salida con créditos de proveedores pueden comparar lo que está disponible en getaiperks.com.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Qué Cambió Desde Nuestra Guía Anterior de Precios de DeepSeek

Tres cosas cambiaron en 2026: V4-Pro-0813 alcanzó la disponibilidad general el 13 de agosto, los precios de horas pico y fuera de horas pico reemplazaron las tarifas planas a mediados de agosto, y V4.1-Flash aterrizó alrededor del 10 de septiembre.

Nuestra página anterior de precios de DeepSeek cotiza tarifas planas por token sin componente de hora del día. Esas son anteriores al cambio y deben leerse como historia.

El cronograma, con la confianza marcada honestamente:

  • 24 de abril de 2026 (confianza media): Vista previa de V4-Pro y V4-Flash, con una ventana de contexto de 1M de tokens, hasta 384K tokens de salida y modos de pensamiento y no pensamiento conmutables.
  • 31 de julio de 2026 (confianza media): DeepSeek-V4-Flash-0731, la versión estable de Flash. El último precio conocido antes del cambio fue de $0.14 por millón de entrada con fallo de caché y $0.28 por millón de salida, ambos planos. Solo histórico.
  • 13 de agosto de 2026: Disponibilidad general de DeepSeek-V4-Pro-0813, el modelo insignia actual de razonamiento y agentes.
  • Alrededor del 10 de septiembre de 2026: DeepSeek-V4.1-Flash, listado en la documentación como "DeepSeek-Flash".

Si estás trabajando con un tutorial o un modelo de costos escrito antes de agosto de 2026, cada cifra de entrada en él es incorrecta en ambos sentidos: demasiado alta para un golpe de caché, demasiado baja para un fallo de caché en horas pico.


El Cambio de Nombre del Endpoint que Rompe Código Antiguo

DeepSeek-V4.1-Flash retiró silenciosamente los nombres de modelo deepseek-v4-flash y deepseek-v4-flash-vision-exp. Las solicitudes que sigan pasando estas cadenas fallarán.

Este es el tipo de cambio que aparece como un incidente de producción en lugar de un ticket de migración, porque el nombre del modelo generalmente se encuentra en un archivo de configuración que nadie ha abierto en meses. Las muestras de código más antiguas, los envoltorios de SDK y los tutoriales de terceros todavía hacen referencia a los nombres retirados.

Vale la pena hacerlo antes de tu próximo despliegue:

  • Busca en todo el repositorio ambas cadenas retiradas, incluida la configuración de infraestructura y los cuadernos.
  • Verifica cualquier SDK o framework de agente que tenga codificado un modelo DeepSeek predeterminado.
  • Confirma la ruta de visión por separado, ya que el endpoint de visión experimental también cambió de nombre.
  • Vuelve a ejecutar tu modelo de costos después, porque el reemplazo se basa en el nuevo calendario de horas pico y fuera de horas pico.

Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Nivel Gratuito y Créditos de DeepSeek: Lo Que Es Realmente Cierto

La aplicación de chat de DeepSeek es gratuita. La API no lo es, y no hay un nivel gratuito declarado en la página de precios oficial.

Aquí es donde la mayoría de los artículos se equivocan. Las afirmaciones de que las nuevas cuentas de API reciben créditos gratuitos circulan ampliamente, se informan de manera inconsistente y no están confirmadas en la página de precios oficial. Si necesitas un saldo inicial, asume que lo estás pagando.

Más importante para los fundadores: DeepSeek no ejecuta un programa dedicado de crédito para startups. No hay solicitud, ni nivel basado en etapas, ni vía de socio. El bajo precio por token es toda la oferta, lo que representa una brecha real si estás ensamblando una pila de créditos.

Esa brecha es exactamente la razón por la que la decisión de enrutamiento importa. Muchos proveedores ejecutan programas para startups, y AI Perks rastrea $7.7 millones en créditos en 194 empresas que cubren a las que lo hacen. El patrón práctico es dirigir el tráfico de alto volumen y amigable con la caché a DeepSeek a $0.022 por millón y gastar los créditos otorgados en los proveedores más caros, donde un token gratuito vale mucho más.


Comprar DeepSeek a Alguien Más

Los hosts de terceros no replican el horario pico y fuera de horas pico de DeepSeek, lo que significa que pueden reducir el precio de la API de primera parte durante las horas pico y perder mucho frente a ella fuera de horas pico.

Baseten lista la entrada DeepSeek V4.1 Flash a $0.30 por millón (confianza media, verifica antes de presupuestar), y la cifra de salida no se confirmó de manera confiable. Baseten también tiene un crédito de prueba de espacio de trabajo nuevo de $30 permanente.

Nota lo que equivale $0.30: es exactamente la tasa de fallo de caché en horas pico de DeepSeek, y el doble de la tasa fuera de horas pico (derivado). Para un equipo de EE. UU. o Europa cuyo tráfico cae principalmente fuera de horas pico de todos modos, una tarifa plana de terceros no es obviamente un ahorro.

OpenRouter, Together y Fireworks también alojan modelos DeepSeek. No estamos cotizando sus precios aquí porque no los hemos verificado, y tampoco debería hacerlo nada más que leas. Sin embargo, el intercambio cualitativo es consistente:

  • API de primera parte: el único lugar donde se aplica la pila completa de golpes de caché y fuera de horas pico, y la ruta más barata por un amplio margen cuando ambas funcionan.
  • Hosts de terceros: tarifas planas, diferentes regiones, facturación unificada y, por lo general, sin exposición al nivel de golpe de caché de DeepSeek.
  • Agregadores: útiles para failover, a un precio que debes medir en lugar de asumir.

Calcula tu propio tráfico frente a ambos, luego compara el resultado con los créditos disponibles en otros proveedores en getaiperks.com. Un token gratuito vence a uno barato.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Preguntas Frecuentes

¿Cuánto más barato es un golpe de caché de DeepSeek?

En DeepSeek-V4-Pro, un golpe de caché cuesta $0.022 por millón de tokens de entrada fuera de horas pico frente a $0.66 por un fallo de caché, una diferencia de 30x. En V4.1-Flash, la brecha es aún mayor, $0.003 frente a $0.15, una diferencia de 50x (derivada). Las tarifas son de la documentación oficial de la API a partir de septiembre de 2026.

¿Cuándo son las horas pico de DeepSeek?

Las horas pico son de 01:00 a 04:00 y de 06:00 a 10:00 UTC solo entre semana. Todo lo demás, incluidos ambos días de fin de semana, se factura a la mitad de la tarifa pico. Eso equivale a aproximadamente el 79% de la semana fuera de horas pico (derivado), por lo que los equipos con sede en EE. UU. obtienen el descuento durante toda su jornada laboral sin cambiar nada.

¿DeepSeek tiene un nivel gratuito de API?

No se indica ningún nivel gratuito de API en la página de precios oficial. La aplicación de chat para consumidores es gratuita, pero la API se paga desde el primer token. Los informes de créditos gratuitos para nuevas cuentas son inconsistentes y no están confirmados. Los proveedores que otorgan créditos se rastrean en getaiperks.com.

¿DeepSeek ofrece créditos para startups?

DeepSeek no tiene un programa dedicado de crédito para startups. El bajo precio por token es toda la oferta. Para los fundadores que construyen una pila de créditos, esa es una brecha que vale la pena llenar en otro lugar: AI Perks cubre $7.7 millones en créditos en 194 empresas de los proveedores que sí ejecutan programas.

¿Por qué mi llamada a la API de DeepSeek dejó de funcionar?

La causa más probable es el nombre del modelo. DeepSeek-V4.1-Flash retiró los nombres de endpoint deepseek-v4-flash y deepseek-v4-flash-vision-exp, y los tutoriales y archivos de configuración más antiguos todavía hacen referencia a ellos. Busca ambas cadenas en tu repositorio, incluidos los SDK y cuadernos de terceros, luego vuelve a verificar tu modelo de costos con las tarifas actuales.

¿Debería usar DeepSeek V4-Pro o V4.1-Flash?

Haz la aritmética antes de asumir que Flash es más barato. La entrada en caché de V4-Pro a $0.022 fuera de horas pico es aproximadamente 7 veces más barata que la entrada sin caché de Flash a $0.15 (derivado), por lo que un buque insignia bien cacheado puede superar a un modelo pequeño sin caché en la línea de entrada por completo. El volumen de salida, no el tamaño del modelo, suele decidir la factura.


Suscríbete en getaiperks.com →

Caché el prefijo, envía fuera de horas pico y deja que los créditos de otra persona cubran el resto.

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.