¿Es DeepSeek más barato directo o a través de un proveedor?
Directo, en casi todos los casos, y la razón es estructural en lugar de un asunto de margen. El bajo precio de DeepSeek proviene de dos multiplicadores que solo existen en la API de primer nivel: una ventana de horario no pico con mitad de precio y un acierto de caché que cuesta aproximadamente 30 veces menos que un fallo de caché en V4-Pro. Los revendedores facturan una tarifa única por token, por lo que ambos multiplicadores desaparecen en la puerta.
Esa es toda la decisión de enrutamiento en una línea. Un proveedor no le está cobrando una modesta prima sobre el mismo precio, le está cobrando un precio fijo contra una factura que podría haber sido una fracción de la misma.
La diferencia es mayor de lo que cualquiera que enrute en una tabla de clasificación adivinaría. Los equipos que buscan este tipo de economía unitaria también suelen buscar créditos gratuitos, que AI Perks rastrea en 194 empresas y $7.7M en créditos.

Los Cuatro Precios que DeepSeek Cobra por el Mismo Token
DeepSeek-V4-Pro tiene cuatro precios de entrada diferentes dependiendo de la hora del día y si el prefijo de su prompt fue almacenado en caché. Ningún otro proveedor importante tiene precios de esta manera.
Las horas pico son de 01:00 a 04:00 y de 06:00 a 10:00 UTC los días laborables. Todo lo que esté fuera de esas ventanas, incluido todo el fin de semana, está en horario no pico a mitad de precio.
| DeepSeek-V4-Pro-0813 | Horario no pico (por 1M) | Horario pico (por 1M) |
|---|---|---|
| Entrada, acierto de caché | $0.022 | $0.044 |
| Entrada, fallo de caché | $0.66 | $1.32 |
| Salida | $1.98 | $3.96 |
| DeepSeek-V4.1-Flash | Horario no pico (por 1M) | Horario pico (por 1M) |
|---|---|---|
| Entrada, acierto de caché | $0.003 | $0.006 |
| Entrada, fallo de caché | $0.15 | $0.30 |
Los dos multiplicadores se suman. Un token de entrada en horario no pico con caché por $0.022 frente a un fallo de caché en horario pico por $1.32 es una diferencia de 60x en el mismo modelo (derivado de la tabla anterior). En Flash, la diferencia es aún mayor: $0.003 frente a $0.30 es 100x, también derivado.
Las horas pico suman 7 horas al día en 5 días laborables, por lo que aproximadamente el 79% de la semana se factura a la tarifa de horario no pico por defecto (derivado). No tiene que hacer nada ingenioso para caer allí. Tiene que evitar hacer algo descuidado.
Qué Cambió en los Precios de DeepSeek en Agosto de 2026
El propio modelo de precios cambió el 16 de agosto de 2026, cuando una tarifa plana por token dio paso a la división entre horario pico y no pico. Cualquier comparación de costos escrita antes de esa fecha describe una lista de tarifas que ya no existe.
La línea de tiempo que importa:
- 24 de abril de 2026: Vista previa de V4-Pro y V4-Flash, con contexto de 1M de tokens y modos de pensamiento conmutables (confianza: media).
- 31 de julio de 2026: DeepSeek-V4-Flash-0731 se lanza como la versión estable de Flash. La última tarifa plana conocida fue de $0.14 por 1M de entrada con fallo de caché y $0.28 de salida (confianza: media, solo histórico).
- 13 de agosto de 2026: DeepSeek-V4-Pro-0813 alcanza la disponibilidad general.
- Alrededor del 10 de septiembre de 2026: DeepSeek-V4.1-Flash llega, listado en la documentación como DeepSeek-Flash.
Compare la antigua tarifa plana de $0.14 con los precios actuales de Flash y el diseño del cambio se vuelve obvio. La entrada con fallo de caché en horario no pico a $0.15 se sitúa casi exactamente donde estaba la antigua tarifa plana, mientras que el horario pico cuesta $0.30, poco más del doble (derivado). DeepSeek no aumentó los precios, sino que instaló un cargo por congestión.

¿Cuánto Cuestan los Proveedores de Terceros y Por Qué No Pueden Igualar?
Un proveedor compra capacidad y vende tokens, por lo que tiene que cotizar un número que cubra su peor hora. Ese número se sitúa por encima de la tarifa de horario no pico de DeepSeek y astronómicamente por encima de su tarifa de horario no pico con caché.
Dos cosas fallan en la reventa:
El precio por hora del día no sobrevive. Un proveedor que atiende a todas las zonas horarias no puede trasladar un descuento anclado en UTC sin arbitraje o una página de precios invendible.
El estado de la caché es por inquilino. El almacenamiento en caché del prefijo vale la pena cuando el mismo prompt del sistema llega al mismo backend repetidamente. Enrute ese prompt a través de un agregador que equilibre la carga entre proveedores y pagará precios de fallo de caché en un prompt que ha enviado mil veces.
Verifique usted mismo cualquier precio de proveedor antes de comprometerse, ya que los números publicados cambian y la mayoría de las publicaciones comparativas citan tarifas que expiraron hace semanas. Una cifra resume la brecha claramente. Baseten lista la entrada DeepSeek V4.1 Flash a $0.30 por 1M (confianza: media, verifique antes de citar), junto con un crédito de prueba de $30 para un nuevo espacio de trabajo. La cifra de salida no se confirmó de manera confiable, por lo que no se cita aquí.
| Ruta | Precio por hora del día | Descuento de caché de prefijo | Señal de precio verificada |
|---|---|---|---|
| DeepSeek de primer nivel, V4-Pro | Sí, oscilación de 2x | Sí, 30x | $0.66 entrada / $1.98 salida, horario no pico |
| DeepSeek de primer nivel, V4.1-Flash | Sí, oscilación de 2x | Sí, 50x (derivado) | $0.15 entrada, horario no pico |
| Baseten | No publicado | No publicado | $0.30 entrada, V4.1 Flash |
| OpenRouter, Together AI, Fireworks | No publicado | Varía según el proveedor | Verificar en la fuente |
Frente a los $0.30 listados por Baseten, la entrada con fallo de caché en horario no pico de DeepSeek a $0.15 es la mitad del precio, y su entrada con caché en horario no pico a $0.003 es 100 veces más barata (derivado). Eso no es un revendedor que sea codicioso. Es una tarifa fija que se encuentra con una tarifa de cuatro niveles.
OpenRouter, Together AI y Fireworks alojan modelos DeepSeek. Sus precios no se cotizan aquí porque no fueron verificados, y un precio desactualizado en una comparación de costos es peor que ningún precio.
Cuándo Pagar el Margen del Proveedor Es la Decisión Correcta
Rutee a través de un proveedor cuando lo que está comprando no son tokens. Hay cuatro situaciones en las que la prima es racional.
La adquisición bloquea el punto final de China. Si su revisión de seguridad no aprueba la llamada directa a DeepSeek, el proveedor no es un margen, es la única forma de que envíe. Esta es la razón más común por la que los equipos enrutan DeepSeek a través de un proveedor de EE. UU.
Necesita una factura y una clave para muchos modelos. Un agregador que falla de DeepSeek a un punto final Llama o Qwen cuando algo está caído está vendiendo tiempo de actividad, no precio.
Su tráfico está en horario pico y sin caché de todos modos. Un producto interactivo de bajo volumen que sirve las mañanas europeas se encuentra dentro de la ventana pico con prompts cortos y únicos. Esa carga de trabajo renuncia a ambos descuentos, lo que reduce considerablemente la ventaja de primer nivel.
Todavía está evaluando. Un crédito de prueba como los $30 de Baseten no cuesta nada y responde a la pregunta de calidad antes de conectar un segundo proveedor. El crédito de evaluación gratuito es la forma más barata de diligencia, y AI Perks existe para catalogar dónde está disponible.

El Cambio de Nombre del Punto Final que Rompe las Configuraciones de Enrutamiento
DeepSeek-V4.1-Flash retiró silenciosamente los nombres de modelo deepseek-v4-flash y deepseek-v4-flash-vision-exp. Las muestras de código y los tutoriales escritos antes de septiembre de 2026 todavía los hacen referencia, y esas llamadas ahora fallan.
Esto afecta más duramente a la configuración de la que trata este artículo. Una configuración de enrutador contiene identificadores de modelo para varios proveedores en un archivo, la mayoría estables durante años, por lo que un nombre retirado silenciosamente aparece como un fallo intermitente en una ruta en lugar de una interrupción obvia.
Dos consecuencias prácticas:
- Busque en su base de código y plantillas de prompt los nombres antiguos antes de depurar cualquier otra cosa.
- Los identificadores de modelo del lado del proveedor están en un espacio de nombres diferente al de DeepSeek, por lo que confirme la cadena exacta que expone su proveedor en lugar de asumir que el nombre de primer nivel funciona.
DeepSeek No Tiene Programa de Créditos para Startups. Otros Sí.
La aplicación de chat de DeepSeek es gratuita, no hay un nivel gratuito de API declarado en la página de precios oficial, y DeepSeek no ejecuta ningún programa de crédito dedicado para startups. Las afirmaciones de créditos gratuitos de API para nuevas cuentas circulan ampliamente, pero se informan de manera inconsistente y no se confirman en la página oficial. Trátelos como no verificados.
Esa es una brecha genuina. Una API con este precio tan bajo es una de las pocas que no proporcionará a una startup un dólar de pista, lo que hace de DeepSeek un suelo de costos en lugar de una jugada de créditos.
Los proveedores que ejecutan programas son los que vale la pena solicitar, y hay muchos más de los que la mayoría de los fundadores conocen. AI Perks rastrea $7.7M en créditos en 194 empresas, que es la línea presupuestaria que DeepSeek en sí nunca cubrirá.
Vea qué proveedores otorgan créditos en getaiperks.com →

Preguntas Frecuentes
¿Es DeepSeek más barato en OpenRouter o directo?
Directo, estructuralmente. El precio de mitad de horario no pico de DeepSeek y su descuento de caché de aproximadamente 30x para V4-Pro son mecanismos de primer nivel que los revendedores facturan como una tarifa fija única. Un proveedor gana su precio en cumplimiento, conmutación por error y una sola factura para varios modelos. Para el costo bruto del token, el primer nivel gana. Los créditos de los proveedores que ejecutan programas están en AI Perks.
¿Cuándo son las horas pico de DeepSeek?
El horario pico es de 01:00 a 04:00 y de 06:00 a 10:00 UTC los días laborables. Todo lo demás, incluido todo el sábado y domingo, se factura a mitad de precio. Eso deja aproximadamente el 79% de la semana a la tarifa de horario no pico por defecto (derivado), por lo que el trabajo por lotes y en cola casi siempre cae allí sin ningún esfuerzo de programación.
¿Cuánto ahorra un acierto de caché de DeepSeek?
En DeepSeek-V4-Pro, un acierto de caché cuesta $0.022 por millón de tokens de entrada en horario no pico frente a $0.66 para un fallo, aproximadamente 30x. En V4.1-Flash, la misma comparación es de $0.003 frente a $0.15, aproximadamente 50x (derivado). Sumando el descuento de caché con el horario no pico, la diferencia frente a un fallo en horario pico alcanza 60x en V4-Pro.
¿Por qué dejó de funcionar mi llamada a la API deepseek-v4-flash?
DeepSeek-V4.1-Flash retiró los nombres de punto final deepseek-v4-flash y deepseek-v4-flash-vision-exp. Cualquier tutorial o ejemplo de código escrito antes de septiembre de 2026 todavía los usa y ahora fallará. Actualice el identificador del modelo y tenga en cuenta que los proveedores de terceros usan sus propios identificadores en un espacio de nombres diferente al de DeepSeek.
¿DeepSeek otorga créditos de API gratuitos a nuevas cuentas?
La aplicación de chat de DeepSeek es gratuita, pero no hay un nivel gratuito de API declarado en la página de precios oficial, y las afirmaciones de créditos para nuevas cuentas se informan de manera inconsistente y no se confirman. DeepSeek tampoco ejecuta programas de créditos para startups. Los proveedores que lo hacen se rastrean en AI Perks en 194 empresas.
¿Cuánto cuesta DeepSeek V4-Pro por millón de tokens?
DeepSeek-V4-Pro-0813 cuesta $0.66 por millón de tokens de entrada con fallo de caché y $1.98 por millón de tokens de salida en horario no pico, duplicándose a $1.32 y $3.96 durante las horas pico. La entrada con caché cuesta $0.022 en horario no pico. Esta segmentación de precios en un solo modelo es la razón por la que una tarifa fija de revendedor rara vez compite. Compense sus otras facturas de modelos en AI Perks.
Suscríbase en getaiperks.com →
DeepSeek establece el suelo de precios. Los créditos gratuitos de todos los demás cubren el resto.