Preços Flash do DeepSeek V4.1 e Fim dos Endpoints da API V4

Preços do DeepSeek V4.1 Flash, a divisão entre pico e fora de pico, acerto e erro de cache, e os nomes de endpoint deepseek-v4-flash que agora falham.

DeepSeekDeepSeek V4LLM PricingAI APIAI Perks
Author Avatar
Andrew
AI Perks Team
11,389

Quick Answer

O DeepSeek V4.1 Flash custa $0,15 por milhão de tokens de entrada com cache-miss fora do pico e $0,30 no pico, com entrada em cache a $0,003 fora do pico. O DeepSeek é o único fornecedor importante que cobra pelo horário do dia e não oferece um programa de crédito inicial, ao contrário das 194 empresas rastreadas em getaiperks.com.

Quanto Custa o DeepSeek V4.1 Flash por Milhão de Tokens

O DeepSeek V4.1 Flash custa $0,15 por milhão de tokens de entrada com cache-miss fora do horário de pico e $0,30 no horário de pico. Um token de entrada em cache custa $0,003 fora do horário de pico, o que é 50x abaixo da taxa de cache-miss do próprio Flash (derivado).

O Flash chegou por volta de 10 de setembro de 2026 e aparece na documentação oficial como DeepSeek-Flash. O carro-chefe DeepSeek-V4-Pro-0813 está disponível desde 13 de agosto de 2026.

Todos os números abaixo são em USD por milhão de tokens, retirados de api-docs.deepseek.com e confirmados em setembro de 2026.

Modelo e janelaEntrada, cache hitEntrada, cache missSaída
DeepSeek-V4-Pro-0813, fora do pico$0,022$0,66$1,98
DeepSeek-V4-Pro-0813, pico$0,044$1,32$3,96
DeepSeek-V4.1-Flash, fora do pico$0,003$0,15Não publicado
DeepSeek-V4.1-Flash, pico$0,006$0,30Não publicado

A DeepSeek não publicou um preço de saída para o V4.1 Flash que possa ser confirmado na página oficial. Se você vir um citado em outro lugar, trate-o como não verificado até que apareça na tabela oficial.

A DeepSeek é incomum de uma segunda maneira que é mais importante para os fundadores do que o número de tokens: ela não executa nenhum programa de crédito para startups. Essa lacuna é abordada abaixo, e é por isso que AI Perks rastreia os provedores que executam um.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Por Que a DeepSeek Cobra Dois Preços Diferentes Para o Mesmo Token

A DeepSeek é a única grande fornecedora de modelos que fatura por hora do dia. As horas de pico são das 01:00 às 04:00 e das 06:00 às 10:00 UTC durante a semana, e tudo fora dessas janelas custa exatamente metade.

Leia essa lista de janelas duas vezes, porque há uma lacuna no meio dela. O trecho das 04:00 às 06:00 UTC fica entre os dois blocos de pico e é cobrado à taxa fora do pico. Não é um bloco contínuo de nove horas de pico.

Derivado das janelas publicadas: o pico cobre sete horas por dia, apenas durante a semana, o que equivale a 35 horas em 168 na semana. Aproximadamente 79 por cento do calendário já está fora do pico.

Isso reformula o problema. Você não está tentando encontrar a janela barata, você está tentando evitar a cara. Três cargas de trabalho onde isso é quase gratuito:

  • Jobs em lote noturnos. Um job agendado para as 08:00 UTC se encaixa no pico. Movê-lo para as 12:00 UTC corta a conta pela metade e não muda mais nada.
  • Execuções de avaliação e regressão. Estas não têm usuários esperando por elas, então elas pertencem fora dos blocos de pico por padrão.
  • Passagens de embedding e reindexação. Grandes queimas de entrada únicas são a coisa mais sensível ao pico que a maioria das equipes executa.

O tráfego interativo é a parte que você não pode mover, e ele deve ser precificado às taxas de pico em qualquer previsão que você construa.


O Cache Hit é o Maior Multiplicador

No DeepSeek-V4-Pro, um token de entrada em cache custa $0,022 por milhão contra $0,66 para um cache-miss. Isso é uma diferença de 30x (derivada da tabela acima), e ofusca o 2x que você obtém do agendamento.

Os dois multiplicadores se somam, e essa soma é toda a história do perfil de custo da DeepSeek. Um token de entrada com cache-miss no pico a $1,32 contra um token de entrada com cache-hit fora do pico a $0,022 é uma propagação de 60x no mesmo modelo (derivada).

No V4.1 Flash, a proporção de cache é ainda maior: $0,15 para um cache-miss contra $0,003 para um cache-hit é 50x (derivada).

O que isso significa na prática é que a estrutura do prompt supera a escolha do modelo. Mover de V4-Pro para Flash corta a entrada de cache-miss em 4,4x (derivada, $0,66 contra $0,15). Conseguir que seu cache atinja no V4-Pro o corta em 30x. O modelo mais barato é a alavanca menor.

Os cache hits vêm de um prefixo estável, então as regras práticas são chatas e eficazes: mantenha o prompt do sistema byte-a-byte idêntico entre as chamadas, coloque definições de ferramentas e contexto recuperado antes de qualquer coisa específica do usuário e nunca interpole um carimbo de data/hora ou um ID de sessão perto do topo de um prompt.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Os Nomes de Endpoint Que o DeepSeek V4.1 Flash Aposentou

O DeepSeek-V4.1-Flash aposentou os nomes de modelo deepseek-v4-flash e deepseek-v4-flash-vision-exp. O código que ainda envia qualquer uma dessas strings falhará.

Nome do modelo aposentadoStatus
deepseek-v4-flashAposentado com V4.1 Flash
deepseek-v4-flash-vision-expAposentado com V4.1 Flash

Esta foi uma mudança discreta em vez de uma depreciação de destaque, que é exatamente o que a torna cara. A string do modelo é geralmente a linha menos revisada em uma integração de IA: ela fica em uma variável de ambiente, um arquivo de configuração, um template Terraform ou um wrapper de SDK terceirizado, e ninguém a toca entre as versões.

O problema mais amplo é a longa cauda de conteúdo. Tutoriais, vídeos no YouTube, respostas em fóruns e amostras de código geradas escritas antes de setembro de 2026 ainda referenciam os nomes antigos, e nenhum deles será corrigido. Um assistente que aprendeu com essas páginas continuará sugerindo-os.

Se você executa DeepSeek em produção, use grep em seu repositório para ambas as strings e, em seguida, verifique sua configuração de infraestrutura e qualquer gerenciador de segredos separadamente. Um nome de modelo definido há seis meses em uma variável de implantação não aparecerá em uma pesquisa de código.


O Que Mudou Desde a Guia de Preços Anterior do DeepSeek

Três coisas invalidaram partes de todas as páginas de preços do DeepSeek escritas antes de meados de agosto de 2026: a divisão pico e fora do pico, a divisão V4-Pro e Flash, e os nomes de endpoint aposentados.

DataLançamento ou mudançaConfiança
24 de abril de 2026Prévia V4-Pro e V4-Flash: contexto de 1 milhão de tokens, até 384K de saída, modos de pensamento comutáveis e sem pensamentoMédio
31 de julho de 2026DeepSeek-V4-Flash-0731, lançamento estável da linha FlashMédio
13 de agosto de 2026Disponibilidade geral do DeepSeek-V4-Pro-0813Alto
16 de agosto de 2026Introdução de preços de pico e fora do picoMédio
Por volta de 10 de setembro de 2026DeepSeek-V4.1-Flash, nomes de endpoint Flash antigos aposentadosAlto

O dado histórico que vale a pena saber é o último preço conhecido do Flash antes da mudança de 16 de agosto: $0,14 por milhão de entrada com cache-miss e $0,28 por milhão de saída. Esse é o número que a maioria das tabelas comparativas de terceiros ainda mostra. Não é o preço atual e antecede completamente o multiplicador de pico, então qualquer previsão construída sobre ele subestima uma carga de trabalho com uso intenso de pico em aproximadamente 2x (derivado: $0,14 contra a taxa atual de $0,30 de cache-miss no pico é 2,1x).

Um único preço de entrada fixo para DeepSeek agora é sem sentido sem dois qualificadores: qual lado do cache e qual lado do relógio.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

DeepSeek Não Tem Nível Gratuito de API Nem Programa de Crédito para Startups

O aplicativo de chat DeepSeek é gratuito para usar. A API não é, e não há nível gratuito declarado na página oficial de preços. A DeepSeek também não executa nenhum programa dedicado de crédito para startups.

Alegações de que novas contas de API recebem créditos gratuitos circulam amplamente e são relatadas de forma inconsistente. Elas não são confirmadas na página oficial de preços, portanto, planeje seu primeiro mês de gastos como se elas não existissem.

Hosts de terceiros são uma rota parcial para contornar isso, com a ressalva usual de que seus preços e termos são deles. A Baseten lista a entrada do DeepSeek V4.1 Flash a $0,30 por milhão e oferece um crédito de teste de $30 para novos espaços de trabalho (verifique ambos antes de orçar contra eles). OpenRouter, Together e Fireworks também hospedam modelos DeepSeek, e a escolha entre eles geralmente se resume a roteamento, região e limites de taxa, em vez de preço de destaque.

A verdadeira lacuna para os fundadores é estrutural. A maioria dos fornecedores de modelos e infraestrutura em que uma startup opera executa alguma forma de programa de crédito, e os valores e termos atuais para cada um são o que a AI Perks rastreia. A DeepSeek não opera nenhum, o que significa que a DeepSeek é a única linha de sua conta de IA que você paga sempre em dinheiro.

Essa é a argumentação para tratá-la como o nível padrão barato dentro de uma pilha, em vez da pilha inteira. Direcione o trabalho de alto volume, amigável ao cache e fora do pico para a DeepSeek, e direcione o trabalho que precisa de raciocínio de fronteira para um provedor cuja conta outra pessoa está cobrindo. AI Perks rastreia $7,7 milhões em créditos em 194 empresas, que é de onde vem essa segunda metade.

Veja quais provedores executam programas de crédito em getaiperks.com →


Perguntas Frequentes

Quanto custa o DeepSeek V4.1 Flash?

O DeepSeek V4.1 Flash custa $0,15 por milhão de tokens de entrada com cache-miss fora do pico e $0,30 no pico. A entrada em cache custa $0,003 fora do pico e $0,006 no pico. A DeepSeek não publicou um preço de saída confirmável para o Flash, portanto, trate qualquer figura de saída que você encontrar em outro lugar como não verificada.

Quais são as horas de pico e fora do pico da DeepSeek?

As horas de pico são das 01:00 às 04:00 e das 06:00 às 10:00 UTC durante a semana. Todo o resto, incluindo o intervalo das 04:00 às 06:00 UTC entre os dois blocos e todo o tráfego de fim de semana, está fora do pico com metade do preço. Derivado dessas janelas, cerca de 79 por cento da semana já está fora do pico.

Por que minha chamada de API deepseek-v4-flash falha repentinamente?

O DeepSeek-V4.1-Flash aposentou os nomes de modelo deepseek-v4-flash e deepseek-v4-flash-vision-exp. Qualquer código, tutorial ou configuração que ainda envie essas strings falhará. Verifique suas variáveis de ambiente e configuração de implantação, bem como seu código-fonte, pois os nomes dos modelos geralmente ficam fora do repositório. A mudança foi lançada discretamente por volta de 10 de setembro de 2026.

A DeepSeek oferece créditos de API gratuitos para novas contas?

Não há nível gratuito de API declarado na página oficial de preços da DeepSeek. Os relatos de créditos para novas contas são inconsistentes e não confirmados, portanto, planeje como se eles não existissem. O aplicativo de chat é gratuito. Para provedores que publicam programas de crédito, veja AI Perks.

A DeepSeek tem um programa de crédito para startups?

Não. A DeepSeek não executa nenhum programa dedicado de crédito para startups, o que a torna uma das poucas APIs de modelos importantes que você sempre paga em dinheiro. A maioria dos outros provedores executa um, e AI Perks rastreia $7,7 milhões em créditos em 194 empresas cobrindo-os.

O DeepSeek V4-Pro ou V4.1 Flash é mais barato?

O Flash é mais barato em todos os comparáveis publicados: $0,15 contra $0,66 por milhão de tokens de entrada com cache-miss fora do pico, uma diferença de 4,4x (derivada). Mas corrigir o cache do seu prompt no V4-Pro é uma alavanca de 30x, então a estrutura do prompt importa mais do que a escolha do modelo. Nenhum deles tem um programa de crédito por trás, que é a parte que AI Perks rastreia para os provedores que o fazem.


Inscreva-se em getaiperks.com →

DeepSeek é a linha mais barata em sua conta de IA. Obtenha as outras linhas cobertas em getaiperks.com.

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.