DeepSeek vs ChatGPT 2026: Os Quatro Preços Cobrados pelo DeepSeek

O DeepSeek fatura por hora do dia e por cache hit, então um modelo tem quatro preços com uma variação de 60x. O que isso significa antes de comparar com o ChatGPT.

DeepSeekChatGPTLLM PricingDeepSeek vs ChatGPTAI Perks
Author Avatar
Andrew
AI Perks Team
7,802

Quick Answer

Depende de qual dos quatro preços do DeepSeek você escolher. O DeepSeek-V4-Pro cobra US$ 0,66 por milhão de tokens de entrada novos fora do horário de pico, US$ 1,32 no horário de pico e US$ 0,022 por um token em cache fora do horário de pico, uma variação de 60x em um único modelo. Nenhum outro grande fornecedor fatura por hora do dia, então qualquer comparação de número único contra o ChatGPT está errada antes de começar. Calcule seu próprio tráfego com base nas taxas atuais publicadas da OpenAI e observe que o DeepSeek não oferece programa de crédito inicial, ao contrário das 194 empresas rastreadas em getaiperks.com.

DeepSeek Não Tem Um Preço por Token

DeepSeek-V4-Pro tem quatro preços de entrada, não um: $0,022, $0,044, $0,66 e $1,32 por milhão de tokens. Qual deles você paga depende da hora do dia e se o prompt atingiu o cache. Isso é um spread de 60x para o mesmo modelo, o mesmo prompt e o mesmo dia.

Cada tabela "DeepSeek vs ChatGPT" que apresenta um número por modelo está comparando um número que não existe. DeepSeek é o único grande fornecedor de modelos que cobra por hora do dia. As horas de pico são 01:00 às 04:00 e 06:00 às 10:00 UTC, de segunda a sexta-feira, e tudo fora dessas janelas, incluindo fins de semana, é cobrado exatamente pela metade.

Aqui estão os preços de lista publicados por milhão de tokens, ambas as metades incluídas.

ModeloEntrada em cacheEntrada novaSaída
DeepSeek-V4-Pro, fora do pico$0,022$0,66$1,98
DeepSeek-V4-Pro, pico$0,044$1,32$3,96
DeepSeek-Flash, fora do pico$0,003$0,15não publicado
DeepSeek-Flash, pico$0,006$0,30não publicado

Essa última coluna não é uma omissão de nosso lado. DeepSeek publica as taxas de entrada com cache e sem cache para a linha V4.1 Flash, mas nenhuma taxa de saída, então qualquer guia que cite um valor de saída Flash está citando algo que DeepSeek não declarou. Não vamos repetir, e seu orçamento também não deve.

A mesma disciplina se aplica na outra direção. Não republicamos os preços de lista da OpenAI que não verificamos na página de preços da OpenAI, porque essas taxas se movem e um número desatualizado em uma tabela de comparação é pior do que nenhum número. Leia este artigo para a estrutura da fatura da DeepSeek, então precifique o ChatGPT diretamente da fonte. AI Perks rastreia a terceira variável, créditos, que nenhum preço de lista inclui.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Quem Realmente Paga a Taxa de Pico da DeepSeek

A precificação de pico cobre sete horas por dia de semana, ou 35 das 168 horas da semana, então aproximadamente 79% de todo o tempo de relógio é cobrado pela metade do preço (derivado). Fora do pico não é uma janela de desconto. É a taxa normal para a maior parte do planeta.

Convertido para UTC+8, as janelas de pico vão das 09:00 às 12:00 e das 14:00 às 18:00, com a lacuna caindo na hora do almoço. Essa é a forma de um dia de trabalho no mercado doméstico da DeepSeek. DeepSeek não declarou isso como motivo, portanto, trate o ajuste como uma observação, e não como um fato, mas ele prevê exatamente quem paga mais.

Localização da equipeDia de trabalho em UTCHoras em pico
San Francisco (UTC-7)16:00 às 00:000 de 8
Nova York (UTC-4)13:00 às 21:000 de 8
Londres (UTC+1)08:00 às 16:002 de 8
Berlim (UTC+2)07:00 às 15:003 de 8
Bengaluru (UTC+5:30)03:30 às 11:304,5 de 8
Shenzhen (UTC+8)01:00 às 09:006 de 8

Uma equipe dos EUA que executa tráfego interativo durante o horário comercial nunca atinge a taxa de pico. Uma equipe europeia paga isso pelas primeiras duas ou três horas de todas as manhãs, o que é um argumento concreto para agendar trabalhos em lote e de avaliação após o almoço em vez de antes da reunião geral.


O Cache Hit Importa Mais que o Relógio

Mover uma carga de trabalho para fora do pico corta a conta pela metade. Colocá-la no cache divide por 30. No DeepSeek-V4-Pro, um token de entrada em cache custa $0,022 por milhão fora do pico, enquanto um novo custa $0,66, exatamente 30x mais (derivado). A alavancagem fora do pico vale 2x. A maioria das equipes ajusta a alavancagem 2x e ignora a 30x.

Duas comparações derivadas tornam a ordem óbvia:

  • Um token em cache no modelo V4-Pro principal fora do pico ($0,022) é 6,8x mais barato que um token novo no modelo Flash econômico fora do pico ($0,15). O cache supera o downgrade.
  • Mesmo um token V4-Pro em cache na taxa de pico ($0,044) é 3,4x mais barato que um token Flash novo fora do pico. O cache supera o downgrade e supera a espera pelas horas baratas combinadas.

Aumentar a taxa de cache hit de 50% para 90% no V4-Pro corta o custo de entrada misto de $0,341 para $0,0858 por milhão de tokens, uma redução de 4,0x (derivado) que nenhuma quantidade de agendamento pode igualar.

Três consequências práticas:

Estabilidade do prefixo supera brevidade do prompt. Um prompt de sistema longo que nunca muda é mais barato que um curto que você reescreve por solicitação, pois apenas o prefixo estável é armazenado em cache.

Coloque a parte variável por último. Qualquer coisa inserida antes do contexto recuperado invalida o cache para tudo o que vem depois.

A profundidade do cache é uma decisão de precificação, não técnica. DeepSeek precifica um cache hit do V4-Pro em 3,3% de um token novo e um hit do Flash em 2,0% (ambos derivados). Fornecedores que precificam cache hits em uma fração menor do que a entrada nova lhe dão muito menos para otimizar. Essa proporção, não a taxa de manchete, é o que comparar entre os provedores.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Quanto uma Tarefa Real Realmente Custa

Considere uma chamada realista de agente aumentada por recuperação: 40.000 tokens de entrada com uma taxa de cache hit de 80%, mais 2.000 tokens de saída. Todos os números abaixo são derivados das taxas publicadas acima.

CenárioCusto de entradaCusto de saídaTotal
V4-Pro, fora do pico$0,00598$0,00396$0,00994
V4-Pro, pico$0,01197$0,00792$0,01989
Flash, fora do pico$0,00130não publicadonão cotável
Flash, pico$0,00259não publicadonão cotável

Duas coisas se destacam. Primeiro, a entrada V4-Pro nesta tarefa custa 4,6x mais que a entrada Flash (derivado), que é uma lacuna muito menor do que os níveis de modelo sugerem, porque o cache hit de 80% está fazendo a maior parte do trabalho em ambos. Segundo, um custo total da tarefa para Flash não é computável a partir de dados publicados. Se um artigo de comparação lhe der um, pergunte de onde veio a taxa de saída.


Onde a Reputação de Barato Desmorona

Roteamento da DeepSeek através de um host de terceiros aplana a divisão pico e fora do pico em uma única taxa fixa, então você paga algo próximo ao preço de pico 100% do tempo. Baseten, por exemplo, lista a entrada DeepSeek V4.1 Flash a $0,30 por milhão, o que é idêntico à taxa de cache-miss de pico da própria DeepSeek e o dobro da taxa fora do pico de $0,15 (valor publicado pela Baseten, vale a pena confirmar antes de orçar com base nele; sua taxa de saída não foi confirmada de forma confiável). Baseten oferece um crédito de teste de espaço de trabalho novo de $30.

OpenRouter, Together e Fireworks também hospedam modelos DeepSeek. Suas taxas são deles para definir e mudam, então verifique cada um por si mesmo em vez de confiar em um número em um post de blog, incluindo este. A troca qualitativa é estável: você ganha conveniência de roteamento, failover e uma fatura única, e perde permanentemente o desconto de 50% fora do pico. Para tráfego que roda principalmente fora do pico, essa troca é negativa.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

O Que Mudou Desde os Guias de Preços Antigos da DeepSeek

Todo guia DeepSeek escrito antes de 16 de agosto de 2026 cita um único preço fixo. Esse preço não existe mais. Se um artigo dá um número por modelo sem menção de horários de pico, ele é anterior à estrutura atual.

  • 24 de abril de 2026: DeepSeek V4-Pro e V4-Flash são lançados em pré-visualização com uma janela de contexto de 1 milhão de tokens, até 384 mil tokens de saída e modos de pensamento e não pensamento alternáveis.
  • 31 de julho de 2026: DeepSeek-V4-Flash-0731 se torna o lançamento estável do Flash. O preço na época era fixo em $0,14 por milhão de entrada sem cache e $0,28 por milhão de saída, sem componente de hora do dia. Isso é história, não uma taxa que você pode comprar hoje.
  • 13 de agosto de 2026: DeepSeek-V4-Pro-0813 atinge disponibilidade geral como o modelo principal de raciocínio e agente.
  • 16 de agosto de 2026: chega a precificação de pico e fora do pico.
  • Por volta de 10 de setembro de 2026: DeepSeek-V4.1-Flash chega, listado na documentação simplesmente como DeepSeek-Flash.

Uma alteração crítica merece nota própria, pois desativa silenciosamente códigos de trabalho. DeepSeek-V4.1-Flash aposentou os nomes de endpoint deepseek-v4-flash e deepseek-v4-flash-vision-exp. Tutoriais, respostas de fóruns e exemplos de código copiados ainda fazem referência a essas strings e falharão com a API ao vivo. Verifique o identificador de modelo atual na documentação da própria DeepSeek em vez de um exemplo de código, já que a nomenclatura mudou duas vezes em cinco meses.


DeepSeek Não Tem Programa de Crédito Inicial

O aplicativo de chat DeepSeek é gratuito. A API não é, e DeepSeek não declara nenhum nível gratuito em sua página oficial de preços. Alegações de créditos de API gratuitos para novas contas DeepSeek circulam amplamente, são relatadas de forma inconsistente e não são confirmadas na página oficial. Trate-as como não verificadas.

Mais importante para os fundadores: DeepSeek não executa um programa dedicado de crédito para startups. Nenhuma bolsa, nenhuma alocação baseada em fase, nenhum nível subsidiado. Você recarrega um saldo e o gasta. Barato por token, subsídio zero.

Esse é o único lugar onde a vantagem de custo se inverte. Um provedor que cobra várias vezes mais por token, enquanto concede a uma jovem empresa cinco dígitos em créditos, é mais barato no primeiro ano do que um provedor barato sem subsídio algum. Custo por token é apenas a métrica correta quando alguém está realmente pagando em dinheiro.

A maioria dos provedores com os quais DeepSeek compete executa programas de crédito. AI Perks rastreia US$ 7,7 milhões em créditos em 194 empresas, que é toda a camada que uma comparação de preço de lista não inclui.

A pilha prática: capacidade creditada dos provedores que a concedem, DeepSeek-Flash fora do pico como padrão pago, cache de prefixo agressivo em tudo que roda no pico e um fallback verificado para as horas que você não pode mudar. Comece com os créditos, porque eles são a única parte da conta que pode ir para zero. Veja o que está atualmente disponível.


Round Funded
SponsoredRaise money from 10,000+ active vetted investors.
Start Raising

Perguntas Frequentes

DeepSeek é mais barato que o ChatGPT?

Essa pergunta tem quatro respostas apenas do lado da DeepSeek. A entrada nova do DeepSeek-V4-Pro custa $0,66 por milhão fora do pico e $1,32 no pico, e um token em cache custa $0,022 fora do pico. Precipe seu próprio tráfego em relação às taxas atuais publicadas da OpenAI, ponderando cada taxa da DeepSeek pela participação de chamadas que realmente a atingem. A resposta depende do seu relógio e da sua taxa de cache hit, não do fornecedor.

Quais são os horários de pico da DeepSeek?

Os horários de pico são das 01:00 às 04:00 e das 06:00 às 10:00 UTC, de segunda a sexta-feira. Todo o resto, incluindo fins de semana, é cobrado pela metade da taxa de pico. Isso torna aproximadamente 79% da semana fora do pico. Equipes em fusos horários dos EUA raramente atingem a precificação de pico durante o horário de trabalho normal.

A DeepSeek oferece créditos de API gratuitos ou um programa para startups?

Não. O aplicativo de chat da DeepSeek é gratuito para usar, mas nenhum nível de API gratuito é declarado em sua página oficial de preços, e os relatos de créditos de inscrição são inconsistentes e não confirmados. A DeepSeek também não executa um programa de crédito para startups, ao contrário de muitos dos provedores rastreados em AI Perks.

Por que minha chamada de API DeepSeek parou de funcionar?

DeepSeek-V4.1-Flash aposentou os identificadores de modelo deepseek-v4-flash e deepseek-v4-flash-vision-exp, silenciosamente e sem janela de depreciação. Tutoriais mais antigos e amostras copiadas ainda os referenciam e falharão. Obtenha o identificador atual da documentação ativa da DeepSeek antes de depurar qualquer outra coisa.

Quanto custam os tokens de saída do DeepSeek-Flash?

DeepSeek não publicou isso. A linha V4.1 Flash lista apenas as taxas de entrada com cache e sem cache. Qualquer valor de custo total por tarefa que você veja para o Flash é construído com base em uma taxa de saída assumida, portanto, trate-o como uma estimativa em vez de um preço.

É mais barato rodar DeepSeek através de um host de terceiros?

Geralmente não, se o seu tráfego rodar fora do pico. Os hosts cobram uma taxa fixa sem divisão entre pico e fora do pico, então você renuncia ao desconto de 50% fora do pico permanentemente em troca de conveniência de roteamento e failover. Verifique a taxa atual de cada host por conta própria antes de mudar, pois as margens variam e mudam com frequência.

Quanto os créditos de IA gratuitos realmente economizam para uma startup?

O suficiente para reverter a comparação. Um provedor que cobra várias vezes mais por token, mas concede cinco dígitos em créditos, é mais barato no primeiro ano do que um provedor barato sem subsídio. AI Perks rastreia US$ 7,7 milhões em créditos em 194 empresas, que é a camada que as comparações de preço de lista ignoram completamente.


Inscreva-se para drops semanais de crédito

Preço por token é o número fácil. Preço por tarefa, após créditos, é o que aparece no cartão.

This content is for informational purposes only and may contain inaccuracies. Credit programs, amounts, and eligibility requirements change frequently. Always verify details directly with the provider.