Quanto Custa DeepSeek para Trabalho de Codificação em 2026?
O DeepSeek-V4-Pro-0813 custa US$ 0,66 por milhão de tokens de entrada com cache miss fora do horário de pico e US$ 1,98 por milhão de tokens de saída fora do horário de pico, e exatamente o dobro de ambos os valores durante o horário de pico. A entrada com cache cai para US$ 0,022 por milhão fora do horário de pico, que é onde o dinheiro de verdade está.
DeepSeek é o único grande fornecedor de modelos que cobra por hora do dia. Dois multiplicadores se acumulam e, juntos, eles contam toda a história do que DeepSeek realmente custa: fora do horário de pico reduz a conta pela metade, e um acerto de cache é cerca de 30 vezes mais barato do que um cache miss.
Essa combinação é mais importante para codificação. Um loop de codificação agentivo repete o mesmo contexto do repositório em cada turno, tornando-se a única carga de trabalho onde altas taxas de acerto de cache são estruturais, em vez de sorte.
O próprio DeepSeek não oferece programa de crédito inicial. Os provedores que o fazem são rastreados em AI Perks, juntamente com US$ 7,7 milhões em créditos em 194 empresas.

Preços de Pico e Fora de Pico: O Mecanismo Que Ninguém Explica
O horário de pico do DeepSeek é das 01:00 às 04:00 e das 06:00 às 10:00 UTC durante a semana. Todo o resto, incluindo todo o sábado e domingo, é fora do horário de pico com preço reduzido pela metade.
Preços atuais de lista, por milhão de tokens:
| Modelo | Entrada, acerto de cache | Entrada, cache miss | Saída |
|---|---|---|---|
| DeepSeek-V4-Pro-0813, fora do pico | $0.022 | $0.66 | $1.98 |
| DeepSeek-V4-Pro-0813, pico | $0.044 | $1.32 | $3.96 |
| DeepSeek-V4.1-Flash, fora do pico | $0.003 | $0.15 | não publicado |
| DeepSeek-V4.1-Flash, pico | $0.006 | $0.30 | não publicado |
Duas coisas decorrem dessas janelas que quase ninguém diz em voz alta. Ambas são aritméticas derivadas da programação UTC publicada, não figuras citadas.
O pico representa apenas cerca de 21% da semana. Sete horas de pico por dia útil representam 35 horas de 168. Quase 80% de todo o tempo do relógio já está fora do horário de pico antes de você mudar qualquer coisa.
Um dia útil completo nos EUA nunca atinge o pico. Das 9h às 17h no Pacífico são 16:00 às 24:00 UTC. Das 9h às 17h no Leste são 13:00 às 21:00 UTC. Nenhuma dessas janelas se sobrepõe a um bloco de pico, então equipes baseadas nos EUA estão pagando metade do preço por acidente. As manhãs europeias são a exceção: das 08:00 às 10:00 UTC é pico, o que corresponde às 9:00 às 11:00 em Londres e às 10:00 ao meio-dia em Berlim.
Há também uma lacuna de duas horas fora do horário de pico entre os dois blocos de pico, das 04:00 às 06:00 UTC, que é um local de estacionamento gratuito para trabalhos noturnos de CI e refatorações em lote.
Por Que Acertos de Cache São Mais Importantes para Codificação do Que Para Chat
Um acerto de cache no DeepSeek-V4-Pro custa US$ 0,022 por milhão de tokens fora do horário de pico, contra US$ 0,66 para um cache miss, uma diferença de 30x, e agentes de codificação geram as maiores taxas de acerto naturais de qualquer carga de trabalho.
O tráfego de chat é um fluxo de prompts curtos e não relacionados, então a maioria das entradas é nova. Um agente de codificação é o oposto: ele carrega a mesma árvore de arquivos, o mesmo prompt do sistema e a mesma diff recente em cada turno de uma longa sessão.
Aqui está o que os dois multiplicadores fazem a uma peça idêntica de trabalho. Volumes ilustrativos, aritmética derivada dos preços de lista acima:
| Uma execução de agente: 2M entrada, 200K saída | Custo |
|---|---|
| Fora do pico, taxa de acerto de cache de 90% | $0.57 |
| Pico, taxa de acerto de cache de 90% | $1.14 |
| Fora do pico, sem cache | $1.72 |
| Pico, sem cache | $3.43 |
Mesmos tokens, mesmo modelo, mesma saída. Uma variação de 6x em trabalho idêntico, decidida inteiramente pelo horário do relógio e disciplina de cache.
Levando ao extremo, a diferença aumenta ainda mais: um token de entrada com cache fora do horário de pico a US$ 0,022 por milhão contra um token de cache miss em pico a US$ 1,32 por milhão é uma diferença de 60x no mesmo modelo. Nenhum outro fornecedor tem uma alavancagem como essa, o que também explica por que tão poucos tutoriais a mencionam.
A mil execuções de agente por mês, a mesma aritmética derivada resulta em aproximadamente US$ 570 contra aproximadamente US$ 3.430. Para uma equipe que também paga por Claude ou GPT nas tarefas difíceis, AI Perks cobre o lado do crédito dessa conta.

O Que Mudou no DeepSeek Desde o Lançamento do V4
Quatro lançamentos em cinco meses moveram o DeepSeek de um preço fixo por token para um preço por hora do dia, e a maioria dos guias publicados ainda cita os antigos números fixos.
A sequência, com confiança anotada onde deveria estar:
- 24 de abril de 2026: Prévia do DeepSeek V4-Pro e V4-Flash. Contexto de 1M de tokens, até 384K tokens de saída, modos de pensamento e sem pensamento selecionáveis. (Confiança: média.)
- 31 de julho de 2026: DeepSeek-V4-Flash-0731, o lançamento estável do Flash. O preço na época era de US$ 0,14 por milhão de entrada com cache miss e US$ 0,28 por milhão de saída. (Apenas contexto histórico, não preço atual.)
- 13 de agosto de 2026: DeepSeek-V4-Pro-0813 atinge disponibilidade geral como o principal modelo de raciocínio e agente.
- 16 de agosto de 2026: A divisão pico e fora de pico chega e os preços fixos terminam.
- Por volta de 10 de setembro de 2026: DeepSeek-V4.1-Flash, no ar na documentação como "DeepSeek-Flash".
Se você está lendo uma comparação de custos do DeepSeek que mostra um único preço de entrada e um único preço de saída sem menção às horas UTC, ela é anterior a 16 de agosto de 2026 e suas conclusões estão erradas em ambas as direções.
A Renomeação do Ponto de Extremidade Que Quebra Códigos Antigos
DeepSeek-V4.1-Flash aposentou silenciosamente os nomes de modelo deepseek-v4-flash e deepseek-v4-flash-vision-exp. Códigos que ainda os utilizam falharão.
Este é o tipo de mudança que derruba uma equipe em uma hora inconveniente, porque a falha surge em tempo de execução no serviço que fixa a string, não em tempo de compilação. Tutoriais mais antigos, respostas do Stack Overflow e arquivos de configuração copiados ainda carregam os nomes aposentados.
Duas consequências práticas. Primeiro, procure por ambas as strings em seu repositório antes do próximo deploy, não depois. Segundo, trate qualquer tutorial do DeepSeek publicado antes de setembro de 2026 como não confiável em identificadores de modelo, bem como em preços.

O DeepSeek Tem Um Nível Gratuito ou Créditos Para Startups?
O aplicativo de chat DeepSeek é gratuito para usar. Não há nível gratuito de API declarado na página oficial de preços, e o DeepSeek não executa nenhum programa dedicado de crédito para startups.
Tenha cuidado com o segundo e o terceiro pontos, pois é aqui que a maioria dos sites erra sobre o DeepSeek. Alegações de que novas contas de API recebem créditos gratuitos são relatadas de forma inconsistente e não são confirmadas na página oficial de preços. Qualquer pessoa que cite um valor específico de crédito para novas contas está repetindo algo que o DeepSeek não publicou.
A ausência de um programa de startup é o fato mais útil. O preço barato por token não é o mesmo que uma concessão, e um fundador que otimiza apenas para o preço de lista está deixando o número maior na mesa:
| Rota | O que realmente é |
|---|---|
| Aplicativo de chat DeepSeek | Gratuito, sem acesso à API |
| API DeepSeek | Pago a partir do primeiro token, sem nível gratuito declarado |
| Créditos para startups DeepSeek | Não existe |
| Outros grandes fornecedores de modelos | Muitos executam programas dedicados de crédito para startups |
DeepSeek é a maneira mais barata de pagar. Não é uma maneira de não pagar. Essas são estratégias diferentes e as equipes mais fortes executam ambas: DeepSeek para trabalhos de codificação com cache de alto volume, créditos concedidos para os modelos de ponta em cima disso. AI Perks rastreia quais fornecedores financiam essa segunda metade.
Hospedagens de terceiros são um contorno parcial. Baseten lista a entrada do DeepSeek V4.1 Flash por US$ 0,30 por milhão e tem um crédito de teste permanente de US$ 30 por novo espaço de trabalho (confiança: média, verifique antes de orçar com base nisso). OpenRouter, Together e Fireworks também hospedam modelos DeepSeek. Seus preços mudam com frequência suficiente para que o conselho honesto seja verificá-los você mesmo no dia, em vez de confiar em qualquer número em um post de blog, incluindo este.
Como Reduzir a Conta de Codificação do DeepSeek
Etapa 1: Cubra o nível de ponta com créditos. Verifique quais fornecedores financiam esse nível em getaiperks.com, para que o DeepSeek cuide apenas do trabalho de volume.
Etapa 2: Verifique em qual fuso horário seus agentes realmente rodam. Se seus trabalhos de CI, refatorações noturnas ou avaliações em lote disparam dentro das 01:00 às 04:00 ou 06:00 às 10:00 UTC, movê-los algumas horas reduz pela metade essa linha de item sem alteração de código.
Etapa 3: Torne o prefixo em cache estável. Qualquer coisa que reordene seu prompt do sistema, injete um timestamp ou embaralhe o contexto do arquivo transforma um token de US$ 0,022 em um token de US$ 0,66.
Etapa 4: Divida os modelos por trabalho. V4-Pro para raciocínio e loops de agente, Flash para classificação, linting e as chamadas baratas de alta frequência ao redor deles.
Etapa 5: Audite suas strings de modelo agora. Os nomes de endpoint Flash aposentados são uma interrupção programada esperando por quem implantar em seguida.

Perguntas Frequentes
Quanto custa DeepSeek para codificação?
O DeepSeek-V4-Pro-0813 custa US$ 0,66 por milhão de tokens de entrada com cache miss e US$ 1,98 por milhão de tokens de saída fora do horário de pico. O horário de pico custa o dobro. A entrada com cache custa US$ 0,022 por milhão fora do horário de pico. As contas reais de codificação ficam entre esses extremos, dependendo da taxa de acerto de cache e do horário.
Quais são os horários de pico e fora de pico do DeepSeek?
O horário de pico é das 01:00 às 04:00 e das 06:00 às 10:00 UTC durante a semana. Todo o resto, incluindo fins de semana, é fora do horário de pico com metade do preço. Derivado dessas janelas, isso deixa aproximadamente 80% da semana fora do horário de pico, e um dia útil padrão nos EUA fica inteiramente fora de ambas as janelas de pico.
O DeepSeek oferece créditos gratuitos para API?
O aplicativo de chat do DeepSeek é gratuito, mas não há nível gratuito de API declarado na página oficial de preços. Relatos de créditos gratuitos para novas contas de API são inconsistentes e não confirmados. O DeepSeek também não executa um programa de crédito para startups, ao contrário da maioria dos grandes fornecedores rastreados em AI Perks.
Por que minha chamada de API DeepSeek parou de funcionar?
O DeepSeek-V4.1-Flash aposentou os nomes de modelo deepseek-v4-flash e deepseek-v4-flash-vision-exp. Qualquer código, tutorial ou configuração que ainda utilize essas strings falhará em tempo de execução. A renomeação não foi amplamente anunciada, portanto, amostras mais antigas e configurações copiadas ainda as carregam. Procure em seu repositório ambas as strings e atualize-as para o identificador Flash atual.
O DeepSeek é mais barato que Claude ou GPT para codificação?
No preço de lista, substancialmente, especialmente com uma alta taxa de acerto de cache fora do horário de pico. No custo total, a comparação muda quando os créditos para startups são envolvidos, pois o DeepSeek não concede nenhum e muitos rivais sim. Verifique o que as alternativas financiarão antes de presumir em AI Perks.
Devo usar o DeepSeek através do OpenRouter ou Baseten em vez disso?
Hospedagens de terceiros adicionam flexibilidade de roteamento, fallback e, às vezes, crédito de teste, mas eles precificam independentemente do cronograma de pico e fora de pico do DeepSeek. Baseten oferece um crédito de teste permanente de US$ 30 por novo espaço de trabalho. Verifique qualquer valor por token hospedado no dia, pois esses preços mudam com frequência.
DeepSeek é a maneira mais barata de pagar. Créditos são a maneira de não pagar.