Preços do DeepSeek: chat gratuito e custos da API

O chat e o aplicativo oficial da DeepSeek ofereciam acesso gratuito na data desta revisão. A DeepSeek API, usada para criar produtos e automações, é cobrada separadamente de acordo com os tokens processados. Abaixo você encontra os preços atuais de V4 Flash e V4 Pro, a fórmula de cálculo e exemplos verificáveis.

Preços verificados em 19 de julho de 2026: a tabela oficial não apresenta os valores atuais como promoção. Esta página usa apenas as tarifas vigentes, sem “preço original” ou prazo promocional expirado.

Este é um guia editorial independente em português. Não somos a DeepSeek, não vendemos créditos e não representamos um canal oficial da empresa. Preços, limites e condições podem mudar; confirme os valores oficiais antes de recarregar saldo ou aprovar um orçamento.

Resumo: o que é gratuito e o que é pago?

Forma de acessoComo funciona o preçoUso mais comum
Chat oficial no navegadorAcesso gratuito disponível na data da revisão; limites e recursos podem variarConversas e tarefas manuais
Aplicativo oficialDownload e acesso listados como gratuitos; condições podem mudarUso pessoal em Android, iPhone e iPad
API oficialPaga por tokens efetivamente processadosAplicativos, integrações, agentes e automações
Pesos abertosSem tarifa por token da API oficial, mas com custos próprios de hardware, nuvem, operação e equipePesquisa, personalização e implantação própria

O acesso gratuito ao chat ou ao DeepSeek App não inclui créditos ilimitados de API. Da mesma forma, baixar pesos de um modelo não torna a infraestrutura necessária para executá-lo gratuita.

Tabela atual de preços da DeepSeek API

Os valores são expressos em dólares americanos por 1 milhão de tokens. A entrada é dividida entre tokens que obtiveram acerto no cache e tokens sem acerto. A saída usa uma tarifa própria.

Modelo atualEntrada: cache hitEntrada: cache missSaída
deepseek-v4-flashUS$ 0,0028 / 1MUS$ 0,14 / 1MUS$ 0,28 / 1M
deepseek-v4-proUS$ 0,003625 / 1MUS$ 0,435 / 1MUS$ 0,87 / 1M

V4 Flash é a opção econômica e o ponto de partida para a maioria das cargas. V4 Pro é uma atualização opcional para tarefas em que o ganho de qualidade compensa o custo maior. Conheça as diferenças no guia do DeepSeek V4.

Preço por mil e por 100 mil tokens

A cobrança real não exige lotes exatos de 1 milhão. Os valores abaixo são apenas conversões da tarifa oficial para facilitar estimativas menores.

Modelo e tipo de tokenPor 1 mil tokensPor 100 mil tokens
V4 Flash — entrada com cacheUS$ 0,0000028US$ 0,00028
V4 Flash — entrada sem cacheUS$ 0,00014US$ 0,014
V4 Flash — saídaUS$ 0,00028US$ 0,028
V4 Pro — entrada com cacheUS$ 0,000003625US$ 0,0003625
V4 Pro — entrada sem cacheUS$ 0,000435US$ 0,0435
V4 Pro — saídaUS$ 0,00087US$ 0,087

Como calcular o custo da API

A conta inclui três parcelas:

Custo =
(tokens de entrada com cache ÷ 1.000.000 × tarifa de cache hit)
+ (tokens de entrada sem cache ÷ 1.000.000 × tarifa de cache miss)
+ (tokens de saída ÷ 1.000.000 × tarifa de saída)

Use os números retornados no campo usage da resposta da API para conferir a cobrança. Uma estimativa baseada apenas em caracteres, palavras ou páginas pode divergir da tokenização real.

Exemplo 1: V4 Flash sem acerto de cache

Em um conjunto de requisições, a carga soma 1 milhão de tokens de entrada sem cache e 500 mil tokens de saída. Esses valores são totais agregados e não descrevem uma única requisição, pois cada modelo possui contexto de 1M e saída máxima anunciada de 384K:

  • Entrada: 1 × US$ 0,14 = US$ 0,14.
  • Saída: 0,5 × US$ 0,28 = US$ 0,14.
  • Total estimado: US$ 0,28.

Exemplo 2: a mesma carga no V4 Pro

No mesmo conjunto agregado de requisições, agora processado com o V4 Pro:

  • Entrada: 1 × US$ 0,435 = US$ 0,435.
  • Saída: 0,5 × US$ 0,87 = US$ 0,435.
  • Total estimado: US$ 0,87.

Exemplo 3: V4 Flash com parte da entrada em cache

Uma requisição contabiliza 700 mil tokens com cache hit, 200 mil sem cache e 100 mil de saída, totalizando 1 milhão de tokens dentro da janela de contexto:

  • Cache hit: 0,7 × US$ 0,0028 = US$ 0,00196.
  • Cache miss: 0,2 × US$ 0,14 = US$ 0,028.
  • Saída: 0,1 × US$ 0,28 = US$ 0,028.
  • Total estimado: US$ 0,05796.

Esses exemplos isolam o custo dos tokens. Impostos, câmbio, taxas do meio de pagamento e custos da sua própria infraestrutura podem alterar o valor final do projeto.

O que significa cache hit no preço?

O Context Caching tenta reaproveitar unidades persistidas de um prefixo de entrada repetido. Quando há acerto, os tokens correspondentes recebem a tarifa de cache hit; o restante é cobrado como cache miss. O mecanismo não reutiliza uma resposta pronta e não garante que toda repetição produzirá um acerto.

Estruture instruções e documentos estáveis no início do prompt e conteúdo variável depois deles. Em seguida, acompanhe prompt_cache_hit_tokens e prompt_cache_miss_tokens em usage. Veja os detalhes e as limitações no guia de DeepSeek Context Caching.

V4 Flash ou V4 Pro: qual custa menos no seu caso?

CritérioV4 FlashV4 Pro
Estratégia inicialUse como baselineTeste como upgrade opcional
Melhor ajusteVolume, velocidade, classificação, extração, resumo e chatRaciocínio exigente, código complexo e agentes avançados
Como decidirCompare qualidade, latência, tokens de saída, taxa de correção humana e custo por tarefa concluída

Um modelo com tarifa menor pode sair mais caro se exigir muitas novas tentativas; um modelo mais caro pode ser desperdício quando o Flash já atende ao critério de qualidade. Faça a comparação com exemplos reais e avalie custo por resultado aprovado, não apenas preço por token.

Limites de concorrência e impacto no orçamento

A documentação atual informa limites de 2.500 conexões concorrentes por conta para V4 Flash e 500 para V4 Pro. A contagem ocorre no nível da conta, independentemente do número de chaves. Ao exceder o limite, a API retorna HTTP 429.

Isso não é uma franquia de tokens nem uma cobrança extra: é um controle de capacidade. Implemente fila, backoff com jitter, timeout e monitoramento. A documentação também permite solicitar expansão de capacidade, sujeita a avaliação. Para implementação, consulte o guia da DeepSeek API em português e o diagnóstico de erros HTTP 429 e outros códigos.

Saldo, cobrança, moeda e meios de pagamento

  • Saldo: quando a conta possui saldo concedido e saldo recarregado, a documentação informa que o saldo concedido é usado primeiro.
  • Moeda: a tabela oficial é publicada em dólar americano. Não fixamos conversões para real ou euro porque a cotação e as taxas variam.
  • Pagamento: consulte no painel da sua conta quais métodos estão disponíveis para seu país e perfil. A lista pode mudar.
  • Orçamento: considere também impostos, backend, observabilidade, armazenamento, revisão humana e serviços de terceiros.

Checklist para controlar custos

  • Comece com V4 Flash e defina um conjunto fixo de avaliação.
  • Limite o tamanho da entrada e da saída conforme a tarefa.
  • Evite reenviar histórico que não contribui para a resposta.
  • Organize prefixos estáveis para aumentar a chance de cache hit.
  • Registre tokens e custo por usuário, recurso e tarefa sem expor conteúdo sensível.
  • Defina alertas, cotas internas e bloqueio quando o orçamento for atingido.
  • Compare o V4 Pro apenas nos casos em que há espaço mensurável para ganho.
  • Revise a página oficial de preços antes de cada previsão financeira importante.

Perguntas frequentes sobre preços

O DeepSeek é gratuito?

O chat e o aplicativo oficial estavam disponíveis gratuitamente em 19 de julho de 2026, sujeitos a condições e limites do produto. A API é um serviço separado e cobrado por tokens.

A DeepSeek API tem plano gratuito?

Não trate a API como gratuita. Uma conta pode possuir saldo concedido, mas isso não transforma a tarifa em zero nem garante novos créditos. Verifique o saldo e as regras diretamente no painel oficial.

Thinking Mode tem outra tarifa?

A tabela oficial diferencia modelo e tipo de token, não publica uma tarifa separada para ligar o Thinking Mode. Porém, a quantidade de tokens processados e gerados pode mudar; meça o campo usage em cargas reais.

Cache hit significa resposta grátis?

Não. Apenas os tokens de entrada que obtêm acerto recebem a tarifa reduzida. Tokens sem acerto e tokens de saída continuam cobrados.

Qual modelo devo usar para economizar?

Comece com deepseek-v4-flash. Compare o Pro apenas quando uma avaliação controlada mostrar ganho relevante. A escolha final deve considerar custo por tarefa aprovada.

Fontes oficiais consultadas

Transparência editorial: conteúdo independente, sem parceria, patrocínio ou endosso da DeepSeek. Informações verificadas em 19 de julho de 2026.