O chat e o aplicativo oficial da DeepSeek ofereciam acesso gratuito na data desta revisão. A DeepSeek API, usada para criar produtos e automações, é cobrada separadamente de acordo com os tokens processados. Abaixo você encontra os preços atuais de V4 Flash e V4 Pro, a fórmula de cálculo e exemplos verificáveis.
Preços verificados em 19 de julho de 2026: a tabela oficial não apresenta os valores atuais como promoção. Esta página usa apenas as tarifas vigentes, sem “preço original” ou prazo promocional expirado.
Este é um guia editorial independente em português. Não somos a DeepSeek, não vendemos créditos e não representamos um canal oficial da empresa. Preços, limites e condições podem mudar; confirme os valores oficiais antes de recarregar saldo ou aprovar um orçamento.
Resumo: o que é gratuito e o que é pago?
| Forma de acesso | Como funciona o preço | Uso mais comum |
|---|---|---|
| Chat oficial no navegador | Acesso gratuito disponível na data da revisão; limites e recursos podem variar | Conversas e tarefas manuais |
| Aplicativo oficial | Download e acesso listados como gratuitos; condições podem mudar | Uso pessoal em Android, iPhone e iPad |
| API oficial | Paga por tokens efetivamente processados | Aplicativos, integrações, agentes e automações |
| Pesos abertos | Sem tarifa por token da API oficial, mas com custos próprios de hardware, nuvem, operação e equipe | Pesquisa, personalização e implantação própria |
O acesso gratuito ao chat ou ao DeepSeek App não inclui créditos ilimitados de API. Da mesma forma, baixar pesos de um modelo não torna a infraestrutura necessária para executá-lo gratuita.
Tabela atual de preços da DeepSeek API
Os valores são expressos em dólares americanos por 1 milhão de tokens. A entrada é dividida entre tokens que obtiveram acerto no cache e tokens sem acerto. A saída usa uma tarifa própria.
| Modelo atual | Entrada: cache hit | Entrada: cache miss | Saída |
|---|---|---|---|
deepseek-v4-flash | US$ 0,0028 / 1M | US$ 0,14 / 1M | US$ 0,28 / 1M |
deepseek-v4-pro | US$ 0,003625 / 1M | US$ 0,435 / 1M | US$ 0,87 / 1M |
V4 Flash é a opção econômica e o ponto de partida para a maioria das cargas. V4 Pro é uma atualização opcional para tarefas em que o ganho de qualidade compensa o custo maior. Conheça as diferenças no guia do DeepSeek V4.
Preço por mil e por 100 mil tokens
A cobrança real não exige lotes exatos de 1 milhão. Os valores abaixo são apenas conversões da tarifa oficial para facilitar estimativas menores.
| Modelo e tipo de token | Por 1 mil tokens | Por 100 mil tokens |
|---|---|---|
| V4 Flash — entrada com cache | US$ 0,0000028 | US$ 0,00028 |
| V4 Flash — entrada sem cache | US$ 0,00014 | US$ 0,014 |
| V4 Flash — saída | US$ 0,00028 | US$ 0,028 |
| V4 Pro — entrada com cache | US$ 0,000003625 | US$ 0,0003625 |
| V4 Pro — entrada sem cache | US$ 0,000435 | US$ 0,0435 |
| V4 Pro — saída | US$ 0,00087 | US$ 0,087 |
Como calcular o custo da API
A conta inclui três parcelas:
Custo =
(tokens de entrada com cache ÷ 1.000.000 × tarifa de cache hit)
+ (tokens de entrada sem cache ÷ 1.000.000 × tarifa de cache miss)
+ (tokens de saída ÷ 1.000.000 × tarifa de saída)
Use os números retornados no campo usage da resposta da API para conferir a cobrança. Uma estimativa baseada apenas em caracteres, palavras ou páginas pode divergir da tokenização real.
Exemplo 1: V4 Flash sem acerto de cache
Em um conjunto de requisições, a carga soma 1 milhão de tokens de entrada sem cache e 500 mil tokens de saída. Esses valores são totais agregados e não descrevem uma única requisição, pois cada modelo possui contexto de 1M e saída máxima anunciada de 384K:
- Entrada: 1 × US$ 0,14 = US$ 0,14.
- Saída: 0,5 × US$ 0,28 = US$ 0,14.
- Total estimado: US$ 0,28.
Exemplo 2: a mesma carga no V4 Pro
No mesmo conjunto agregado de requisições, agora processado com o V4 Pro:
- Entrada: 1 × US$ 0,435 = US$ 0,435.
- Saída: 0,5 × US$ 0,87 = US$ 0,435.
- Total estimado: US$ 0,87.
Exemplo 3: V4 Flash com parte da entrada em cache
Uma requisição contabiliza 700 mil tokens com cache hit, 200 mil sem cache e 100 mil de saída, totalizando 1 milhão de tokens dentro da janela de contexto:
- Cache hit: 0,7 × US$ 0,0028 = US$ 0,00196.
- Cache miss: 0,2 × US$ 0,14 = US$ 0,028.
- Saída: 0,1 × US$ 0,28 = US$ 0,028.
- Total estimado: US$ 0,05796.
Esses exemplos isolam o custo dos tokens. Impostos, câmbio, taxas do meio de pagamento e custos da sua própria infraestrutura podem alterar o valor final do projeto.
O que significa cache hit no preço?
O Context Caching tenta reaproveitar unidades persistidas de um prefixo de entrada repetido. Quando há acerto, os tokens correspondentes recebem a tarifa de cache hit; o restante é cobrado como cache miss. O mecanismo não reutiliza uma resposta pronta e não garante que toda repetição produzirá um acerto.
Estruture instruções e documentos estáveis no início do prompt e conteúdo variável depois deles. Em seguida, acompanhe prompt_cache_hit_tokens e prompt_cache_miss_tokens em usage. Veja os detalhes e as limitações no guia de DeepSeek Context Caching.
V4 Flash ou V4 Pro: qual custa menos no seu caso?
| Critério | V4 Flash | V4 Pro |
|---|---|---|
| Estratégia inicial | Use como baseline | Teste como upgrade opcional |
| Melhor ajuste | Volume, velocidade, classificação, extração, resumo e chat | Raciocínio exigente, código complexo e agentes avançados |
| Como decidir | Compare qualidade, latência, tokens de saída, taxa de correção humana e custo por tarefa concluída | |
Um modelo com tarifa menor pode sair mais caro se exigir muitas novas tentativas; um modelo mais caro pode ser desperdício quando o Flash já atende ao critério de qualidade. Faça a comparação com exemplos reais e avalie custo por resultado aprovado, não apenas preço por token.
Limites de concorrência e impacto no orçamento
A documentação atual informa limites de 2.500 conexões concorrentes por conta para V4 Flash e 500 para V4 Pro. A contagem ocorre no nível da conta, independentemente do número de chaves. Ao exceder o limite, a API retorna HTTP 429.
Isso não é uma franquia de tokens nem uma cobrança extra: é um controle de capacidade. Implemente fila, backoff com jitter, timeout e monitoramento. A documentação também permite solicitar expansão de capacidade, sujeita a avaliação. Para implementação, consulte o guia da DeepSeek API em português e o diagnóstico de erros HTTP 429 e outros códigos.
Saldo, cobrança, moeda e meios de pagamento
- Saldo: quando a conta possui saldo concedido e saldo recarregado, a documentação informa que o saldo concedido é usado primeiro.
- Moeda: a tabela oficial é publicada em dólar americano. Não fixamos conversões para real ou euro porque a cotação e as taxas variam.
- Pagamento: consulte no painel da sua conta quais métodos estão disponíveis para seu país e perfil. A lista pode mudar.
- Orçamento: considere também impostos, backend, observabilidade, armazenamento, revisão humana e serviços de terceiros.
Checklist para controlar custos
- Comece com V4 Flash e defina um conjunto fixo de avaliação.
- Limite o tamanho da entrada e da saída conforme a tarefa.
- Evite reenviar histórico que não contribui para a resposta.
- Organize prefixos estáveis para aumentar a chance de cache hit.
- Registre tokens e custo por usuário, recurso e tarefa sem expor conteúdo sensível.
- Defina alertas, cotas internas e bloqueio quando o orçamento for atingido.
- Compare o V4 Pro apenas nos casos em que há espaço mensurável para ganho.
- Revise a página oficial de preços antes de cada previsão financeira importante.
Perguntas frequentes sobre preços
O DeepSeek é gratuito?
O chat e o aplicativo oficial estavam disponíveis gratuitamente em 19 de julho de 2026, sujeitos a condições e limites do produto. A API é um serviço separado e cobrado por tokens.
A DeepSeek API tem plano gratuito?
Não trate a API como gratuita. Uma conta pode possuir saldo concedido, mas isso não transforma a tarifa em zero nem garante novos créditos. Verifique o saldo e as regras diretamente no painel oficial.
Thinking Mode tem outra tarifa?
A tabela oficial diferencia modelo e tipo de token, não publica uma tarifa separada para ligar o Thinking Mode. Porém, a quantidade de tokens processados e gerados pode mudar; meça o campo usage em cargas reais.
Cache hit significa resposta grátis?
Não. Apenas os tokens de entrada que obtêm acerto recebem a tarifa reduzida. Tokens sem acerto e tokens de saída continuam cobrados.
Qual modelo devo usar para economizar?
Comece com deepseek-v4-flash. Compare o Pro apenas quando uma avaliação controlada mostrar ganho relevante. A escolha final deve considerar custo por tarefa aprovada.
Fontes oficiais consultadas
- Models & Pricing — tarifas, recursos e concorrência
- Token & Token Usage — contagem e campo usage
- Rate Limit & Isolation — limites e expansão de capacidade
- Site oficial da DeepSeek — acesso ao chat, app e API
Transparência editorial: conteúdo independente, sem parceria, patrocínio ou endosso da DeepSeek. Informações verificadas em 19 de julho de 2026.