Modelos DeepSeek: famílias, status e como escolher

Esta página organiza os principais modelos DeepSeek por status e forma de acesso: API oficial hospedada, aliases legados, pesos publicados e gerações anteriores. Essa distinção é essencial porque o nome de uma família, um checkpoint para download e um ID aceito pela API não são a mesma coisa.

Catálogo hospedado verificado via GET /models

Em 29 de julho de 2026, consultamos o endpoint autenticado GET /models. A resposta foi HTTP 200 e anunciou exatamente dois IDs: deepseek-v4-flash e deepseek-v4-pro.

Catálogo autenticado da DeepSeek API com V4 Flash e V4 Pro listados em GET models
Consulta original a GET /models em 29 de julho de 2026. A API listou V4 Flash e V4 Pro; aliases e R1 ficaram fora do catálogo.
NomeEm GET /modelsInterpretaçãoAção
deepseek-v4-flashSimID atual hospedadoBaseline para código novo
deepseek-v4-proSimID atual hospedadoAvaliar quando a tarefa justificar maior custo
deepseek-chatNãoAlias legado aceito em uma chamada isoladaNão usar em código novo
deepseek-reasonerNãoAlias legado aceito em uma chamada isoladaUsar V4 com Thinking explícito
deepseek-r1NãoFamília/checkpoint, não ID anunciadoSeparar API atual de execução própria

A ausência no catálogo não prova, sozinha, que toda chamada falhará: os dois aliases responderam em testes separados. Ela mostra que esses nomes não integram o catálogo anunciado e podem desaparecer. Consulte a auditoria completa da API.

Metodologia e limites

  • Consulta iniciada em 2026-07-29T17:42:07.789Z.
  • HTTP 200 em 499 ms; uma consulta autenticada, sem repetição.
  • O tempo registrado não é benchmark e o catálogo pode mudar.

Fonte oficial: Lists Models.

Status verificado em 29 de julho de 2026: os IDs atuais da API oficial são deepseek-v4-flash e deepseek-v4-pro. deepseek-r1 e deepseek-v3-2 não são IDs atuais da API hospedada.

Este é um índice editorial independente, não um catálogo oficial. Não somos a DeepSeek e não representamos parceria, autorização ou endosso da empresa.

Status atual em 30 segundos

  • deepseek-v4-flash e deepseek-v4-pro são os dois IDs atuais da API hospedada.
  • Flash e Pro oferecem Thinking e Non-Thinking Mode; Thinking fica ativado por padrão.
  • A DeepSeek anunciou a retirada dos aliases após 24 de julho de 2026. Em 29/07/2026, ambos ainda responderam nesta conta e retornaram V4 Flash, embora ausentes de GET /models; compatibilidade observada, sem garantia.
  • Durante a janela de compatibilidade documentada, deepseek-reasoner foi mapeado para V4 Flash com Thinking — não para V4 Pro.
  • V4 Pro é um upgrade opcional para tarefas mais exigentes.
  • DeepSeek R1 é uma família de raciocínio e checkpoints; não é um ID hospedado atual.
  • O endpoint temporário do V3.2 Speciale terminou em 15 de dezembro de 2025, às 15:59 UTC.

Família, ID da API e checkpoint não são a mesma coisa

TermoSignificadoExemplo
FamíliaGeração ou linha de pesquisaDeepSeek V4 ou DeepSeek R1
Produto hospedadoServiço operado pela DeepSeekChat, App ou API oficial
ID da APINome enviado no campo modeldeepseek-v4-flash
CheckpointConjunto específico de pesos para downloadDeepSeek-R1-0528
AliasNome de compatibilidade que aponta para outro modelo ou mododeepseek-reasoner
QuantizaçãoConversão para reduzir memória ou mudar formatoUma variante criada para um runtime específico

Um checkpoint aparecer no Hugging Face ou em um provedor externo não faz dele um ID da API oficial. Do mesmo modo, um alias pode mudar de destino ou ser removido. Para código de produção, consulte a lista de modelos do serviço que realmente será usado.

IDs atuais e aliases legados

IDStatus em 29/07/2026PerfilAção recomendada
deepseek-v4-flashAtualVelocidade, economia, escala e raciocínio eficientePonto de partida para novas integrações
deepseek-v4-proAtualTarefas complexas, conhecimento, código e agentes avançadosTeste como upgrade opcional
deepseek-chatAlias legado; prazo encerradoMapeamento documentado na transição: V4 Flash em Non-ThinkingMigrar para o ID explícito e confirmar GET /models
deepseek-reasonerAlias legado; prazo encerradoMapeamento documentado na transição: V4 Flash em ThinkingMigrar para Flash com Thinking ativado e confirmar GET /models

Os dois modelos V4 têm contexto de até 1 milhão de tokens e saída máxima anunciada de 384 mil. Para recursos, arquitetura, modos e limitações, leia o guia de DeepSeek V4 Flash vs Pro. Para código, autenticação e migração, use a documentação da API em português.

Principais famílias de modelos DeepSeek

DeepSeek V4

Status: geração atual em Preview, disponível nos produtos oficiais e com pesos publicados. A API oferece Flash e Pro. Flash prioriza eficiência; Pro busca maior capacidade em tarefas exigentes. Os dois funcionam em Thinking e Non-Thinking Mode.

DeepSeek R1

Status: família de raciocínio com checkpoints publicados, incluindo R1, R1-Zero, R1-0528 e variantes distilled. R1 foi associado historicamente ao nome deepseek-reasoner, mas não é um ID atual da API oficial hospedada. Para pesos, versões e formas de execução, consulte o guia do DeepSeek R1.

DeepSeek V3.2

Status: geração anterior e pesos publicados, não um ID atual da API oficial. O V3.2 Speciale teve um endpoint temporário cujo acesso terminou em 15 de dezembro de 2025, às 15:59 UTC. Um provedor terceiro ou implantação própria pode oferecer checkpoints diferentes, mas isso não reativa o endpoint oficial. Veja o guia do DeepSeek V3.2.

DeepSeek V3.1 e V3

Status: gerações anteriores com checkpoints e variantes publicadas. Continuam relevantes para pesquisa, reprodução de resultados e ambientes que escolheram uma versão fixa, mas não devem ser apresentadas como os IDs atuais da API. Consulte os guias de DeepSeek V3.1 e DeepSeek V3 e verifique a licença da versão exata.

DeepSeek V2

Status: geração anterior importante na evolução da arquitetura MoE da DeepSeek, hoje mais relevante como referência técnica e checkpoint do que como escolha da API hospedada atual. Veja o guia do DeepSeek V2.

DeepSeek Coder

Status: linha especializada em código, com checkpoints como Coder e Coder V2. Esses nomes não aparecem como IDs atuais no catálogo hospedado. Para uma aplicação nova via API oficial, teste V4 Flash e V4 Pro no seu conjunto de programação antes de decidir por self-hosting. Consulte o guia do DeepSeek Coder.

DeepSeek VL e OCR

Status: famílias e projetos voltados a visão, documentos e reconhecimento de conteúdo visual. Não confunda a existência de checkpoints multimodais ou o Vision Mode do aplicativo com suporte de imagem nos IDs atuais de Chat Completions. Confirme endpoint, formato de entrada, licença e versão de cada solução no guia do DeepSeek VL.

DeepSeek Math e Prover

Status: linhas de pesquisa e checkpoints especializados em matemática e demonstração formal. Podem ser úteis para estudo ou implantação própria, mas não são IDs atuais da API hospedada. Resultados dependem da versão, do benchmark e da configuração de inferência. Veja o guia do DeepSeek Math.

Modelos destilados

Status: checkpoints menores treinados para transferir parte do comportamento de uma família maior para bases como Qwen ou Llama. “Distill” não significa que o modelo seja idêntico ao R1 completo. Hardware, contexto, licença, qualidade e formato variam por checkpoint.

Linha do tempo oficial das famílias DeepSeek V2, V3, R1, V3.1, V3.2 e V4 entre maio de 2024 e julho de 2026.
Linha do tempo documental das famílias DeepSeek e do status atual da API hospedada.

Como esta linha do tempo foi montada

A arte cruza os anúncios e o histórico oficial da API com os repositórios publicados pela DeepSeek. Ela separa três estados que tutoriais antigos costumam misturar: família lançada, pesos ainda disponíveis para execução própria e modelo atualmente hospedado pela API. Em 29 de julho de 2026, a lista documentada da API apresenta somente deepseek-v4-flash e deepseek-v4-pro.

Limite da verificação: em 29 de julho de 2026, usamos uma chave temporária para consultar GET /models e fazer uma chamada isolada a cada alias legado após o prazo anunciado de 24 de julho. Nesta conta, deepseek-chat e deepseek-reasoner responderam HTTP 200 e retornaram V4 Flash; o primeiro em Non-Thinking e o segundo em Thinking. Isso é uma observação pontual, não garantia de suporte: ambos ficaram fora do catálogo atual e podem deixar de funcionar sem aviso. Para código novo, use um ID V4 explícito e confirme GET /models.

Ponto de partida na API atual

EscolhaQuando começar por ela
V4 FlashChat, extração, classificação, resumo, alto volume e baseline de custo
V4 Flash com ThinkingRaciocínio com foco em eficiência e migração de deepseek-reasoner
V4 ProCódigo complexo, agentes ou análise em que testes mostram ganho suficiente para justificar maior custo

Não selecione o Pro apenas porque a tarefa envolve “raciocínio”. Flash também oferece Thinking Mode e é o caminho oficial de compatibilidade para o antigo Reasoner. Compare as duas opções usando a mesma entrada, rubrica e limite de saída.

API, App, pesos próprios ou provedor terceiro?

Forma de acessoQuem gerencia a infraestrutura?Modelos disponíveisUso típico
Chat e AppDeepSeekSeleção feita pelo produtoUso individual e tarefas manuais
API oficialDeepSeekIDs atuais documentadosAplicativos e integrações
Pesos própriosSua equipeCheckpoints compatíveis escolhidos por vocêPesquisa, personalização e controle de implantação
Provedor terceiroO provedorCatálogo, versão e aliases própriosNuvem ou interface alternativa

Em um provedor terceiro, preço, região, retenção, contexto e até o nome do modelo podem diferir da API oficial. Registre fornecedor, versão exata, data e configuração nos testes para evitar comparar produtos diferentes.

Como escolher o modelo certo

  1. Defina a tarefa: entrada, saída, idioma, formato e condições de recusa.
  2. Escolha a forma de acesso: Chat, App, API, pesos próprios ou provedor terceiro.
  3. Crie uma avaliação: use exemplos normais, difíceis, raros e adversariais.
  4. Comece pelo baseline: na API atual, normalmente V4 Flash.
  5. Compare alternativas: meça qualidade, latência, custo, tokens, falhas e esforço de correção.
  6. Cheque recursos: contexto, Thinking, ferramentas, JSON, runtime e hardware.
  7. Revise governança: licença, privacidade, região, segurança, retenção e responsável humano.
  8. Fixe a versão: monitore mudanças de alias e repita testes antes de migrar.

Se você ainda está escolhendo a aplicação, use a matriz de casos de uso do DeepSeek. Se o fator decisivo é orçamento, consulte os preços atuais da DeepSeek API.

Licenças, pesos e quantizações

  • Leia a licença e o model card do checkpoint exato, não apenas da família.
  • “Open weights” não significa domínio público, ausência de condições ou código inteiramente aberto.
  • Uma quantização comunitária não deve ser atribuída automaticamente à DeepSeek.
  • Confirme quem criou o arquivo, hash, formato e compatibilidade do runtime.
  • Meça perda de qualidade, velocidade, memória e estabilidade na sua infraestrutura.
  • Inclua energia, hardware, nuvem, operação e equipe no custo total.

Como interpretar benchmarks

Um benchmark é evidência sobre uma configuração específica, não uma classificação universal. Antes de repetir uma afirmação, confirme quem publicou o dado, a versão do modelo, o modo de raciocínio, as ferramentas, o orçamento de tokens e o método de avaliação.

  • Atribua resultados do relatório da DeepSeek à própria DeepSeek.
  • Não compare pontuações obtidas em versões ou protocolos diferentes como se fossem equivalentes.
  • Evite superlativos como “melhor do mundo” sem escopo e fonte.
  • Teste português brasileiro e português europeu separadamente quando ambos forem importantes.
  • Meça qualidade e falhas no seu conjunto de produção, além do benchmark público.

Perguntas frequentes

Quais são os IDs atuais da DeepSeek API?

deepseek-v4-flash e deepseek-v4-pro, segundo a documentação verificada em 29 de julho de 2026.

DeepSeek R1 ainda está na API oficial?

Em 29/07/2026, os aliases legados responderam HTTP 200 e retornaram V4 Flash nesta conta, embora não aparecessem em GET /models. Isso é compatibilidade observada, não garantia. A seção de catálogo abaixo contém a evidência completa.

V4 Pro é o novo deepseek-reasoner?

Não como equivalência oficial. Migre primeiro para V4 Flash com Thinking. Adote Pro somente se seus testes justificarem o upgrade.

O endpoint V3.2 Speciale ainda funciona?

Não. O acesso temporário oficial terminou em 15 de dezembro de 2025, às 15:59 UTC.

Todo modelo do Hugging Face está na API?

Não. Um repositório de pesos é diferente de um produto hospedado. Use somente IDs retornados e documentados pela API escolhida.

Posso executar um modelo DeepSeek localmente?

Alguns checkpoints têm pesos publicados, mas a viabilidade depende de licença, hardware, quantização, runtime e requisitos de segurança. Modelos grandes podem demandar infraestrutura especializada.

Flash ou Pro para começar?

Comece com V4 Flash e um conjunto de avaliações. Compare o Pro nos casos em que o Flash não atinge o critério de qualidade.

Fontes oficiais consultadas

Transparência editorial: este índice é independente. Disponibilidade em provedor terceiro não equivale a disponibilidade na API oficial. Informações verificadas em 29 de julho de 2026.