Modelos DeepSeek: famílias, status e como escolher

Esta página organiza os principais modelos DeepSeek por status e forma de acesso: API oficial hospedada, aliases legados, pesos publicados e gerações anteriores. Essa distinção é essencial porque o nome de uma família, um checkpoint para download e um ID aceito pela API não são a mesma coisa.

Para separar chat, aplicativo, modelos e API antes de escolher uma família, consulte a visão geral do DeepSeek em português.

Atualização documental — 23 de agosto de 2026. A API hospedada documenta três IDs: deepseek-v4-flash, deepseek-v4-pro e o experimental deepseek-v4-flash-vision-exp. Flash e Pro recebem texto; o Vision Exp recebe texto e imagens em Chat Completions, Responses API e Anthropic API. A existência do Vision Exp não transforma DeepSeek-VL ou DeepSeek-VL2 em IDs hospedados atuais.

Catálogo hospedado atual

ID da APIEntradaEstado documentadoUso inicialLimite de concorrência
deepseek-v4-flashTextoFlash-0731, beta públicoBaseline de custo, escala e tarefas gerais2.500
deepseek-v4-proTextoPro-0813, disponibilidade geralCasos complexos validados por avaliação própria500
deepseek-v4-flash-vision-expTexto e imagensExperimental, lançado em 21/08/2026Screenshots, gráficos, OCR assistido e agentes com percepção visual2.500

Os três modelos têm contexto documentado de 1 milhão de tokens, saída máxima de 384 mil tokens, Thinking e Non-Thinking Mode, JSON Output, Tool Calls, Responses API, Anthropic API e Chat Prefix Completion. FIM Completion é documentado somente para Flash e Pro em Non-Thinking Mode; não é suportado pelo Vision Exp.

Segundo a própria DeepSeek, o Vision Exp mantém capacidade de texto próxima à do V4 Flash e acrescenta compreensão visual. Essa é uma afirmação do fornecedor, não uma conclusão dos testes deste site. Valide qualidade, latência e custo com imagens representativas do seu uso.

Retrato histórico: a consulta GET /models abaixo retornou dois IDs em 29/07/2026. Ela registra aquele momento e não representa o catálogo atual após o lançamento do Vision Exp em 21/08/2026. Para o estado vigente, use a tabela “Catálogo hospedado atual” acima.

Snapshot autenticado de 29/07/2026 — preservar como histórico

Em 29 de julho de 2026, consultamos o endpoint autenticado GET /models. A resposta foi HTTP 200 e anunciou exatamente dois IDs: deepseek-v4-flash e deepseek-v4-pro.

Catálogo autenticado da DeepSeek API com V4 Flash e V4 Pro listados em GET models
Consulta original a GET /models em 29 de julho de 2026. A API listou V4 Flash e V4 Pro; aliases e R1 ficaram fora do catálogo.
NomeEm GET /modelsInterpretaçãoAção
deepseek-v4-flashSimID atual hospedadoBaseline para código novo
deepseek-v4-proSimID atual hospedadoAvaliar quando a tarefa justificar maior custo
deepseek-chatNãoAlias legado aceito em uma chamada isoladaNão usar em código novo
deepseek-reasonerNãoAlias legado aceito em uma chamada isoladaUsar V4 com Thinking explícito
deepseek-r1NãoFamília/checkpoint, não ID anunciadoSeparar API atual de execução própria

A ausência no catálogo não prova, sozinha, que toda chamada falhará: os dois aliases responderam em testes separados. Ela mostra que esses nomes não integram o catálogo anunciado e podem desaparecer. Consulte a auditoria completa da API.

Metodologia e limites

  • Consulta iniciada em 2026-07-29T17:42:07.789Z.
  • HTTP 200 em 499 ms; uma consulta autenticada, sem repetição.
  • O tempo registrado não é benchmark e o catálogo pode mudar.

Fonte oficial: Lists Models.

Status documental em 24 de agosto de 2026: a API hospedada documenta deepseek-v4-flash, deepseek-v4-pro e o experimental deepseek-v4-flash-vision-exp; a tabela oficial identifica Flash-0731 em beta público, Pro-0813 em GA e Vision Exp como experimental. A consulta GET /models abaixo ocorreu em 29/07 e comprova somente os IDs retornados naquela data.

Este é um índice editorial independente, não um catálogo oficial. Não somos a DeepSeek e não representamos parceria, autorização ou endosso da empresa.

Status atual em 30 segundos

  • deepseek-v4-flash, deepseek-v4-pro e deepseek-v4-flash-vision-exp são os três IDs hospedados documentados.
  • Flash e Pro são modelos de entrada textual. Vision Exp é o único dos três documentado para texto e imagens.
  • Os três oferecem Thinking e Non-Thinking Mode; Thinking permanece ativado por padrão.
  • deepseek-chat e deepseek-reasoner são aliases legados fora do catálogo recomendado para código novo.
  • DeepSeek R1, V3.x, Coder, Math, DeepSeek-VL e DeepSeek-VL2 são famílias ou checkpoints históricos, não IDs atuais da API hospedada.
  • Um modelo disponível por self-hosting ou por provedor terceiro pode ter preço, versão, retenção e contrato diferentes da API oficial.

Família, ID da API e checkpoint não são a mesma coisa

TermoSignificadoExemplo
FamíliaGeração ou linha de pesquisaDeepSeek V4 ou DeepSeek R1
Produto hospedadoServiço operado pela DeepSeekChat, App ou API oficial
ID da APINome enviado no campo modeldeepseek-v4-flash
CheckpointConjunto específico de pesos para downloadDeepSeek-R1-0528
AliasNome de compatibilidade que aponta para outro modelo ou mododeepseek-reasoner
QuantizaçãoConversão para reduzir memória ou mudar formatoUma variante criada para um runtime específico

Um checkpoint aparecer no Hugging Face ou em um provedor externo não faz dele um ID da API oficial. Do mesmo modo, um alias pode mudar de destino ou ser removido. Para código de produção, consulte a lista de modelos do serviço que realmente será usado.

IDs atuais e aliases legados

IDStatus em 23/08/2026EntradaAção recomendada
deepseek-v4-flashAtualTextoPonto de partida para novas integrações textuais
deepseek-v4-proAtualTextoTeste como upgrade opcional
deepseek-v4-flash-vision-expAtual; experimentalTexto e imagensUse somente quando houver entrada visual
deepseek-chatAlias legado; prazo encerradoTextoMigrar para o ID explícito
deepseek-reasonerAlias legado; prazo encerradoTextoMigrar para Flash com Thinking e validar

Os três modelos V4 têm contexto de até 1 milhão de tokens e saída máxima anunciada de 384 mil. Flash e Pro recebem texto; Vision Exp é o modelo multimodal experimental. Para recursos, modos e limitações, leia o guia do DeepSeek V4.

Principais famílias de modelos DeepSeek

DeepSeek V4

Status: geração hospedada atual. Flash-0731 está em beta público, Pro-0813 em disponibilidade geral e Vision Exp é experimental. A API oferece deepseek-v4-flash, deepseek-v4-pro e deepseek-v4-flash-vision-exp; os três suportam Thinking e Non-Thinking Mode.

DeepSeek R1

Status: família de raciocínio com checkpoints publicados, incluindo R1, R1-Zero, R1-0528 e variantes distilled. R1 foi associado historicamente ao nome deepseek-reasoner, mas não é um ID atual da API oficial hospedada. Para pesos, versões e formas de execução, consulte o guia do DeepSeek R1.

DeepSeek V3.2

Status: geração anterior e pesos publicados, não um ID atual da API oficial. O V3.2 Speciale teve um endpoint temporário cujo acesso terminou em 15 de dezembro de 2025, às 15:59 UTC. Um provedor terceiro ou implantação própria pode oferecer checkpoints diferentes, mas isso não reativa o endpoint oficial. Veja o guia do DeepSeek V3.2.

DeepSeek V3.2-Exp

Status: versão experimental histórica que apresentou o DeepSeek Sparse Attention (DSA) e antecedeu o V3.2. Não é um ID atual da API hospedada e não deve ser confundida com o Vision Exp da geração V4. Consulte o guia do DeepSeek V3.2-Exp.

DeepSeek V3.1 e V3

Status: gerações anteriores com checkpoints e variantes publicadas. Continuam relevantes para pesquisa, reprodução de resultados e ambientes que escolheram uma versão fixa, mas não devem ser apresentadas como os IDs atuais da API. Consulte os guias de DeepSeek V3.1 e DeepSeek V3 e verifique a licença da versão exata.

DeepSeek V2

Status: geração anterior importante na evolução da arquitetura MoE da DeepSeek, hoje mais relevante como referência técnica e checkpoint do que como escolha da API hospedada atual. Veja o guia do DeepSeek V2.

DeepSeek Coder

Status: linha especializada em código, com checkpoints como Coder e Coder V2. Esses nomes não aparecem como IDs atuais no catálogo hospedado. Para uma aplicação nova via API oficial, teste V4 Flash e V4 Pro no seu conjunto de programação antes de decidir por self-hosting. Consulte o guia do DeepSeek Coder.

DeepSeek VL e OCR

Status: famílias multimodais com checkpoints publicados para execução própria, incluindo DeepSeek-VL e DeepSeek-VL2. Elas não são o mesmo produto que o ID hospedado experimental deepseek-v4-flash-vision-exp. Veja o guia do DeepSeek VL e VL2 e, para a opção hospedada atual, o guia do DeepSeek V4.

DeepSeek Math e Prover

Status: linhas de pesquisa e checkpoints especializados em matemática e demonstração formal. Podem ser úteis para estudo ou implantação própria, mas não são IDs atuais da API hospedada. Resultados dependem da versão, do benchmark e da configuração de inferência. Veja o guia do DeepSeek Math.

Modelos destilados

Status: checkpoints menores treinados para transferir parte do comportamento de uma família maior para bases como Qwen ou Llama. “Distill” não significa que o modelo seja idêntico ao R1 completo. Hardware, contexto, licença, qualidade e formato variam por checkpoint.

Linha do tempo oficial das famílias DeepSeek V2, V3, R1, V3.1, V3.2 e V4 entre maio de 2024 e julho de 2026.
Linha do tempo documental das famílias DeepSeek e do status atual da API hospedada.

Como esta linha do tempo foi montada

A arte cruza os anúncios e o histórico oficial da API com os repositórios publicados pela DeepSeek. Ela separa três estados que tutoriais antigos costumam misturar: família lançada, pesos ainda disponíveis para execução própria e modelo atualmente hospedado pela API. Em 29 de julho de 2026, a lista documentada da API apresenta somente deepseek-v4-flash e deepseek-v4-pro.

Limite da verificação: em 29 de julho de 2026, usamos uma chave temporária para consultar GET /models e fazer uma chamada isolada a cada alias legado após o prazo anunciado de 24 de julho. Nesta conta, deepseek-chat e deepseek-reasoner responderam HTTP 200 e retornaram V4 Flash; o primeiro em Non-Thinking e o segundo em Thinking. Isso é uma observação pontual, não garantia de suporte: ambos ficaram fora do catálogo atual e podem deixar de funcionar sem aviso. Para código novo, use um ID V4 explícito e confirme GET /models.

Ponto de partida na API atual

EscolhaQuando começar por ela
V4 FlashTexto, chat, extração, classificação, resumo, alto volume e baseline de custo
V4 Flash com ThinkingRaciocínio textual com foco em eficiência e migração de deepseek-reasoner
V4 ProTexto complexo, agentes ou análise quando testes mostram ganho suficiente
V4 Flash Vision ExpEntrada visual: screenshots, gráficos, OCR assistido ou imagem com texto

Não selecione o Pro apenas porque a tarefa envolve raciocínio: Flash também oferece Thinking. Não selecione Vision Exp para uma tarefa somente textual; ele é experimental e existe para entradas com imagem.

API, App, pesos próprios ou provedor terceiro?

Forma de acessoQuem gerencia a infraestrutura?Modelos disponíveisUso típico
Chat e AppDeepSeekSeleção feita pelo produtoUso individual e tarefas manuais
API oficialDeepSeekIDs atuais documentadosAplicativos e integrações
Pesos própriosSua equipeCheckpoints compatíveis escolhidos por vocêPesquisa, personalização e controle de implantação
Provedor terceiroO provedorCatálogo, versão e aliases própriosNuvem ou interface alternativa

Em um provedor terceiro, preço, região, retenção, contexto e até o nome do modelo podem diferir da API oficial. Registre fornecedor, versão exata, data e configuração nos testes para evitar comparar produtos diferentes.

Como escolher o modelo certo

  1. Defina a tarefa: entrada, saída, idioma, formato e condições de recusa.
  2. Escolha a forma de acesso: Chat, App, API, pesos próprios ou provedor terceiro.
  3. Crie uma avaliação: use exemplos normais, difíceis, raros e adversariais.
  4. Comece pelo baseline: na API atual, normalmente V4 Flash.
  5. Compare alternativas: meça qualidade, latência, custo, tokens, falhas e esforço de correção.
  6. Cheque recursos: contexto, Thinking, ferramentas, JSON, runtime e hardware.
  7. Revise governança: licença, privacidade, região, segurança, retenção e responsável humano.
  8. Fixe a versão: monitore mudanças de alias e repita testes antes de migrar.

Se você ainda está escolhendo a aplicação, use a matriz de casos de uso do DeepSeek. Se o fator decisivo é orçamento, consulte os preços atuais da DeepSeek API.

Licenças, pesos e quantizações

  • Leia a licença e o model card do checkpoint exato, não apenas da família.
  • “Open weights” não significa domínio público, ausência de condições ou código inteiramente aberto.
  • Uma quantização comunitária não deve ser atribuída automaticamente à DeepSeek.
  • Confirme quem criou o arquivo, hash, formato e compatibilidade do runtime.
  • Meça perda de qualidade, velocidade, memória e estabilidade na sua infraestrutura.
  • Inclua energia, hardware, nuvem, operação e equipe no custo total.

Como interpretar benchmarks

Um benchmark é evidência sobre uma configuração específica, não uma classificação universal. Antes de repetir uma afirmação, confirme quem publicou o dado, a versão do modelo, o modo de raciocínio, as ferramentas, o orçamento de tokens e o método de avaliação.

  • Atribua resultados do relatório da DeepSeek à própria DeepSeek.
  • Não compare pontuações obtidas em versões ou protocolos diferentes como se fossem equivalentes.
  • Evite superlativos como “melhor do mundo” sem escopo e fonte.
  • Teste português brasileiro e português europeu separadamente quando ambos forem importantes.
  • Meça qualidade e falhas no seu conjunto de produção, além do benchmark público.

Perguntas frequentes

Quais são os IDs atuais da DeepSeek API?

A documentação vigente apresenta deepseek-v4-flash, deepseek-v4-pro e deepseek-v4-flash-vision-exp. O terceiro é experimental e é o único dos três documentado para receber imagens.

DeepSeek R1 ainda está na API oficial?

Em 29/07/2026, os aliases legados responderam HTTP 200 e retornaram V4 Flash nesta conta, embora não aparecessem em GET /models. Isso é compatibilidade observada, não garantia. A seção de catálogo abaixo contém a evidência completa.

V4 Pro é o novo deepseek-reasoner?

Não como equivalência oficial. Migre primeiro para V4 Flash com Thinking. Adote Pro somente se seus testes justificarem o upgrade.

O endpoint V3.2 Speciale ainda funciona?

Não. O acesso temporário oficial terminou em 15 de dezembro de 2025, às 15:59 UTC.

Todo modelo do Hugging Face está na API?

Não. Um repositório de pesos é diferente de um produto hospedado. Use somente IDs retornados e documentados pela API escolhida.

Posso executar um modelo DeepSeek localmente?

Alguns checkpoints têm pesos publicados, mas a viabilidade depende de licença, hardware, quantização, runtime e requisitos de segurança. Modelos grandes podem demandar infraestrutura especializada.

Flash ou Pro para começar?

Comece com V4 Flash e um conjunto de avaliações. Compare o Pro nos casos em que o Flash não atinge o critério de qualidade.

Fontes oficiais consultadas

Transparência editorial: este índice é independente. Disponibilidade em provedor terceiro não equivale a disponibilidade na API oficial. Informações verificadas documentalmente em 24 de agosto de 2026; a consulta autenticada permanece datada de 29 de julho de 2026.