Esta página organiza os principais modelos DeepSeek por status e forma de acesso: API oficial hospedada, aliases legados, pesos publicados e gerações anteriores. Essa distinção é essencial porque o nome de uma família, um checkpoint para download e um ID aceito pela API não são a mesma coisa.
Para separar chat, aplicativo, modelos e API antes de escolher uma família, consulte a visão geral do DeepSeek em português.
Atualização documental — 23 de agosto de 2026. A API hospedada documenta três IDs:
deepseek-v4-flash,deepseek-v4-proe o experimentaldeepseek-v4-flash-vision-exp. Flash e Pro recebem texto; o Vision Exp recebe texto e imagens em Chat Completions, Responses API e Anthropic API. A existência do Vision Exp não transforma DeepSeek-VL ou DeepSeek-VL2 em IDs hospedados atuais.
Catálogo hospedado atual
| ID da API | Entrada | Estado documentado | Uso inicial | Limite de concorrência |
|---|---|---|---|---|
deepseek-v4-flash | Texto | Flash-0731, beta público | Baseline de custo, escala e tarefas gerais | 2.500 |
deepseek-v4-pro | Texto | Pro-0813, disponibilidade geral | Casos complexos validados por avaliação própria | 500 |
deepseek-v4-flash-vision-exp | Texto e imagens | Experimental, lançado em 21/08/2026 | Screenshots, gráficos, OCR assistido e agentes com percepção visual | 2.500 |
Os três modelos têm contexto documentado de 1 milhão de tokens, saída máxima de 384 mil tokens, Thinking e Non-Thinking Mode, JSON Output, Tool Calls, Responses API, Anthropic API e Chat Prefix Completion. FIM Completion é documentado somente para Flash e Pro em Non-Thinking Mode; não é suportado pelo Vision Exp.
Segundo a própria DeepSeek, o Vision Exp mantém capacidade de texto próxima à do V4 Flash e acrescenta compreensão visual. Essa é uma afirmação do fornecedor, não uma conclusão dos testes deste site. Valide qualidade, latência e custo com imagens representativas do seu uso.
Retrato histórico: a consulta GET /models abaixo retornou dois IDs em 29/07/2026. Ela registra aquele momento e não representa o catálogo atual após o lançamento do Vision Exp em 21/08/2026. Para o estado vigente, use a tabela “Catálogo hospedado atual” acima.
Snapshot autenticado de 29/07/2026 — preservar como histórico
Em 29 de julho de 2026, consultamos o endpoint autenticado GET /models. A resposta foi HTTP 200 e anunciou exatamente dois IDs: deepseek-v4-flash e deepseek-v4-pro.

| Nome | Em GET /models | Interpretação | Ação |
|---|---|---|---|
deepseek-v4-flash | Sim | ID atual hospedado | Baseline para código novo |
deepseek-v4-pro | Sim | ID atual hospedado | Avaliar quando a tarefa justificar maior custo |
deepseek-chat | Não | Alias legado aceito em uma chamada isolada | Não usar em código novo |
deepseek-reasoner | Não | Alias legado aceito em uma chamada isolada | Usar V4 com Thinking explícito |
deepseek-r1 | Não | Família/checkpoint, não ID anunciado | Separar API atual de execução própria |
A ausência no catálogo não prova, sozinha, que toda chamada falhará: os dois aliases responderam em testes separados. Ela mostra que esses nomes não integram o catálogo anunciado e podem desaparecer. Consulte a auditoria completa da API.
Metodologia e limites
- Consulta iniciada em
2026-07-29T17:42:07.789Z. - HTTP 200 em 499 ms; uma consulta autenticada, sem repetição.
- O tempo registrado não é benchmark e o catálogo pode mudar.
Fonte oficial: Lists Models.
Status documental em 24 de agosto de 2026: a API hospedada documenta
deepseek-v4-flash,deepseek-v4-proe o experimentaldeepseek-v4-flash-vision-exp; a tabela oficial identifica Flash-0731 em beta público, Pro-0813 em GA e Vision Exp como experimental. A consultaGET /modelsabaixo ocorreu em 29/07 e comprova somente os IDs retornados naquela data.
Este é um índice editorial independente, não um catálogo oficial. Não somos a DeepSeek e não representamos parceria, autorização ou endosso da empresa.
Status atual em 30 segundos
deepseek-v4-flash,deepseek-v4-proedeepseek-v4-flash-vision-expsão os três IDs hospedados documentados.- Flash e Pro são modelos de entrada textual. Vision Exp é o único dos três documentado para texto e imagens.
- Os três oferecem Thinking e Non-Thinking Mode; Thinking permanece ativado por padrão.
deepseek-chatedeepseek-reasonersão aliases legados fora do catálogo recomendado para código novo.- DeepSeek R1, V3.x, Coder, Math, DeepSeek-VL e DeepSeek-VL2 são famílias ou checkpoints históricos, não IDs atuais da API hospedada.
- Um modelo disponível por self-hosting ou por provedor terceiro pode ter preço, versão, retenção e contrato diferentes da API oficial.
Família, ID da API e checkpoint não são a mesma coisa
| Termo | Significado | Exemplo |
|---|---|---|
| Família | Geração ou linha de pesquisa | DeepSeek V4 ou DeepSeek R1 |
| Produto hospedado | Serviço operado pela DeepSeek | Chat, App ou API oficial |
| ID da API | Nome enviado no campo model | deepseek-v4-flash |
| Checkpoint | Conjunto específico de pesos para download | DeepSeek-R1-0528 |
| Alias | Nome de compatibilidade que aponta para outro modelo ou modo | deepseek-reasoner |
| Quantização | Conversão para reduzir memória ou mudar formato | Uma variante criada para um runtime específico |
Um checkpoint aparecer no Hugging Face ou em um provedor externo não faz dele um ID da API oficial. Do mesmo modo, um alias pode mudar de destino ou ser removido. Para código de produção, consulte a lista de modelos do serviço que realmente será usado.
IDs atuais e aliases legados
| ID | Status em 23/08/2026 | Entrada | Ação recomendada |
|---|---|---|---|
deepseek-v4-flash | Atual | Texto | Ponto de partida para novas integrações textuais |
deepseek-v4-pro | Atual | Texto | Teste como upgrade opcional |
deepseek-v4-flash-vision-exp | Atual; experimental | Texto e imagens | Use somente quando houver entrada visual |
deepseek-chat | Alias legado; prazo encerrado | Texto | Migrar para o ID explícito |
deepseek-reasoner | Alias legado; prazo encerrado | Texto | Migrar para Flash com Thinking e validar |
Os três modelos V4 têm contexto de até 1 milhão de tokens e saída máxima anunciada de 384 mil. Flash e Pro recebem texto; Vision Exp é o modelo multimodal experimental. Para recursos, modos e limitações, leia o guia do DeepSeek V4.
Principais famílias de modelos DeepSeek
DeepSeek V4
Status: geração hospedada atual. Flash-0731 está em beta público, Pro-0813 em disponibilidade geral e Vision Exp é experimental. A API oferece deepseek-v4-flash, deepseek-v4-pro e deepseek-v4-flash-vision-exp; os três suportam Thinking e Non-Thinking Mode.
DeepSeek R1
Status: família de raciocínio com checkpoints publicados, incluindo R1, R1-Zero, R1-0528 e variantes distilled. R1 foi associado historicamente ao nome deepseek-reasoner, mas não é um ID atual da API oficial hospedada. Para pesos, versões e formas de execução, consulte o guia do DeepSeek R1.
DeepSeek V3.2
Status: geração anterior e pesos publicados, não um ID atual da API oficial. O V3.2 Speciale teve um endpoint temporário cujo acesso terminou em 15 de dezembro de 2025, às 15:59 UTC. Um provedor terceiro ou implantação própria pode oferecer checkpoints diferentes, mas isso não reativa o endpoint oficial. Veja o guia do DeepSeek V3.2.
DeepSeek V3.2-Exp
Status: versão experimental histórica que apresentou o DeepSeek Sparse Attention (DSA) e antecedeu o V3.2. Não é um ID atual da API hospedada e não deve ser confundida com o Vision Exp da geração V4. Consulte o guia do DeepSeek V3.2-Exp.
DeepSeek V3.1 e V3
Status: gerações anteriores com checkpoints e variantes publicadas. Continuam relevantes para pesquisa, reprodução de resultados e ambientes que escolheram uma versão fixa, mas não devem ser apresentadas como os IDs atuais da API. Consulte os guias de DeepSeek V3.1 e DeepSeek V3 e verifique a licença da versão exata.
DeepSeek V2
Status: geração anterior importante na evolução da arquitetura MoE da DeepSeek, hoje mais relevante como referência técnica e checkpoint do que como escolha da API hospedada atual. Veja o guia do DeepSeek V2.
DeepSeek Coder
Status: linha especializada em código, com checkpoints como Coder e Coder V2. Esses nomes não aparecem como IDs atuais no catálogo hospedado. Para uma aplicação nova via API oficial, teste V4 Flash e V4 Pro no seu conjunto de programação antes de decidir por self-hosting. Consulte o guia do DeepSeek Coder.
DeepSeek VL e OCR
Status: famílias multimodais com checkpoints publicados para execução própria, incluindo DeepSeek-VL e DeepSeek-VL2. Elas não são o mesmo produto que o ID hospedado experimental deepseek-v4-flash-vision-exp. Veja o guia do DeepSeek VL e VL2 e, para a opção hospedada atual, o guia do DeepSeek V4.
DeepSeek Math e Prover
Status: linhas de pesquisa e checkpoints especializados em matemática e demonstração formal. Podem ser úteis para estudo ou implantação própria, mas não são IDs atuais da API hospedada. Resultados dependem da versão, do benchmark e da configuração de inferência. Veja o guia do DeepSeek Math.
Modelos destilados
Status: checkpoints menores treinados para transferir parte do comportamento de uma família maior para bases como Qwen ou Llama. “Distill” não significa que o modelo seja idêntico ao R1 completo. Hardware, contexto, licença, qualidade e formato variam por checkpoint.

Como esta linha do tempo foi montada
A arte cruza os anúncios e o histórico oficial da API com os repositórios publicados pela DeepSeek. Ela separa três estados que tutoriais antigos costumam misturar: família lançada, pesos ainda disponíveis para execução própria e modelo atualmente hospedado pela API. Em 29 de julho de 2026, a lista documentada da API apresenta somente deepseek-v4-flash e deepseek-v4-pro.
Limite da verificação: em 29 de julho de 2026, usamos uma chave temporária para consultar GET /models e fazer uma chamada isolada a cada alias legado após o prazo anunciado de 24 de julho. Nesta conta, deepseek-chat e deepseek-reasoner responderam HTTP 200 e retornaram V4 Flash; o primeiro em Non-Thinking e o segundo em Thinking. Isso é uma observação pontual, não garantia de suporte: ambos ficaram fora do catálogo atual e podem deixar de funcionar sem aviso. Para código novo, use um ID V4 explícito e confirme GET /models.
Ponto de partida na API atual
| Escolha | Quando começar por ela |
|---|---|
| V4 Flash | Texto, chat, extração, classificação, resumo, alto volume e baseline de custo |
| V4 Flash com Thinking | Raciocínio textual com foco em eficiência e migração de deepseek-reasoner |
| V4 Pro | Texto complexo, agentes ou análise quando testes mostram ganho suficiente |
| V4 Flash Vision Exp | Entrada visual: screenshots, gráficos, OCR assistido ou imagem com texto |
Não selecione o Pro apenas porque a tarefa envolve raciocínio: Flash também oferece Thinking. Não selecione Vision Exp para uma tarefa somente textual; ele é experimental e existe para entradas com imagem.
API, App, pesos próprios ou provedor terceiro?
| Forma de acesso | Quem gerencia a infraestrutura? | Modelos disponíveis | Uso típico |
|---|---|---|---|
| Chat e App | DeepSeek | Seleção feita pelo produto | Uso individual e tarefas manuais |
| API oficial | DeepSeek | IDs atuais documentados | Aplicativos e integrações |
| Pesos próprios | Sua equipe | Checkpoints compatíveis escolhidos por você | Pesquisa, personalização e controle de implantação |
| Provedor terceiro | O provedor | Catálogo, versão e aliases próprios | Nuvem ou interface alternativa |
Em um provedor terceiro, preço, região, retenção, contexto e até o nome do modelo podem diferir da API oficial. Registre fornecedor, versão exata, data e configuração nos testes para evitar comparar produtos diferentes.
Como escolher o modelo certo
- Defina a tarefa: entrada, saída, idioma, formato e condições de recusa.
- Escolha a forma de acesso: Chat, App, API, pesos próprios ou provedor terceiro.
- Crie uma avaliação: use exemplos normais, difíceis, raros e adversariais.
- Comece pelo baseline: na API atual, normalmente V4 Flash.
- Compare alternativas: meça qualidade, latência, custo, tokens, falhas e esforço de correção.
- Cheque recursos: contexto, Thinking, ferramentas, JSON, runtime e hardware.
- Revise governança: licença, privacidade, região, segurança, retenção e responsável humano.
- Fixe a versão: monitore mudanças de alias e repita testes antes de migrar.
Se você ainda está escolhendo a aplicação, use a matriz de casos de uso do DeepSeek. Se o fator decisivo é orçamento, consulte os preços atuais da DeepSeek API.
Licenças, pesos e quantizações
- Leia a licença e o model card do checkpoint exato, não apenas da família.
- “Open weights” não significa domínio público, ausência de condições ou código inteiramente aberto.
- Uma quantização comunitária não deve ser atribuída automaticamente à DeepSeek.
- Confirme quem criou o arquivo, hash, formato e compatibilidade do runtime.
- Meça perda de qualidade, velocidade, memória e estabilidade na sua infraestrutura.
- Inclua energia, hardware, nuvem, operação e equipe no custo total.
Como interpretar benchmarks
Um benchmark é evidência sobre uma configuração específica, não uma classificação universal. Antes de repetir uma afirmação, confirme quem publicou o dado, a versão do modelo, o modo de raciocínio, as ferramentas, o orçamento de tokens e o método de avaliação.
- Atribua resultados do relatório da DeepSeek à própria DeepSeek.
- Não compare pontuações obtidas em versões ou protocolos diferentes como se fossem equivalentes.
- Evite superlativos como “melhor do mundo” sem escopo e fonte.
- Teste português brasileiro e português europeu separadamente quando ambos forem importantes.
- Meça qualidade e falhas no seu conjunto de produção, além do benchmark público.
Perguntas frequentes
Quais são os IDs atuais da DeepSeek API?
A documentação vigente apresenta deepseek-v4-flash, deepseek-v4-pro e deepseek-v4-flash-vision-exp. O terceiro é experimental e é o único dos três documentado para receber imagens.
DeepSeek R1 ainda está na API oficial?
Em 29/07/2026, os aliases legados responderam HTTP 200 e retornaram V4 Flash nesta conta, embora não aparecessem em GET /models. Isso é compatibilidade observada, não garantia. A seção de catálogo abaixo contém a evidência completa.
V4 Pro é o novo deepseek-reasoner?
Não como equivalência oficial. Migre primeiro para V4 Flash com Thinking. Adote Pro somente se seus testes justificarem o upgrade.
O endpoint V3.2 Speciale ainda funciona?
Não. O acesso temporário oficial terminou em 15 de dezembro de 2025, às 15:59 UTC.
Todo modelo do Hugging Face está na API?
Não. Um repositório de pesos é diferente de um produto hospedado. Use somente IDs retornados e documentados pela API escolhida.
Posso executar um modelo DeepSeek localmente?
Alguns checkpoints têm pesos publicados, mas a viabilidade depende de licença, hardware, quantização, runtime e requisitos de segurança. Modelos grandes podem demandar infraestrutura especializada.
Flash ou Pro para começar?
Comece com V4 Flash e um conjunto de avaliações. Compare o Pro nos casos em que o Flash não atinge o critério de qualidade.
Fontes oficiais consultadas
- DeepSeek-V4 Preview — anúncio e migração dos aliases
- List Models — endpoint da lista de modelos
- Models & Pricing — catálogo hospedado atual
- DeepSeek-V3.2 Release — status do Speciale
- DeepSeek-R1 Release — família R1
- Organização da DeepSeek no Hugging Face — pesos e model cards
Transparência editorial: este índice é independente. Disponibilidade em provedor terceiro não equivale a disponibilidade na API oficial. Informações verificadas documentalmente em 24 de agosto de 2026; a consulta autenticada permanece datada de 29 de julho de 2026.