DeepSeek V4 download: onde baixar o modelo oficialmente (e como não cair em repositório falso)

download oficial do DeepSeek V4 no Hugging Face
Resposta rápida

DeepSeek V4 download tem um endereço só que importa: a organização verificada deepseek-ai no Hugging Face, onde ficam os repositórios DeepSeek-V4-Flash, DeepSeek-V4-Flash-0731 (a versão de produção de 31/07/2026) e DeepSeek-V4-Pro, todos sob licença MIT. Se tu não quer gastar disco, dá pra usar o modelo pela API oficial em api.deepseek.com, compatível com o formato OpenAI. E atenção: existe campanha real de malware com repositórios falsos imitando projetos DeepSeek, entregando executável na aba Releases. Peso de modelo aberto nunca chega em forma de .exe, beleza?

Baixar modelo aberto do lugar errado não te entrega um modelo ruim, te entrega um malware

E isso não é papo de paranoico: existe campanha ativa com repositórios falsos no GitHub que copiam o visual do projeto legítimo e distribuem o binário DeepSeek-TUI_x64.exe dentro de um arquivo 7z na aba Releases. O bicho desativa proteções do Windows Defender e abre portas de firewall 😬

O DeepSeek V4 é aberto de verdade, com pesos publicados sob licença MIT, e é justamente por ser aberto que o nome dele aparece em um monte de repositório que não tem nada a ver com a DeepSeek

Então bora fazer isso direito: aqui tu vê qual é o canal oficial, como conferir se o repositório é legítimo, e quando baixar os pesos nem faz sentido pro teu caso

Formação Agentes de IA
Formação Recomendada

Formação Agentes de IA

Domine a criação de Agentes de IA e Venda para Empresas

  • 402 aulas
  • 32 projetos
  • 38h 19min

Baixar os pesos ou usar pela API: qual dos dois você precisa

Antes de qualquer download, responde uma pergunta: tu quer o MODELO na tua máquina ou só a resposta do modelo dentro do teu produto?

São duas coisas bem diferentes, e a maioria das pessoas que pesquisa por download na verdade queria a API

CritérioAPI oficialBaixar os pesos
Onde rodaServidores da DeepSeek, endpoint https://api.deepseek.comTua máquina, teu servidor ou teu cluster
Formato de integraçãoCompatível com o formato OpenAITu escolhe o runtime
Contexto1 milhão de tokens1 milhão de tokens no V4-Flash
Custo do V4-FlashUS$ 0,14 por 1M de entrada (cache miss), US$ 0,0028 com cache hit e US$ 0,28 por 1M de saídaZero de token, tu paga em disco e hardware
Custo do V4-ProUS$ 0,435 por 1M de entrada (cache miss), US$ 0,003625 com cache hit e US$ 0,87 por 1M de saídaClasse servidor, fora da realidade doméstica
LicençaUso via serviçoMIT nos pesos do Pro e do Flash
Hardware seuNenhumObrigatório, e não é pouco

Detalhe importante pra decidir: o V4-Pro tem 1,6 trilhão de parâmetros totais e fica restrito a servidor ou cluster

A variante viável fora de datacenter é o V4-Flash, com 284 bilhões de parâmetros totais e 13 bilhões ativados por token (arquitetura MoE, aquele esquema de acionar só uma parte da rede por token)

Quem acompanha a casa desde o modo DeepThink do DeepSeek 3.1 já sacou o padrão: eles soltam o modelo aberto e mantêm o serviço próprio rodando em paralelo

O que você precisa antes de baixar o DeepSeek V4

Checklist rápido, pra tu não descobrir problema no meio de um download de mais de 100 GB

  • Conta no Hugging Face e o cliente de linha de comando instalado. Aqui mora a pegadinha número um: o huggingface-cli foi removido no huggingface_hub v1.0. O comando atual é hf
  • Espaço em disco compatível com o formato escolhido. Nos arquivos GGUF do V4-Flash publicados pela Unsloth, os tamanhos são: UD-Q8_K_XL com 162 GB, UD-Q4_K_XL com 155 GB, o de 3 bits com 103 GB e o dinâmico de 1 bit com 85 GB
  • A decisão entre Flash e Pro tomada ANTES. Baixar 1,6 trilhão de parâmetros "pra ver como é" não é curiosidade, é castigo
  • Uma conexão que aguente o tranco. Parece óbvio, mas download interrompido em arquivo desse tamanho é o tipo de coisa que arruína a tarde

Se rodar ferramenta por terminal ainda te dá um frio na barriga, o roteiro de como instalar o Claude Code no computador segue a mesma lógica de CLI e serve de aquecimento

Como baixar o DeepSeek V4 passo a passo (canal oficial)

  1. Abra a organização oficial no Hugging Face e confira o selo. O endereço é huggingface.co/deepseek-ai, uma organização com selo Verified e listada como company. Esse é o ponto de partida, sempre

O erro comum deste passo: chegar no repositório pela busca por nome em vez de pela URL da organização. A busca te devolve homônimo, a org verificada não

  1. Escolha o repositório certo. Os oficiais dos pesos do V4 são deepseek-ai/DeepSeek-V4-Flash, deepseek-ai/DeepSeek-V4-Flash-0731, deepseek-ai/DeepSeek-V4-Pro e os irmãos com sufixo -Base

O DeepSeek-V4-Flash-0731 é a versão de produção, liberada em 31 de julho de 2026, e substitui a preview. É o modelo de abril re-treinado no pós-treino (agente, código, uso de ferramentas), sem mudar o tamanho

O erro comum deste passo: baixar o -Base achando que é o modelo de conversa. Os -Base são só pré-treinados, sem ajuste de instrução, ou seja, não vão se comportar como assistente

  1. Confira o arquivo LICENSE dentro do próprio repositório. Os pesos do V4 (Pro e Flash) estão sob MIT License, e o arquivo LICENSE fica ali no repo do modelo

O erro comum deste passo: acreditar na licença que um blog aleatório diz. Abre o arquivo, leva cinco segundos

  1. Rode o download com o comando atual. Nome completo do repositório, sempre com o prefixo da organização:
hf download deepseek-ai/DeepSeek-V4-Flash-0731

O erro comum deste passo: usar huggingface-cli download. Ele foi descontinuado, e se tu está na v1.0 do huggingface_hub o comando simplesmente não existe mais

  1. Se o teu caminho é llama.cpp, use a versão GGUF. Existe o repositório unsloth/DeepSeek-V4-Flash-GGUF com os arquivos quantizados, e a documentação orienta usar a versão mais recente do llama.cpp ou o Unsloth Studio
hf download unsloth/DeepSeek-V4-Flash-GGUF

O erro comum deste passo: subestimar o tamanho. Mesmo o dinâmico de 1 bit tem 85 GB, e o UD-Q8_K_XL passa dos 160 GB. Isso não cabe num SSD já lotado de projeto antigo, confere o espaço antes 🙂

Como diferenciar o release oficial de um repositório falso

Essa parte é a que mais gente pula, e é a única que pode te custar a máquina inteira

O sintoma: um repositório que parece o certo

O nome é idêntico, o README tem o mesmo visual do projeto legítimo, o print é o mesmo. Só que ele não está dentro da organização deepseek-ai

A org oficial no GitHub é github.com/deepseek-ai. Buscar por "deepseek-v4" lá dentro do GitHub retorna repositórios de contas pessoais e organizações não oficiais usando exatamente o mesmo nome

A causa: modelo em alta é isca perfeita

A campanha real que circula distribui o binário DeepSeek-TUI_x64.exe empacotado num 7z na aba Releases. Uma vez rodando, ele desativa proteções do Windows Defender e abre portas de firewall

E não para no DeepSeek: a mesma infraestrutura reaproveita nomes de outras ferramentas de IA em alta, com instaladores falsos batizados de Claude, Grok, WormGPT e KawaiiGPT

Desenvolvedor também já entrou na mira, com malware distribuído disfarçado de pacote da DeepSeek pra devs. Ou seja: não é só o usuário final baixando .exe, é o install no teu terminal também

A solução: duas regras que já te tiram da mira

  • Peso de modelo aberto não vem em executável. Vem em arquivo de modelo. Se o "download do modelo" te oferece um .exe ou um 7z com instalador dentro, para na hora
  • Sempre partir da URL da organização verificada, nunca da busca por nome. Entra em huggingface.co/deepseek-ai ou em github.com/deepseek-ai e navega dali pra dentro

Tome cuidado com o hábito de pesquisar o nome do modelo e clicar no primeiro resultado que parecer o oficial. É exatamente esse reflexo que a campanha explora

Qual versão do DeepSeek V4 baixar para cada cenário

Traduzindo tudo isso em decisão prática

Rodar local com máquina forte: DeepSeek-V4-Flash-0731, nos pesos completos. É o MoE de 284 bilhões totais com 13 bilhões ativados por token e 1 milhão de tokens de contexto, já com o pós-treino novo voltado a agente, código e uso de ferramentas

Rodar em máquina apertada: os GGUF quantizados da Unsloth, começando pelo bit que couber no teu disco. Só entra sabendo do trade-off: quanto menor o bit, mais qualidade tu deixa na mesa. O dinâmico de 1 bit com 85 GB é o piso de espaço, não o de qualidade 😛

Pesquisa e fine-tune: as versões -Base. São os pré-treinados sem ajuste de instrução, que é exatamente o que tu quer quando vai treinar por cima

Servidor ou cluster: o DeepSeek-V4-Pro, o de 1,6 trilhão de parâmetros. Não tenta em PC da Nasa doméstico, é classe servidor mesmo

Integrar em produto sem baixar nada: API. E aqui tem uma facilidade boa: o nome de modelo deepseek-v4-flash passou a servir a versão 0731 automaticamente, então integração que já chamava esse nome recebe o build novo sem mudança de código

Conclusão

A regra prática do DeepSeek V4 download cabe em uma linha: um único ponto de entrada confiável, que é a organização deepseek-ai no Hugging Face e no GitHub

Dali tu escolhe entre Flash e Pro, confere o LICENSE (MIT), roda o hf download com o nome completo do repo e pronto

Qualquer download que chegue em forma de executável merece desconfiança imediata, sem exceção

E um conselho pra não gastar disco e tempo à toa: testa primeiro pela API ou pelo chat oficial em chat.deepseek.com só pra saber se o modelo serve ao teu caso. Se der ruim no acesso, o status.deepseek.com te diz se o problema é do lado deles antes de tu sair depurando a própria máquina

Qualquer coisa, o V4 não vai sair do ar tão cedo. Baixa com calma e com o repositório certo 😀

até o próximo post!

Perguntas frequentes

O DeepSeek V4 é de graça pra baixar?

Sim, os pesos do V4-Pro e do V4-Flash estão sob licença MIT, publicados na organização deepseek-ai no Hugging Face. O download em si não custa nada, mas tu paga em disco e hardware pra rodar o modelo localmente.

Dá pra rodar o DeepSeek V4 Flash em um computador comum?

O V4-Flash é a variante viável fora de datacenter, com 284 bilhões de parâmetros totais e 13 bilhões ativados por token (arquitetura MoE). Já o V4-Pro, com 1,6 trilhão de parâmetros totais, é classe servidor e não entra na conta de máquina doméstica.

Qual a diferença entre DeepSeek-V4-Flash e DeepSeek-V4-Flash-0731?

O DeepSeek-V4-Flash original saiu em 24 de abril de 2026. O DeepSeek-V4-Flash-0731, liberado em 31 de julho de 2026, é esse mesmo modelo re-treinado no pós-treino (agente, código, uso de ferramentas), sem mudar o tamanho, e é a versão de produção que substitui a preview.

O comando huggingface-cli download ainda funciona pra baixar o DeepSeek V4?

Não. O huggingface-cli foi removido no huggingface_hub v1.0, e o comando atual é hf download. Se tu copiar um tutorial antigo com huggingface-cli, o comando simplesmente não vai existir na tua instalação.

Existe versão GGUF do DeepSeek V4 pra rodar no llama.cpp?

Sim, a Unsloth publicou o repositório unsloth/DeepSeek-V4-Flash-GGUF no Hugging Face. Os tamanhos variam bastante: UD-Q8_K_XL com 162 GB, UD-Q4_K_XL com 155 GB, o de 3 bits com 103 GB e o dinâmico de 1 bit com 85 GB.

Baixar o DeepSeek V4 pelo GitHub é seguro?

Só se vier da organização oficial deepseek-ai. Existe campanha ativa de malware com repositórios falsos que imitam o visual do projeto legítimo e distribuem o binário DeepSeek-TUI_x64.exe dentro de um 7z na aba Releases, desativando proteções do Windows Defender. A mesma infraestrutura já usou nomes de Claude, Grok, WormGPT e KawaiiGPT.



Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted
Inline Feedbacks
View all comments

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares