Qwen ou DeepSeek: qual das duas IAs chinesas escolher?

Qwen vs DeepSeek é a dúvida de quem trata as duas IAs chinesas como se fossem a mesma coisa, e elas não são: Qwen é a família de modelos da Alibaba, DeepSeek é uma empresa independente de Hangzhou fundada em julho de 2023 por Liang Wenfeng e financiada pelo fundo High-Flyer. O topo da Qwen hoje é o Qwen3.8-Max (3 de agosto de 2026), MoE de 2,4 trilhões de parâmetros que aceita texto, imagem e vídeo. Do outro lado, o DeepSeek-V4-Flash-0731 tem pesos abertos sob licença MIT e API a US$ 0,14 por milhão de tokens de entrada
Tratar Qwen e DeepSeek como "a IA chinesa" é o erro mais comum de quem só viu os dois nomes passando no feed
São duas frentes diferentes, com donos diferentes e caminhos diferentes
Qwen é a família de modelos da Alibaba, tocada pela equipe Alibaba Qwen e distribuída pelas APIs do Alibaba Cloud Model Studio
DeepSeek é uma empresa independente, sediada em Hangzhou, na província de Zhejiang, fundada em julho de 2023 por Liang Wenfeng, cofundador do fundo quantitativo High-Flyer, que também financia e detém a empresa
Ou seja: de um lado tu tem a maior nuvem da China empurrando o modelo dela, do outro tu tem uma casa nascida de um fundo quant que solta peso aberto no Hugging Face
A escolha entre as duas não é "qual é a melhor", é qual delas encaixa no que você vai fazer
Bora comparar?
Qwen3.8-Max vs DeepSeek-V4-Flash: comparação linha a linha
Pra comparação valer alguma coisa, ela tem que ser entre os modelos de topo de cada lado nesta data
Do lado Qwen, o Qwen3.8-Max, anunciado em 3 de agosto de 2026 como o maior e mais capaz modelo da família até então
Do lado DeepSeek, o DeepSeek-V4-Flash-0731, publicado em 31 de julho de 2026 como versão de produção, substituindo o preview de abril
| Critério | Qwen3.8-Max | DeepSeek-V4-Flash-0731 |
|---|---|---|
| Quem faz | Alibaba (equipe Alibaba Qwen) | DeepSeek, empresa independente de Hangzhou, fundada em julho de 2023 por Liang Wenfeng e financiada pela High-Flyer |
| Data do modelo de topo | 3 de agosto de 2026 | 31 de julho de 2026 |
| Arquitetura | MoE, 2,4 trilhões de parâmetros totais | MoE, 284 bilhões totais e 13 bilhões ativados por token |
| Janela de contexto | 1 milhão de tokens | 1 milhão de tokens |
| Entradas aceitas | Texto, imagem e vídeo (saída em texto) | Texto |
| Pesos abertos | Ainda não publicados até 5 de agosto de 2026 | Sim, licença MIT e sem gate no Hugging Face |
| Preço da API (entrada) | US$ 2,00 por 1 milhão de tokens | US$ 0,14 por 1 milhão de tokens |
| Preço da API (saída) | US$ 6,00 por 1 milhão de tokens | US$ 0,28 por 1 milhão de tokens |
| Artificial Analysis Intelligence Index | 53 (mediana dos comparáveis: 32) | 50 (mediana dos comparáveis: 25) |
| Velocidade | 46 tokens por segundo, considerada lenta pela própria página | 113 tokens por segundo, considerada rápida pela própria página |
| Onde a API vive | APIs do Alibaba Cloud Model Studio e QwenWork, a plataforma de agente de IA para trabalho da Alibaba | API da DeepSeek, chamada com o nome de modelo deepseek-v4-flash |
Repara numa coisa antes de seguir: as pontuações do Artificial Analysis saem de uma página viva, que re-mede modelo quando quer
Os dois números acima são a leitura de 5 de agosto de 2026, então trate como foto do dia, não como verdade eterna
E olha o detalhe que salta da tabela: 53 contra 50 de pontuação, com o Qwen custando mais de 14 vezes o preço de entrada do DeepSeek
A diferença de capacidade é pequena, a diferença de conta é gigante
Em que tipo de tarefa cada uma costuma ser lembrada
Agora sai do papel do benchmark e vai pro que tu realmente faz no dia
Quando a entrada tem imagem ou vídeo:
Aqui não tem disputa, tem só um caminho
O Qwen3.8-Max aceita texto, imagem e vídeo como entrada e devolve texto
O DeepSeek-V4-Flash trabalha com texto
Então se o seu fluxo manda print, frame de vídeo ou documento visual pro modelo, a conversa acaba do lado da Alibaba, simples assim
Quando é raciocínio em volume, com custo apertado:
O DeepSeek V4 Flash é modelo de raciocínio, com chain-of-thought, e roda a 113 tokens por segundo
Com entrada a US$ 0,14 e saída a US$ 0,28 por milhão de tokens, ele é o tipo de modelo que tu deixa ligado num pipeline sem suar frio no fim do mês
E tem um detalhe que muita gente ignora: o cache hit custa US$ 0,0028 por 1 milhão de tokens
Se o seu prompt tem um bloco fixo enorme (contexto de projeto, base de regras, documentação), o repique dessa parte sai por quase nada
Tome cuidado com um ponto aqui!
A política de preços da API da DeepSeek prevê valores em horário de pico equivalentes ao dobro do preço fora de pico, e isso vale pra todos os itens cobrados
Ou seja: aquele cálculo lindo que tu fez na planilha pode virar outro número dependendo da hora em que o seu job roda
Se o processamento é em lote e pode esperar, vale demais olhar a janela de execução
Quando tu precisa rodar on-premise ou usar comercialmente os pesos:
Hoje só existe um caminho, e é o do DeepSeek
Os pesos do DeepSeek-V4-Flash-0731 estão sob licença MIT e sem gate no repositório oficial no Hugging Face, com uso comercial e deploy on-premise permitidos
Do lado Qwen a história ainda está sendo escrita: em 5 de agosto de 2026 os pesos do Qwen3.8-Max e do Qwen3.8-27B ainda não estavam no Hugging Face e nenhuma licença tinha sido nomeada
A própria conta da Qwen anunciou publicamente que os pesos sairiam "na próxima semana", e que o Qwen3.8-27B também vai pra pesos abertos
Anúncio é anúncio, arquivo publicado é outra coisa, então quem precisa DISSO hoje sabe pra onde ir
E o contexto, desempata?
Não desempata
Os dois trabalham com janela de até 1 milhão de tokens
Então se o seu argumento de escolha era "qual aguenta mais contexto", pode riscar da lista e usar os outros critérios 🙂
Qual das duas escolher, na prática
Sem empate covarde
Pra maioria dos projetos em português que só mandam texto, o DeepSeek V4 Flash é a escolha mais racional hoje
Ele entrega 50 no Artificial Analysis contra 53 do Qwen3.8-Max, por US$ 0,14 de entrada contra US$ 2,00, e ainda roda a 113 tokens por segundo contra 46
Mais que o dobro da velocidade, uma fração do preço, e uma diferença de pontuação de 3 pontos
Pra chatbot, extração, classificação, geração de texto em volume e automação, a conta fecha sozinha
O Qwen3.8-Max se justifica em três situações bem definidas:
- Quando a entrada é multimodal, com imagem ou vídeo, porque aí o DeepSeek V4 Flash simplesmente não atende
- Quando você já vive dentro do Alibaba Cloud Model Studio ou usa o QwenWork, e trocar de plataforma custa mais caro que a diferença de token
- Quando você quer o topo de capacidade disponível na comparação e os 3 pontos a mais valem o preço no seu caso (produto crítico, poucas chamadas, margem alta)
Agora o registro honesto da incerteza, porque o desenho pode mudar rápido
Os pesos abertos do Qwen3.8-Max e do Qwen3.8-27B foram anunciados pra semana seguinte a 5 de agosto de 2026 e ainda não estavam publicados
Se saírem com licença permissiva, o argumento do "só o DeepSeek dá pra rodar em casa" muda de figura
Do outro lado, o DeepSeek V4-Pro, de 1,6 trilhão de parâmetros, segue em preview, sem versão oficial: em agosto de 2026 a API deepseek-v4-pro e os modelos do app e da web continuam nesse status
Os dois foram anunciados juntos em 24 de abril de 2026 como preview de pesos abertos sob MIT, mas só o Flash virou produção
Então a comparação de hoje é entre um Qwen no topo e um DeepSeek que ainda nem soltou o irmão maior…
Duas IAs trabalhando juntas: veja o conceito na prática
Antes de escolher modelo, vale entender como esse papo de IA tocando um fluxo inteiro funciona na tela
Pra começar do zero nesse assunto de IAs em fluxo, este vídeo do canal mostra duas ferramentas construindo um app enquanto o dev só acompanha:
É o mesmo raciocínio que tu vai aplicar quando plugar Qwen ou DeepSeek no seu processo: o modelo faz a parte pesada, você define o caminho e revisa o resultado
Próximo passo: teste as duas antes de fechar contrato
Comparação de tabela serve pra cortar opção, não pra decidir por você
O que decide é o seu prompt, com o seu contexto, na sua língua
Então o próximo passo é bem simples e não custa nada:
- Abra o chat da DeepSeek, que é gratuito com conta criada
- Abra o chat da Qwen em outra aba
- Pegue um prompt REAL do seu trabalho, daqueles que você usa toda semana, e rode o mesmo texto nos dois
- Compare o resultado lado a lado: qualidade da resposta, jeito que ele escreve em português, se seguiu a instrução até o fim
O erro comum aqui é testar com prompt de brincadeira ("escreva um poema sobre gatos") e achar que aprendeu alguma coisa
Os dois vão mandar bem nisso, e você não vai ter descoberto nada útil
Use a tarefa chata, a que dá trabalho de verdade, essa sim separa os modelos
Só DEPOIS desse teste você decide qual API vai pro código
E fica de olho em duas coisas nas próximas semanas: a publicação dos pesos abertos do Qwen3.8-Max e do Qwen3.8-27B, e a versão oficial do DeepSeek V4-Pro fora do preview
Qualquer uma das duas muda o cálculo que a gente fez aqui 😀
Até o próximo post!
Perguntas frequentes
Qwen e DeepSeek são da mesma empresa chinesa?
Não, são coisas bem diferentes. Qwen é a família de modelos da Alibaba, tocada pela equipe Alibaba Qwen e distribuída pelas APIs do Alibaba Cloud Model Studio. Já a DeepSeek é uma empresa independente, sediada em Hangzhou, fundada em julho de 2023 por Liang Wenfeng e financiada pelo fundo High-Flyer.
Qual sai mais barato para rodar em produção, Qwen ou DeepSeek?
O DeepSeek-V4-Flash-0731 é bem mais em conta: US$ 0,14 por milhão de tokens de entrada e US$ 0,28 na saída, contra US$ 2,00 e US$ 6,00 do Qwen3.8-Max. Só fica de olho no horário de pico da DeepSeek, que cobra o dobro do preço fora de pico em todos os itens.
Dá pra rodar o DeepSeek localmente, on-premise?
Dá sim. Os pesos do DeepSeek-V4-Flash-0731 estão publicados sob licença MIT e sem gate no Hugging Face, com uso comercial e deploy on-premise permitidos. É o único caminho aberto hoje entre as duas, já que o Qwen3.8-Max ainda não teve pesos publicados.
O Qwen3.8-Max já tem pesos abertos disponíveis para download?
Ainda não, pelo menos até 5 de agosto de 2026. A própria conta da Qwen anunciou que os pesos do Qwen3.8-Max, e também do Qwen3.8-27B, sairiam na semana seguinte, mas nenhuma licença foi nomeada até essa data.
Qual das duas IAs aceita imagem ou vídeo como entrada?
Só o Qwen3.8-Max. Ele aceita texto, imagem e vídeo como entrada e devolve texto como saída. O DeepSeek-V4-Flash trabalha apenas com texto.
Dá pra usar Qwen ou DeepSeek sem escrever código, direto no navegador?
Dá. O chat da DeepSeek fica em chat.deepseek.com e é gratuito com conta. O chat da Qwen fica em chat.qwen.ai, pra quem quer testar o Qwen3.8-Max sem mexer em API.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares

As diferenças de var, let e const

Como fazer redirecionamento com PHP
Neste artigo você vai aprender a como fazer redirecionamento com PHP, utilizaremos abordagens fáceis de entender e de aplicar Fala programador(a), beleza? Bora aprender mais […]

ChatGPT: o que é, como usar, dicas e como acessar login
ChatGPT é uma ferramenta de processamento de linguagem natural (NLP) baseada na arquitetura GPT-3.5, desenvolvida pela OpenAI. Sua criação representa um marco significativo no campo […]
