Qwen ou DeepSeek: qual das duas IAs chinesas escolher?

comparação Qwen vs DeepSeek, as duas principais IAs chinesas
Resposta rápida

Qwen vs DeepSeek é a dúvida de quem trata as duas IAs chinesas como se fossem a mesma coisa, e elas não são: Qwen é a família de modelos da Alibaba, DeepSeek é uma empresa independente de Hangzhou fundada em julho de 2023 por Liang Wenfeng e financiada pelo fundo High-Flyer. O topo da Qwen hoje é o Qwen3.8-Max (3 de agosto de 2026), MoE de 2,4 trilhões de parâmetros que aceita texto, imagem e vídeo. Do outro lado, o DeepSeek-V4-Flash-0731 tem pesos abertos sob licença MIT e API a US$ 0,14 por milhão de tokens de entrada

Tratar Qwen e DeepSeek como "a IA chinesa" é o erro mais comum de quem só viu os dois nomes passando no feed

São duas frentes diferentes, com donos diferentes e caminhos diferentes

Qwen é a família de modelos da Alibaba, tocada pela equipe Alibaba Qwen e distribuída pelas APIs do Alibaba Cloud Model Studio

DeepSeek é uma empresa independente, sediada em Hangzhou, na província de Zhejiang, fundada em julho de 2023 por Liang Wenfeng, cofundador do fundo quantitativo High-Flyer, que também financia e detém a empresa

Ou seja: de um lado tu tem a maior nuvem da China empurrando o modelo dela, do outro tu tem uma casa nascida de um fundo quant que solta peso aberto no Hugging Face

A escolha entre as duas não é "qual é a melhor", é qual delas encaixa no que você vai fazer

Bora comparar?

Qwen3.8-Max vs DeepSeek-V4-Flash: comparação linha a linha

Pra comparação valer alguma coisa, ela tem que ser entre os modelos de topo de cada lado nesta data

Do lado Qwen, o Qwen3.8-Max, anunciado em 3 de agosto de 2026 como o maior e mais capaz modelo da família até então

Do lado DeepSeek, o DeepSeek-V4-Flash-0731, publicado em 31 de julho de 2026 como versão de produção, substituindo o preview de abril

CritérioQwen3.8-MaxDeepSeek-V4-Flash-0731
Quem fazAlibaba (equipe Alibaba Qwen)DeepSeek, empresa independente de Hangzhou, fundada em julho de 2023 por Liang Wenfeng e financiada pela High-Flyer
Data do modelo de topo3 de agosto de 202631 de julho de 2026
ArquiteturaMoE, 2,4 trilhões de parâmetros totaisMoE, 284 bilhões totais e 13 bilhões ativados por token
Janela de contexto1 milhão de tokens1 milhão de tokens
Entradas aceitasTexto, imagem e vídeo (saída em texto)Texto
Pesos abertosAinda não publicados até 5 de agosto de 2026Sim, licença MIT e sem gate no Hugging Face
Preço da API (entrada)US$ 2,00 por 1 milhão de tokensUS$ 0,14 por 1 milhão de tokens
Preço da API (saída)US$ 6,00 por 1 milhão de tokensUS$ 0,28 por 1 milhão de tokens
Artificial Analysis Intelligence Index53 (mediana dos comparáveis: 32)50 (mediana dos comparáveis: 25)
Velocidade46 tokens por segundo, considerada lenta pela própria página113 tokens por segundo, considerada rápida pela própria página
Onde a API viveAPIs do Alibaba Cloud Model Studio e QwenWork, a plataforma de agente de IA para trabalho da AlibabaAPI da DeepSeek, chamada com o nome de modelo deepseek-v4-flash

Repara numa coisa antes de seguir: as pontuações do Artificial Analysis saem de uma página viva, que re-mede modelo quando quer

Os dois números acima são a leitura de 5 de agosto de 2026, então trate como foto do dia, não como verdade eterna

E olha o detalhe que salta da tabela: 53 contra 50 de pontuação, com o Qwen custando mais de 14 vezes o preço de entrada do DeepSeek

A diferença de capacidade é pequena, a diferença de conta é gigante

Em que tipo de tarefa cada uma costuma ser lembrada

Agora sai do papel do benchmark e vai pro que tu realmente faz no dia

Quando a entrada tem imagem ou vídeo:

Aqui não tem disputa, tem só um caminho

O Qwen3.8-Max aceita texto, imagem e vídeo como entrada e devolve texto

O DeepSeek-V4-Flash trabalha com texto

Então se o seu fluxo manda print, frame de vídeo ou documento visual pro modelo, a conversa acaba do lado da Alibaba, simples assim

Quando é raciocínio em volume, com custo apertado:

O DeepSeek V4 Flash é modelo de raciocínio, com chain-of-thought, e roda a 113 tokens por segundo

Com entrada a US$ 0,14 e saída a US$ 0,28 por milhão de tokens, ele é o tipo de modelo que tu deixa ligado num pipeline sem suar frio no fim do mês

E tem um detalhe que muita gente ignora: o cache hit custa US$ 0,0028 por 1 milhão de tokens

Se o seu prompt tem um bloco fixo enorme (contexto de projeto, base de regras, documentação), o repique dessa parte sai por quase nada

Tome cuidado com um ponto aqui!

A política de preços da API da DeepSeek prevê valores em horário de pico equivalentes ao dobro do preço fora de pico, e isso vale pra todos os itens cobrados

Ou seja: aquele cálculo lindo que tu fez na planilha pode virar outro número dependendo da hora em que o seu job roda

Se o processamento é em lote e pode esperar, vale demais olhar a janela de execução

Quando tu precisa rodar on-premise ou usar comercialmente os pesos:

Hoje só existe um caminho, e é o do DeepSeek

Os pesos do DeepSeek-V4-Flash-0731 estão sob licença MIT e sem gate no repositório oficial no Hugging Face, com uso comercial e deploy on-premise permitidos

Do lado Qwen a história ainda está sendo escrita: em 5 de agosto de 2026 os pesos do Qwen3.8-Max e do Qwen3.8-27B ainda não estavam no Hugging Face e nenhuma licença tinha sido nomeada

A própria conta da Qwen anunciou publicamente que os pesos sairiam "na próxima semana", e que o Qwen3.8-27B também vai pra pesos abertos

Anúncio é anúncio, arquivo publicado é outra coisa, então quem precisa DISSO hoje sabe pra onde ir

E o contexto, desempata?

Não desempata

Os dois trabalham com janela de até 1 milhão de tokens

Então se o seu argumento de escolha era "qual aguenta mais contexto", pode riscar da lista e usar os outros critérios 🙂

Qual das duas escolher, na prática

Sem empate covarde

Pra maioria dos projetos em português que só mandam texto, o DeepSeek V4 Flash é a escolha mais racional hoje

Ele entrega 50 no Artificial Analysis contra 53 do Qwen3.8-Max, por US$ 0,14 de entrada contra US$ 2,00, e ainda roda a 113 tokens por segundo contra 46

Mais que o dobro da velocidade, uma fração do preço, e uma diferença de pontuação de 3 pontos

Pra chatbot, extração, classificação, geração de texto em volume e automação, a conta fecha sozinha

O Qwen3.8-Max se justifica em três situações bem definidas:

  1. Quando a entrada é multimodal, com imagem ou vídeo, porque aí o DeepSeek V4 Flash simplesmente não atende
  2. Quando você já vive dentro do Alibaba Cloud Model Studio ou usa o QwenWork, e trocar de plataforma custa mais caro que a diferença de token
  3. Quando você quer o topo de capacidade disponível na comparação e os 3 pontos a mais valem o preço no seu caso (produto crítico, poucas chamadas, margem alta)

Agora o registro honesto da incerteza, porque o desenho pode mudar rápido

Os pesos abertos do Qwen3.8-Max e do Qwen3.8-27B foram anunciados pra semana seguinte a 5 de agosto de 2026 e ainda não estavam publicados

Se saírem com licença permissiva, o argumento do "só o DeepSeek dá pra rodar em casa" muda de figura

Do outro lado, o DeepSeek V4-Pro, de 1,6 trilhão de parâmetros, segue em preview, sem versão oficial: em agosto de 2026 a API deepseek-v4-pro e os modelos do app e da web continuam nesse status

Os dois foram anunciados juntos em 24 de abril de 2026 como preview de pesos abertos sob MIT, mas só o Flash virou produção

Então a comparação de hoje é entre um Qwen no topo e um DeepSeek que ainda nem soltou o irmão maior…

Duas IAs trabalhando juntas: veja o conceito na prática

Antes de escolher modelo, vale entender como esse papo de IA tocando um fluxo inteiro funciona na tela

Pra começar do zero nesse assunto de IAs em fluxo, este vídeo do canal mostra duas ferramentas construindo um app enquanto o dev só acompanha:

É o mesmo raciocínio que tu vai aplicar quando plugar Qwen ou DeepSeek no seu processo: o modelo faz a parte pesada, você define o caminho e revisa o resultado

Próximo passo: teste as duas antes de fechar contrato

Comparação de tabela serve pra cortar opção, não pra decidir por você

O que decide é o seu prompt, com o seu contexto, na sua língua

Então o próximo passo é bem simples e não custa nada:

  1. Abra o chat da DeepSeek, que é gratuito com conta criada
  2. Abra o chat da Qwen em outra aba
  3. Pegue um prompt REAL do seu trabalho, daqueles que você usa toda semana, e rode o mesmo texto nos dois
  4. Compare o resultado lado a lado: qualidade da resposta, jeito que ele escreve em português, se seguiu a instrução até o fim

O erro comum aqui é testar com prompt de brincadeira ("escreva um poema sobre gatos") e achar que aprendeu alguma coisa

Os dois vão mandar bem nisso, e você não vai ter descoberto nada útil

Use a tarefa chata, a que dá trabalho de verdade, essa sim separa os modelos

Só DEPOIS desse teste você decide qual API vai pro código

E fica de olho em duas coisas nas próximas semanas: a publicação dos pesos abertos do Qwen3.8-Max e do Qwen3.8-27B, e a versão oficial do DeepSeek V4-Pro fora do preview

Qualquer uma das duas muda o cálculo que a gente fez aqui 😀

Até o próximo post!

Perguntas frequentes

Qwen e DeepSeek são da mesma empresa chinesa?

Não, são coisas bem diferentes. Qwen é a família de modelos da Alibaba, tocada pela equipe Alibaba Qwen e distribuída pelas APIs do Alibaba Cloud Model Studio. Já a DeepSeek é uma empresa independente, sediada em Hangzhou, fundada em julho de 2023 por Liang Wenfeng e financiada pelo fundo High-Flyer.

Qual sai mais barato para rodar em produção, Qwen ou DeepSeek?

O DeepSeek-V4-Flash-0731 é bem mais em conta: US$ 0,14 por milhão de tokens de entrada e US$ 0,28 na saída, contra US$ 2,00 e US$ 6,00 do Qwen3.8-Max. Só fica de olho no horário de pico da DeepSeek, que cobra o dobro do preço fora de pico em todos os itens.

Dá pra rodar o DeepSeek localmente, on-premise?

Dá sim. Os pesos do DeepSeek-V4-Flash-0731 estão publicados sob licença MIT e sem gate no Hugging Face, com uso comercial e deploy on-premise permitidos. É o único caminho aberto hoje entre as duas, já que o Qwen3.8-Max ainda não teve pesos publicados.

O Qwen3.8-Max já tem pesos abertos disponíveis para download?

Ainda não, pelo menos até 5 de agosto de 2026. A própria conta da Qwen anunciou que os pesos do Qwen3.8-Max, e também do Qwen3.8-27B, sairiam na semana seguinte, mas nenhuma licença foi nomeada até essa data.

Qual das duas IAs aceita imagem ou vídeo como entrada?

Só o Qwen3.8-Max. Ele aceita texto, imagem e vídeo como entrada e devolve texto como saída. O DeepSeek-V4-Flash trabalha apenas com texto.

Dá pra usar Qwen ou DeepSeek sem escrever código, direto no navegador?

Dá. O chat da DeepSeek fica em chat.deepseek.com e é gratuito com conta. O chat da Qwen fica em chat.qwen.ai, pra quem quer testar o Qwen3.8-Max sem mexer em API.




Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted
Inline Feedbacks
View all comments

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares