O que é o Qwen, a IA do Alibaba, e para que ele serve?

o que é o Qwen, a inteligência artificial do Alibaba
Resposta rápida

Qwen é a família de modelos de IA do Alibaba, criada pelo Tongyi Lab e anunciada em abril de 2023 com o nome chinês Tongyi Qianwen. Não é um modelo só: é uma série com versões densas e MoE, de 0,6B até modelos de trilhões de parâmetros, boa parte sob licença Apache 2.0. O ecossistema tem três braços: o Qwen Studio (ex-Qwen Chat) pra usar grátis no navegador, o Qwen Code como agente de codificação no terminal e o Qwen-Image pra gerar e editar imagem. Dá pra consumir por API, baixar os pesos ou rodar por conta própria

Fala aí, beleza? Quem ouve falar em Qwen pela primeira vez sempre faz a mesma pergunta: isso é um chatbot, um modelo ou uma plataforma?

A resposta curta é: os três, e é exatamente por isso que o nome confunde tanto

Qwen é a família de modelos de IA do Alibaba, com braços em texto, código e imagem, e ainda tem um site oficial onde tu usa tudo isso direto pelo navegador

Neste post eu separo cada pedaço: quem faz, quais modelos existem, o que cada braço resolve na prática e como começar hoje, do navegador ao terminal 🙂

Quem está por trás do Qwen: Alibaba e o Tongyi Lab

O Qwen é do Alibaba, aquele grupo chinês gigante de e-commerce e nuvem

A linha nasceu dentro do Tongyi Lab, o laboratório de IA do grupo, que depois foi reorganizado como uma unidade de negócio dedicada a grandes modelos

O nome chinês da linha é Tongyi Qianwen, e ela foi anunciada em abril de 2023

Ou seja: não é projeto de fim de semana nem startup de garagem, é laboratório de empresa grande com unidade própria pra isso

E por que isso importa pra você? Porque muda a expectativa de continuidade

Quando o modelo é braço de uma unidade de negócio, ele tende a vir em geração atrás de geração, com API, pesos e produto pronto em volta, e não em lançamento solto que morre em três meses

A família Qwen: quais modelos existem e em que tamanhos

Aqui mora a maior confusão do tema: as pessoas falam "o Qwen" como se fosse UM modelo

Não é

Qwen é guarda-chuva de uma série inteira, com dois tipos de arquitetura convivendo: modelos densos (todos os parâmetros trabalham a cada resposta) e modelos MoE, de Mixture of Experts, onde só uma parte dos parâmetros é ativada por vez

Se você nunca viu esse termo, pensa assim: no denso você chama a empresa inteira pra reunião, no MoE você chama só o time que entende do assunto

O Qwen3 é a geração que abriu bastante essa família, com pesos abertos sob licença Apache 2.0 e raciocínio híbrido: o MESMO modelo alterna entre responder direto e entrar num modo de raciocínio mais longo (thinking e non-thinking)

Outro ponto forte dessa geração é a cobertura de idiomas: 119 idiomas e dialetos no treino, contra 29 da geração anterior

Pra quem escreve em português isso conta muito, e eu já falei mais sobre as novidades do Qwen 3 em outro post aqui do blog

ModeloArquiteturaParâmetrosLicença dos pesosRaciocínio híbrido
Qwen3 densos (0,6B, 1,7B, 4B, 8B, 14B, 32B)Densode 0,6B a 32B, todos ativosApache 2.0Sim
Qwen3 30B-A3BMoE30B totais, 3B ativosApache 2.0Sim
Qwen3 235B-A22BMoE235B totais, 22B ativosApache 2.0Sim
Qwen3.8-MaxMoE2,4 trilhões totais, 95B ativospesos abertos prometidos, ainda não publicados em 05/08/2026não informado no material do anúncio
Qwen3.8-27Bnão informado no material do anúncionão informado no material do anúncioanunciado como pesos abertosnão informado no material do anúncio

Se liga na leitura da tabela: um 0,6B e um 235B carregam o mesmo sobrenome e resolvem problemas completamente diferentes

É por isso que "o Qwen é bom?" é uma pergunta meio sem resposta, tem que dizer QUAL Qwen 😀

Qwen3.8-Max: o modelo mais capaz da família até agora

Em 3 de agosto de 2026 o Alibaba apresentou o Qwen3.8-Max, o modelo mais capaz da linha até aqui

É um MoE de 2,4 trilhões de parâmetros totais com 95 bilhões ativos, e suporta janela de contexto de até 1 milhão de tokens

Na API ele é cobrado por token: US$ 2 por milhão de tokens de entrada, US$ 6 por milhão de tokens de saída e US$ 0,25 por milhão de tokens de entrada em cache

Agora a parte honesta, porque essa é a pergunta que mais aparece

O Qwen3.8-Max será o primeiro modelo da classe Max com pesos abertos, mas até 5 de agosto de 2026 os pesos ainda NÃO estavam disponíveis pra download

A publicação foi prometida pra semana seguinte ao anúncio, no Hugging Face e no ModelScope

Então se você chegou aqui querendo baixar o topo da linha hoje: calma, ainda não dá

Junto dele o Alibaba anunciou também o Qwen3.8-27B, uma versão menor e bem mais leve de hardware, igualmente de pesos abertos

E olha, isso é o mais interessante do lançamento pra mim: modelo de fronteira é bonito de ver no papel, mas quem vai rodar coisa em casa ou num servidor modesto olha pro irmão menor

Para que serve o Qwen na prática: texto, código e imagem

Beleza, e sai do papel pra quê?

O ecossistema tem três braços bem definidos, cada um resolvendo um tipo de tarefa

Qwen Studio: o caminho sem instalar nada

A plataforma oficial de uso direto pelo navegador mudou de nome: o Qwen Chat passou a se chamar Qwen Studio, anunciado em 10 de abril de 2026, mantendo dados, configurações e funcionalidades dos usuários

Se você procurou "Qwen Chat" e achou outra tela, é isso, só trocou a placa na porta

Ele fica em qwen.ai e em chat.qwen.ai, é gratuito e aberto a qualquer pessoa, e dá acesso unificado aos modelos abertos e aos proprietários da linha

O que cabe lá dentro: chat, entendimento de imagem e de vídeo, geração e edição de imagem, processamento de documentos, uso de ferramentas, voz e vídeo chat, e artifacts

É o braço "quero ver o que essa IA faz e não quero saber de terminal"

Qwen Code: o braço de código, no terminal

O Qwen Code é um agente de codificação open source que roda no terminal, mantido pela equipe Qwen no repositório QwenLM/qwen-code

Esse aqui já pede instalação: ele é instalado globalmente pelo npm, com o pacote @qwen-code/qwen-code, e exige Node.js 20 ou superior

Agente, não autocomplete: a ideia é ele mexer no projeto, não sugerir linha solta

Se você já usa alguma CLI de IA no dia a dia, o formato é familiar, tu abre o terminal na pasta do projeto e conversa com ele por ali

Qwen-Image: o braço visual

O modelo de geração de imagem da família é o Qwen-Image, um MMDiT de 20 bilhões de parâmetros aberto pela equipe Qwen em agosto de 2025

O destaque dele é renderização de texto DENTRO da imagem, em inglês e em chinês, que historicamente é o calcanhar de aquiles desse tipo de modelo

Depois veio a versão Qwen-Image-2512 sob licença Apache 2.0, o que libera uso comercial, modificação, fine-tuning e deploy próprio

Ela pode ser usada tanto no chat oficial quanto pelos pesos no Hugging Face e no ModelScope

Pra quem quer ir além de gerar do zero, também dá pra fazer edição avançada de imagem com a linha visual da família

O que o Qwen entregou nos testes do Hora de Codar

Aqui eu falo do que passou pela minha mão, não do que li em release

No vídeo abaixo eu passo um dia inteiro testando um modelo da linha Qwen em projetos meus, e mostro o resultado bruto de cada um

O primeiro teste foi uma landing page de escritório de advocacia com formulário de contato, em HTML, CSS e JavaScript, com prompt simples

Saiu em cerca de 3 minutos e o resultado me agradou: fonte diferenciada, cores boas, nada de template genérico

E olha, foi prompt simples mesmo, com um prompt bem detalhado a página sairia melhor ainda

Depois eu fiz um clone da tela inicial do Spotify com playlists, em um único prompt, e gostei do que veio, mesmo sendo simples

Já o teste mais ousado, um projeto 3D animado (um aquário interativo com controle de força da corrente), veio fraco e com bugs

Mas eu fiquei satisfeito assim mesmo, porque saiu de UM prompt só

Esse é o resumo dos meus testes: os projetos saíram com um a três prompts, e é aí que mora a graça

Teve pedra no caminho também, pra ser justo

Peguei limite de cota e mensagens de alta demanda durante as gerações, e alguns projetos quebraram no meio da gravação por causa da demanda alta no acesso gratuito

A ferramenta tentou de novo sozinha e concluiu, mas ficou lento, e eu atribuo isso ao horário de pico

Pra testar sem enrolação eu usei o modelo por dentro do editor, por uma extensão, e também pelo chat no site do próprio modelo

Duas opiniões minhas que valem mais que qualquer benchmark de slide:

  • contexto gigante não é automaticamente vantagem, a IA pode se embaralhar com informação demais
  • velocidade não é sinônimo de qualidade, rápido e errado continua errado

O que me chamou atenção de verdade não foi tamanho nem velocidade: foi ele não ser só um chat

Ele acessa ferramentas, cria arquivos e escreve código, em vez de só devolver texto pra você copiar e colar

E eu gosto MUITO da chegada de modelo assim, porque isso pressiona os modelos ocidentais a trazerem novidade e a baixarem preço, quem ganha é a gente 😀

Se você já testou algum modelo da linha, comenta aí o que saiu do seu teste, curto demais ver os projetos dos outros

Como começar a usar o Qwen hoje

Tem três caminhos de distribuição: API na Alibaba Cloud Model Studio, download dos pesos no Hugging Face e no ModelScope, e deploy próprio

Vou do mais fácil pro mais técnico, com o erro comum de cada etapa

  1. Abra o Qwen Studio no navegador

Entra em qwen.ai ou em chat.qwen.ai, é gratuito e aberto a qualquer pessoa

O erro comum deste passo: procurar por "Qwen Chat" e achar que a plataforma sumiu, ela só foi renomeada pra Qwen Studio em abril de 2026, os dados e configurações seguem lá

  1. Use o Studio pra descobrir de que braço você precisa

Lá dentro cabe chat, compreensão de imagem e vídeo, geração e edição de imagem, documentos, ferramentas, voz e vídeo chat e artifacts

O erro comum deste passo: julgar a família inteira por uma tarefa só, um teste de imagem não diz nada sobre o desempenho em código

  1. Se for integrar no seu sistema, vá de API pela Alibaba Cloud Model Studio

É o caminho de quem quer o modelo dentro do próprio produto, com cobrança por token

O erro comum deste passo: assumir que o preço de um modelo vale pra família toda, cada modelo tem a sua tabela (o Qwen3.8-Max, por exemplo, é US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de saída, com entrada em cache a US$ 0,25 por milhão)

  1. Pra codar no terminal, instale o Qwen Code

Aqui sim entra instalação: ele vai global pelo npm e exige Node.js 20 ou superior

node -v
npm install -g @qwen-code/qwen-code

O erro comum deste passo: rodar o npm install com Node antigo e tomar erro na instalação ou na primeira execução, confere o node -v ANTES, não depois 😛

  1. Pra rodar por conta própria, baixe os pesos

Os pesos abertos ficam em huggingface.co/Qwen e no ModelScope, e daí você faz o deploy onde quiser

O erro comum deste passo: contar com os pesos do Qwen3.8-Max hoje, eles ainda não estavam publicados em 5 de agosto de 2026

E tome cuidado com a expectativa de hardware: rodar modelo grande localmente pede GPU forte, aquele PC da Nasa, então versão em nuvem costuma ser o caminho viável pra maioria

Vale a pena entrar no ecossistema Qwen?

Depende de qual dos três caminhos é o seu, e aqui vai o meu resumo honesto

Se você é curioso e só quer entender o hype, o Qwen Studio resolve: grátis, no navegador, com chat, imagem e documentos no mesmo lugar

Se você é dev, o Qwen Code no terminal e a API na Alibaba Cloud Model Studio são a porta de entrada séria, com custo por token na mesa antes de você escrever a primeira linha

E se o seu problema é licença, a Apache 2.0 dos modelos abertos do Qwen3 e do Qwen-Image-2512 é o argumento mais forte da família, porque libera uso comercial, modificação e deploy próprio

O que segue em aberto é o principal: os pesos do Qwen3.8-Max, prometidos pro Hugging Face e pro ModelScope mas ainda não publicados até 5 de agosto de 2026

Minha sugestão de próximo passo é a mais simples possível: abre o Qwen Studio e joga UMA tarefa real sua nele, daquelas que você faz toda semana

Migrar fluxo inteiro por causa de anúncio de lançamento é receita de dor de cabeça, teste primeiro e decide depois, beleza?

Até o próximo post!

Perguntas frequentes

O Qwen é gratuito ou pago?

O Qwen Studio é gratuito e aberto a qualquer pessoa, dando acesso unificado aos modelos abertos e proprietários da linha. Já o uso via API é cobrado por token: o Qwen3.8-Max, por exemplo, custa US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de saída, com US$ 0,25 por milhão em cache.

Já dá para baixar os pesos do Qwen3.8-Max?

Até 5 de agosto de 2026 os pesos do Qwen3.8-Max ainda não estavam disponíveis para download. A publicação foi prometida para a semana seguinte ao anúncio, no Hugging Face e no ModelScope, e ele será o primeiro modelo da classe Max do Qwen com pesos abertos.

Qual a diferença entre Qwen Chat e Qwen Studio?

É o mesmo produto: o Qwen Chat foi renomeado para Qwen Studio em 10 de abril de 2026, mantendo dados, configurações e funcionalidades dos usuários. Se você procurava por Qwen Chat e caiu numa tela diferente, só trocou a placa na porta.

Como instalar o Qwen Code no terminal?

O Qwen Code se instala globalmente pelo npm com o pacote @qwen-code/qwen-code, e exige Node.js 20 ou superior. Ele é mantido pela equipe Qwen no repositório github.com/QwenLM/qwen-code. Se você não quer instalar nada, o caminho é o Qwen Studio no navegador.

O Qwen funciona bem em português e outros idiomas?

O Qwen3 foi treinado cobrindo 119 idiomas e dialetos, contra 29 da geração anterior. Isso amplia bastante a cobertura pra quem escreve e conversa em português.

Onde acessar os modelos Qwen além do chat oficial?

Os modelos Qwen são distribuídos por três caminhos: API na Alibaba Cloud Model Studio, download dos pesos no Hugging Face e no ModelScope, e deploy próprio (self-hosting). A escolha depende de você querer só usar, baixar pra rodar local ou integrar via API.




Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted
Inline Feedbacks
View all comments

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares