O que é o Qwen, a IA do Alibaba, e para que ele serve?

Qwen é a família de modelos de IA do Alibaba, criada pelo Tongyi Lab e anunciada em abril de 2023 com o nome chinês Tongyi Qianwen. Não é um modelo só: é uma série com versões densas e MoE, de 0,6B até modelos de trilhões de parâmetros, boa parte sob licença Apache 2.0. O ecossistema tem três braços: o Qwen Studio (ex-Qwen Chat) pra usar grátis no navegador, o Qwen Code como agente de codificação no terminal e o Qwen-Image pra gerar e editar imagem. Dá pra consumir por API, baixar os pesos ou rodar por conta própria
Fala aí, beleza? Quem ouve falar em Qwen pela primeira vez sempre faz a mesma pergunta: isso é um chatbot, um modelo ou uma plataforma?
A resposta curta é: os três, e é exatamente por isso que o nome confunde tanto
Qwen é a família de modelos de IA do Alibaba, com braços em texto, código e imagem, e ainda tem um site oficial onde tu usa tudo isso direto pelo navegador
Neste post eu separo cada pedaço: quem faz, quais modelos existem, o que cada braço resolve na prática e como começar hoje, do navegador ao terminal 🙂
Quem está por trás do Qwen: Alibaba e o Tongyi Lab
O Qwen é do Alibaba, aquele grupo chinês gigante de e-commerce e nuvem
A linha nasceu dentro do Tongyi Lab, o laboratório de IA do grupo, que depois foi reorganizado como uma unidade de negócio dedicada a grandes modelos
O nome chinês da linha é Tongyi Qianwen, e ela foi anunciada em abril de 2023
Ou seja: não é projeto de fim de semana nem startup de garagem, é laboratório de empresa grande com unidade própria pra isso
E por que isso importa pra você? Porque muda a expectativa de continuidade
Quando o modelo é braço de uma unidade de negócio, ele tende a vir em geração atrás de geração, com API, pesos e produto pronto em volta, e não em lançamento solto que morre em três meses
A família Qwen: quais modelos existem e em que tamanhos
Aqui mora a maior confusão do tema: as pessoas falam "o Qwen" como se fosse UM modelo
Não é
Qwen é guarda-chuva de uma série inteira, com dois tipos de arquitetura convivendo: modelos densos (todos os parâmetros trabalham a cada resposta) e modelos MoE, de Mixture of Experts, onde só uma parte dos parâmetros é ativada por vez
Se você nunca viu esse termo, pensa assim: no denso você chama a empresa inteira pra reunião, no MoE você chama só o time que entende do assunto
O Qwen3 é a geração que abriu bastante essa família, com pesos abertos sob licença Apache 2.0 e raciocínio híbrido: o MESMO modelo alterna entre responder direto e entrar num modo de raciocínio mais longo (thinking e non-thinking)
Outro ponto forte dessa geração é a cobertura de idiomas: 119 idiomas e dialetos no treino, contra 29 da geração anterior
Pra quem escreve em português isso conta muito, e eu já falei mais sobre as novidades do Qwen 3 em outro post aqui do blog
| Modelo | Arquitetura | Parâmetros | Licença dos pesos | Raciocínio híbrido |
|---|---|---|---|---|
| Qwen3 densos (0,6B, 1,7B, 4B, 8B, 14B, 32B) | Denso | de 0,6B a 32B, todos ativos | Apache 2.0 | Sim |
| Qwen3 30B-A3B | MoE | 30B totais, 3B ativos | Apache 2.0 | Sim |
| Qwen3 235B-A22B | MoE | 235B totais, 22B ativos | Apache 2.0 | Sim |
| Qwen3.8-Max | MoE | 2,4 trilhões totais, 95B ativos | pesos abertos prometidos, ainda não publicados em 05/08/2026 | não informado no material do anúncio |
| Qwen3.8-27B | não informado no material do anúncio | não informado no material do anúncio | anunciado como pesos abertos | não informado no material do anúncio |
Se liga na leitura da tabela: um 0,6B e um 235B carregam o mesmo sobrenome e resolvem problemas completamente diferentes
É por isso que "o Qwen é bom?" é uma pergunta meio sem resposta, tem que dizer QUAL Qwen 😀
Qwen3.8-Max: o modelo mais capaz da família até agora
Em 3 de agosto de 2026 o Alibaba apresentou o Qwen3.8-Max, o modelo mais capaz da linha até aqui
É um MoE de 2,4 trilhões de parâmetros totais com 95 bilhões ativos, e suporta janela de contexto de até 1 milhão de tokens
Na API ele é cobrado por token: US$ 2 por milhão de tokens de entrada, US$ 6 por milhão de tokens de saída e US$ 0,25 por milhão de tokens de entrada em cache
Agora a parte honesta, porque essa é a pergunta que mais aparece
O Qwen3.8-Max será o primeiro modelo da classe Max com pesos abertos, mas até 5 de agosto de 2026 os pesos ainda NÃO estavam disponíveis pra download
A publicação foi prometida pra semana seguinte ao anúncio, no Hugging Face e no ModelScope
Então se você chegou aqui querendo baixar o topo da linha hoje: calma, ainda não dá
Junto dele o Alibaba anunciou também o Qwen3.8-27B, uma versão menor e bem mais leve de hardware, igualmente de pesos abertos
E olha, isso é o mais interessante do lançamento pra mim: modelo de fronteira é bonito de ver no papel, mas quem vai rodar coisa em casa ou num servidor modesto olha pro irmão menor
Para que serve o Qwen na prática: texto, código e imagem
Beleza, e sai do papel pra quê?
O ecossistema tem três braços bem definidos, cada um resolvendo um tipo de tarefa
Qwen Studio: o caminho sem instalar nada
A plataforma oficial de uso direto pelo navegador mudou de nome: o Qwen Chat passou a se chamar Qwen Studio, anunciado em 10 de abril de 2026, mantendo dados, configurações e funcionalidades dos usuários
Se você procurou "Qwen Chat" e achou outra tela, é isso, só trocou a placa na porta
Ele fica em qwen.ai e em chat.qwen.ai, é gratuito e aberto a qualquer pessoa, e dá acesso unificado aos modelos abertos e aos proprietários da linha
O que cabe lá dentro: chat, entendimento de imagem e de vídeo, geração e edição de imagem, processamento de documentos, uso de ferramentas, voz e vídeo chat, e artifacts
É o braço "quero ver o que essa IA faz e não quero saber de terminal"
Qwen Code: o braço de código, no terminal
O Qwen Code é um agente de codificação open source que roda no terminal, mantido pela equipe Qwen no repositório QwenLM/qwen-code
Esse aqui já pede instalação: ele é instalado globalmente pelo npm, com o pacote @qwen-code/qwen-code, e exige Node.js 20 ou superior
Agente, não autocomplete: a ideia é ele mexer no projeto, não sugerir linha solta
Se você já usa alguma CLI de IA no dia a dia, o formato é familiar, tu abre o terminal na pasta do projeto e conversa com ele por ali
Qwen-Image: o braço visual
O modelo de geração de imagem da família é o Qwen-Image, um MMDiT de 20 bilhões de parâmetros aberto pela equipe Qwen em agosto de 2025
O destaque dele é renderização de texto DENTRO da imagem, em inglês e em chinês, que historicamente é o calcanhar de aquiles desse tipo de modelo
Depois veio a versão Qwen-Image-2512 sob licença Apache 2.0, o que libera uso comercial, modificação, fine-tuning e deploy próprio
Ela pode ser usada tanto no chat oficial quanto pelos pesos no Hugging Face e no ModelScope
Pra quem quer ir além de gerar do zero, também dá pra fazer edição avançada de imagem com a linha visual da família
O que o Qwen entregou nos testes do Hora de Codar
Aqui eu falo do que passou pela minha mão, não do que li em release
No vídeo abaixo eu passo um dia inteiro testando um modelo da linha Qwen em projetos meus, e mostro o resultado bruto de cada um
O primeiro teste foi uma landing page de escritório de advocacia com formulário de contato, em HTML, CSS e JavaScript, com prompt simples
Saiu em cerca de 3 minutos e o resultado me agradou: fonte diferenciada, cores boas, nada de template genérico
E olha, foi prompt simples mesmo, com um prompt bem detalhado a página sairia melhor ainda
Depois eu fiz um clone da tela inicial do Spotify com playlists, em um único prompt, e gostei do que veio, mesmo sendo simples
Já o teste mais ousado, um projeto 3D animado (um aquário interativo com controle de força da corrente), veio fraco e com bugs
Mas eu fiquei satisfeito assim mesmo, porque saiu de UM prompt só
Esse é o resumo dos meus testes: os projetos saíram com um a três prompts, e é aí que mora a graça
Teve pedra no caminho também, pra ser justo
Peguei limite de cota e mensagens de alta demanda durante as gerações, e alguns projetos quebraram no meio da gravação por causa da demanda alta no acesso gratuito
A ferramenta tentou de novo sozinha e concluiu, mas ficou lento, e eu atribuo isso ao horário de pico
Pra testar sem enrolação eu usei o modelo por dentro do editor, por uma extensão, e também pelo chat no site do próprio modelo
Duas opiniões minhas que valem mais que qualquer benchmark de slide:
- contexto gigante não é automaticamente vantagem, a IA pode se embaralhar com informação demais
- velocidade não é sinônimo de qualidade, rápido e errado continua errado
O que me chamou atenção de verdade não foi tamanho nem velocidade: foi ele não ser só um chat
Ele acessa ferramentas, cria arquivos e escreve código, em vez de só devolver texto pra você copiar e colar
E eu gosto MUITO da chegada de modelo assim, porque isso pressiona os modelos ocidentais a trazerem novidade e a baixarem preço, quem ganha é a gente 😀
Se você já testou algum modelo da linha, comenta aí o que saiu do seu teste, curto demais ver os projetos dos outros
Como começar a usar o Qwen hoje
Tem três caminhos de distribuição: API na Alibaba Cloud Model Studio, download dos pesos no Hugging Face e no ModelScope, e deploy próprio
Vou do mais fácil pro mais técnico, com o erro comum de cada etapa
- Abra o Qwen Studio no navegador
Entra em qwen.ai ou em chat.qwen.ai, é gratuito e aberto a qualquer pessoa
O erro comum deste passo: procurar por "Qwen Chat" e achar que a plataforma sumiu, ela só foi renomeada pra Qwen Studio em abril de 2026, os dados e configurações seguem lá
- Use o Studio pra descobrir de que braço você precisa
Lá dentro cabe chat, compreensão de imagem e vídeo, geração e edição de imagem, documentos, ferramentas, voz e vídeo chat e artifacts
O erro comum deste passo: julgar a família inteira por uma tarefa só, um teste de imagem não diz nada sobre o desempenho em código
- Se for integrar no seu sistema, vá de API pela Alibaba Cloud Model Studio
É o caminho de quem quer o modelo dentro do próprio produto, com cobrança por token
O erro comum deste passo: assumir que o preço de um modelo vale pra família toda, cada modelo tem a sua tabela (o Qwen3.8-Max, por exemplo, é US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de saída, com entrada em cache a US$ 0,25 por milhão)
- Pra codar no terminal, instale o Qwen Code
Aqui sim entra instalação: ele vai global pelo npm e exige Node.js 20 ou superior
node -v
npm install -g @qwen-code/qwen-codeO erro comum deste passo: rodar o npm install com Node antigo e tomar erro na instalação ou na primeira execução, confere o node -v ANTES, não depois 😛
- Pra rodar por conta própria, baixe os pesos
Os pesos abertos ficam em huggingface.co/Qwen e no ModelScope, e daí você faz o deploy onde quiser
O erro comum deste passo: contar com os pesos do Qwen3.8-Max hoje, eles ainda não estavam publicados em 5 de agosto de 2026
E tome cuidado com a expectativa de hardware: rodar modelo grande localmente pede GPU forte, aquele PC da Nasa, então versão em nuvem costuma ser o caminho viável pra maioria
Vale a pena entrar no ecossistema Qwen?
Depende de qual dos três caminhos é o seu, e aqui vai o meu resumo honesto
Se você é curioso e só quer entender o hype, o Qwen Studio resolve: grátis, no navegador, com chat, imagem e documentos no mesmo lugar
Se você é dev, o Qwen Code no terminal e a API na Alibaba Cloud Model Studio são a porta de entrada séria, com custo por token na mesa antes de você escrever a primeira linha
E se o seu problema é licença, a Apache 2.0 dos modelos abertos do Qwen3 e do Qwen-Image-2512 é o argumento mais forte da família, porque libera uso comercial, modificação e deploy próprio
O que segue em aberto é o principal: os pesos do Qwen3.8-Max, prometidos pro Hugging Face e pro ModelScope mas ainda não publicados até 5 de agosto de 2026
Minha sugestão de próximo passo é a mais simples possível: abre o Qwen Studio e joga UMA tarefa real sua nele, daquelas que você faz toda semana
Migrar fluxo inteiro por causa de anúncio de lançamento é receita de dor de cabeça, teste primeiro e decide depois, beleza?
Até o próximo post!
Perguntas frequentes
O Qwen é gratuito ou pago?
O Qwen Studio é gratuito e aberto a qualquer pessoa, dando acesso unificado aos modelos abertos e proprietários da linha. Já o uso via API é cobrado por token: o Qwen3.8-Max, por exemplo, custa US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de saída, com US$ 0,25 por milhão em cache.
Já dá para baixar os pesos do Qwen3.8-Max?
Até 5 de agosto de 2026 os pesos do Qwen3.8-Max ainda não estavam disponíveis para download. A publicação foi prometida para a semana seguinte ao anúncio, no Hugging Face e no ModelScope, e ele será o primeiro modelo da classe Max do Qwen com pesos abertos.
Qual a diferença entre Qwen Chat e Qwen Studio?
É o mesmo produto: o Qwen Chat foi renomeado para Qwen Studio em 10 de abril de 2026, mantendo dados, configurações e funcionalidades dos usuários. Se você procurava por Qwen Chat e caiu numa tela diferente, só trocou a placa na porta.
Como instalar o Qwen Code no terminal?
O Qwen Code se instala globalmente pelo npm com o pacote @qwen-code/qwen-code, e exige Node.js 20 ou superior. Ele é mantido pela equipe Qwen no repositório github.com/QwenLM/qwen-code. Se você não quer instalar nada, o caminho é o Qwen Studio no navegador.
O Qwen funciona bem em português e outros idiomas?
O Qwen3 foi treinado cobrindo 119 idiomas e dialetos, contra 29 da geração anterior. Isso amplia bastante a cobertura pra quem escreve e conversa em português.
Onde acessar os modelos Qwen além do chat oficial?
Os modelos Qwen são distribuídos por três caminhos: API na Alibaba Cloud Model Studio, download dos pesos no Hugging Face e no ModelScope, e deploy próprio (self-hosting). A escolha depende de você querer só usar, baixar pra rodar local ou integrar via API.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares

As diferenças de var, let e const

Como fazer redirecionamento com PHP
Neste artigo você vai aprender a como fazer redirecionamento com PHP, utilizaremos abordagens fáceis de entender e de aplicar Fala programador(a), beleza? Bora aprender mais […]

ChatGPT: o que é, como usar, dicas e como acessar login
ChatGPT é uma ferramenta de processamento de linguagem natural (NLP) baseada na arquitetura GPT-3.5, desenvolvida pela OpenAI. Sua criação representa um marco significativo no campo […]
