Qwen é gratuito? Planos, limites de uso e o que mudou em 2026

Qwen é gratuito, sim, mas depende do caminho. O chat no Qwen Studio (antigo Qwen Chat, renomeado em 10/04/2026) segue gratuito e sem assinatura mensal equivalente a ChatGPT Plus ou Claude Pro. Já a API cobra: o nível gratuito por Qwen OAuth foi encerrado em 15/04/2026, sem substituto anunciado. Contas novas do Alibaba Cloud Model Studio ganham 1.000.000 de tokens por modelo elegível por 90 dias, só na região de Singapura. Depois disso é pay-as-you-go (Qwen3.8-Max a US$ 2 por milhão de entrada e US$ 6 de saída) ou Coding Plan. E os pesos abertos do Qwen3 são Apache 2.0, livres pra baixar.
Fala aí, beleza? "Qwen é gratuito" é uma daquelas perguntas que tem três respostas ao mesmo tempo, e todas certas 😅
Porque depende do caminho: conversar no chat, chamar por API ou baixar os pesos e rodar na tua máquina
Cada um desses tem uma régua de cobrança diferente, e em 2026 uma delas mudou bastante (pra pior, se tu contava com ela)
Bora separar isso antes de você investir tempo montando uma automação que esbarra num limite…
Qwen Chat virou Qwen Studio: o que mudou
Se você procurou por "Qwen Chat" e achou que perdeu alguma coisa, calma
A renomeação foi anunciada em 10/04/2026: o Qwen Chat passou a se chamar Qwen Studio, mantendo dados, ajustes e funcionalidades
O acesso continua pelos endereços oficiais qwen.ai e chat.qwen.ai
O Qwen Studio é a plataforma oficial de acesso unificado aos modelos abertos e proprietários do Qwen, com uso livre
E é aqui que mora a parte gratuita da história: não existe assinatura mensal do chat equivalente a ChatGPT Plus ou Claude Pro
A cobrança aparece só no caminho de API/desenvolvedor, beleza? O chat de consumidor segue gratuito
E limite de mensagens por dia? Não achei página oficial documentando teto nenhum, e os blogs por aí dizem tanto "sem limites" quanto "limitado por taxa"
Então não vou chutar número aqui: o que dá pra afirmar é que o uso do chat é livre e não passa por assinatura
O nível gratuito de API por Qwen OAuth acabou
Essa é a parte que mais dói pra quem planejava usar Qwen sem pagar nada
O nível gratuito de API por Qwen OAuth foi encerrado em 15/04/2026, sem restauração posterior nem substituto anunciado
E ele não morreu de uma vez: antes do fechamento total, a cota gratuita caiu de 1.000 requisições por dia para 100 requisições por dia
Na documentação de autenticação do Qwen Code, o Qwen OAuth deixou de ser uma opção selecionável e consta como provedor descontinuado desde 15/04/2026
Só pra não gerar confusão: o que acabou naquela data foi ESSE caminho gratuito por OAuth, não a cobrança da API como um todo ter começado ali
Tanto que continua existindo uso gratuito no lado de desenvolvedor, pela cota inicial de conta nova no Model Studio (falo dela logo abaixo)
O impacto prático é direto: todo tutorial (e todo vídeo) que mostrava "loga com a tua conta Qwen no terminal e usa de graça" descreve um caminho que não existe mais
Se o teu plano era esse, ele precisa de plano B 🙃
Os caminhos de uso do Qwen e onde cada um custa
Dá pra resumir a vida em três portas, e cada uma cobra de um jeito:
- Chat no Qwen Studio: gratuito, sem plano de assinatura pro usuário final
- API no Alibaba Cloud Model Studio: pago por uso, com cota inicial pra conta nova
- Pesos abertos do Qwen3: licença Apache 2.0, com distribuição em Hugging Face, ModelScope e Kaggle
A terceira porta é a mais subestimada: sendo Apache 2.0, você baixa e roda onde quiser, e aí o custo vira infraestrutura, não licença
Claro que rodar modelo grande em casa pede um PC da Nasa, mas a permissão tá lá
Se você quer entender melhor o que essa família de modelos entrega, tem um guia sobre o Qwen 3 da Alibaba em português aqui do blog
E o Qwen Code, é grátis?
O Qwen Code é um agente de codificação de terminal open source, no repositório QwenLM/qwen-code sob Apache 2.0
Instalar não custa nada, é um npm e pronto:
npm install -g @qwen-code/qwen-code@latestMas se liga na diferença: a ferramenta é gratuita, o combustível não necessariamente
Como o Qwen OAuth saiu de cena, não conte com autenticação gratuita embutida: o consumo de modelo vem pelo caminho de API
Planos e limites do Qwen na API: cota gratuita, pay-as-you-go e Coding Plan
Aqui é onde a pergunta "é gratuito?" vira "gratuito até quando?"
Contas novas do Alibaba Cloud Model Studio recebem cota gratuita ao ativar o serviço, e depois dela o jogo é pagar por uso ou assinar
| Caminho | Como cobra | Teto conhecido | Detalhe que pega |
|---|---|---|---|
| Cota gratuita (conta nova no Model Studio) | Sem cobrança enquanto durar | 1.000.000 de tokens por modelo elegível, válida por 90 dias a partir da ativação | Só na região de Singapura e cobre apenas inferência em tempo real |
| Pay-as-you-go (Qwen3.8-Max) | Por token consumido | Sem exigência de assinatura de Token Plan | US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de saída no Model Studio |
| Coding Plan Pro | Assinatura mensal de valor fixo | Até 90.000 requisições por mês | Oferta de quantidade limitada: esgotando, o plano deixa de ficar disponível |
| Coding Plan Lite | Fora de circulação | Sem novas compras desde 20/03/2026 | Sem renovações e upgrades desde 13/04/2026 |
O Qwen3.8-Max foi apresentado em 02/08/2026 e entrou na API pay-as-you-go em 03/08/2026, como modelo de topo
O Coding Plan é a alternativa de valor fixo ao pagamento por uso, com acesso a modelos dentro de ferramentas de codificação
E quanto custa o Coding Plan por mês? A documentação oficial remete ao carrinho de compra e não exibe o valor, então não tem número aqui
Acho zoado botar preço por achismo, e tem blog citando cifras que a Alibaba não publica
Onde ficam as barreiras de uso na prática
Tem gente que trava sem nem chegar perto do fim do dinheiro, porque o limite que morde primeiro é outro
Limite duplo de taxa. As chamadas de API do Model Studio têm limite de requisições por minuto (RPM) e de tokens por minuto (TPM)
O erro Requests rate limit exceeded indica que você bateu no RPM
Já Allocated quota exceeded indica TPM
Saber ler esses dois é meio caminho pra corrigir: um pede espaçar as chamadas, o outro pede mandar menos texto por minuto
Cota compartilhada. A cota gratuita é dividida entre a conta Alibaba Cloud e seus usuários RAM
O exemplo da própria documentação deixa claro: cota de 1.000.000 de tokens em qwen-max, a conta usa 100.000, um usuário RAM usa 200.000, sobram 700.000
Ou seja, não é 1 milhão por pessoa do time, é 1 milhão pro conjunto
Freio de mão contra susto na fatura. Existe o recurso Free quota only, habilitado na página de detalhes do modelo
Ele interrompe o serviço quando a cota acaba, em vez de deixar escorrer pro pago
Tome cuidado com o escopo: vale só para modelos da região de Singapura e dentro do período de validade da cota
O custo real do Qwen em uso pesado: o que vi comparando com o GLM
Quando o caminho é pago por uso, o preço de tabela conta menos do que parece
O que pesa mesmo é quanto o modelo consome pra terminar a tarefa
No vídeo eu montei 4 projetos, cada um a partir de um único prompt, e coloquei Qwen e GLM pra tocar exatamente os mesmos projetos
Rodei os dois dentro do Claude Code pagando por uso, acompanhando o custo acumulado no painel de gasto a cada rodada (se você usa a ferramenta por assinatura, os planos do Claude Code seguem outra lógica de cobrança)
Na primeira rodada o Qwen gastou praticamente três vezes menos que o GLM
Na rodada seguinte o GLM custou pelo menos o dobro do Qwen
Um dos projetos o GLM entregou em 15 minutos na minha máquina, e mesmo com número de requisições e tokens parecidos, o custo final dos dois ficou bem distante
O Qwen chegou a fazer mais requisições em uma das rodadas e ainda assim saiu mais barato… minha hipótese é que ele aproveita melhor o fluxo do Claude Code
Nem tudo foi lindo, se liga: o Qwen subiu um projeto numa porta errada e eu precisei pedir pra reiniciar em outra, enquanto o concorrente achou porta livre sozinho
Abri cada entrega no navegador e testei o comportamento na prática, incluindo um projeto de caminho mais curto em que desenhei obstáculos na mão
Esperava que o GLM ganhasse e me surpreendi: pagar mais caro num modelo não garante entrega melhor, e benchmark não substitui teste próprio
Deixo claro o recorte: ali eu medi custo por tarefa em uso via API, não plano gratuito nem limite de assinatura
Ah, e uma coisa que ficou óbvia no processo: escrever prompt melhor economiza token, e token economizado é conta menor no fim do mês
Pra começar do zero nesse papo de custo do Qwen, esse vídeo do canal mostra os 4 projetos rodando lado a lado e o painel de gasto de cada rodada:
Vale usar o Qwen de graça? O veredito
Depende de quem você é nessa história, então vou por perfil:
Você só quer conversar, testar modelos e resolver coisa do dia a dia? O Qwen Studio te atende sem pagar nada e sem assinatura, ponto
É o cenário em que a resposta pra "Qwen é gratuito" é um sim seco
Você quer automatizar, plugar em script, rodar agente? Conte com custo desde cedo
O caminho gratuito por OAuth foi encerrado, e o que sobra é a cota inicial da conta nova (1.000.000 de tokens por modelo elegível, 90 dias, região de Singapura) e depois pay-as-you-go ou Coding Plan
Você tem infraestrutura e quer independência? Os pesos abertos do Qwen3 estão sob Apache 2.0 em Hugging Face, ModelScope e Kaggle
Aí o custo muda de natureza: vira máquina, energia e manutenção, não fatura de API
O que eu não faço é prometer o que ninguém documentou: teto de mensagens no chat, valor mensal do Coding Plan e disponibilidade atual do Pro ficam fora, porque a fonte oficial não mostra 🙂
Conclusão
Resumindo a novela: o Qwen é gratuito no chat, cobrado na API (com uma cota inicial pra conta nova) e livre nos pesos abertos
O próximo passo é escolher a porta ANTES de investir tempo: chat pra explorar, API com cota inicial pra prototipar, pesos abertos pra rodar por conta própria
Se a escolha for API, faça o dever de casa antes de montar automação: confira RPM e TPM, lembre que a cota é compartilhada com os usuários RAM e olhe a validade dos 90 dias
E se você for pagar por uso, compare gasto por tarefa, não só preço por milhão de token… foi exatamente aí que o resultado do meu teste me pegou de surpresa
Até o próximo post! =)
Perguntas frequentes
Dá pra usar o Qwen OAuth de graça em 2026?
Não. O nível gratuito de API por Qwen OAuth foi encerrado em 15/04/2026, sem restauração posterior nem substituto anunciado. Antes do fechamento total, a cota já tinha caído de 1.000 para 100 requisições por dia, e hoje ele consta como provedor descontinuado na documentação do Qwen Code. O que acabou foi esse caminho por OAuth: contas novas do Model Studio seguem recebendo cota gratuita ao ativar o serviço.
O Qwen Code funciona sem pagar nada?
Instalar o Qwen Code não custa nada: é um agente open source sob Apache 2.0, instalado com npm install -g @qwen-code/qwen-code@latest. Mas a ferramenta em si é gratuita, o consumo de modelo não, já que a autenticação gratuita via Qwen OAuth saiu de cena.
Quanto custa usar o Qwen3.8-Max pela API?
O Qwen3.8-Max custa US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída no Model Studio. Ele foi apresentado em 02/08/2026 e entrou na API pay-as-you-go em 03/08/2026, sem exigir assinatura de Token Plan.
Qual a diferença entre o Coding Plan e pagar por uso no Qwen?
O Coding Plan é uma assinatura mensal de valor fixo, alternativa ao pagamento por token. O Coding Plan Pro tem teto de até 90.000 requisições por mês e é oferta de quantidade limitada, enquanto o Coding Plan Lite já saiu de circulação: parou de aceitar novas compras em 20/03/2026 e parou renovações e upgrades em 13/04/2026.
Rodar os modelos Qwen3 localmente é gratuito?
Os pesos abertos do Qwen3 são licenciados em Apache 2.0 e distribuídos em Hugging Face, ModelScope e Kaggle, então baixar e rodar não tem custo de licença. O gasto que sobra é de infraestrutura, ou seja, o hardware necessário pra rodar o modelo na tua máquina.
Toda conta nova do Qwen no Model Studio ganha cota gratuita?
Sim, contas novas do Alibaba Cloud Model Studio recebem 1.000.000 de tokens por modelo elegível ao ativar o serviço, válidos por 90 dias. Essa cota vale só na região de Singapura, cobre apenas inferência em tempo real e é compartilhada entre a conta e os usuários RAM vinculados a ela.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares

As diferenças de var, let e const

Como fazer redirecionamento com PHP
Neste artigo você vai aprender a como fazer redirecionamento com PHP, utilizaremos abordagens fáceis de entender e de aplicar Fala programador(a), beleza? Bora aprender mais […]

ChatGPT: o que é, como usar, dicas e como acessar login
ChatGPT é uma ferramenta de processamento de linguagem natural (NLP) baseada na arquitetura GPT-3.5, desenvolvida pela OpenAI. Sua criação representa um marco significativo no campo […]
