Qwen é gratuito? Planos, limites de uso e o que mudou em 2026

Qwen é gratuito no chat, mas a API tem limites de uso e cobrança
Resposta rápida

Qwen é gratuito, sim, mas depende do caminho. O chat no Qwen Studio (antigo Qwen Chat, renomeado em 10/04/2026) segue gratuito e sem assinatura mensal equivalente a ChatGPT Plus ou Claude Pro. Já a API cobra: o nível gratuito por Qwen OAuth foi encerrado em 15/04/2026, sem substituto anunciado. Contas novas do Alibaba Cloud Model Studio ganham 1.000.000 de tokens por modelo elegível por 90 dias, só na região de Singapura. Depois disso é pay-as-you-go (Qwen3.8-Max a US$ 2 por milhão de entrada e US$ 6 de saída) ou Coding Plan. E os pesos abertos do Qwen3 são Apache 2.0, livres pra baixar.

Fala aí, beleza? "Qwen é gratuito" é uma daquelas perguntas que tem três respostas ao mesmo tempo, e todas certas 😅

Porque depende do caminho: conversar no chat, chamar por API ou baixar os pesos e rodar na tua máquina

Cada um desses tem uma régua de cobrança diferente, e em 2026 uma delas mudou bastante (pra pior, se tu contava com ela)

Bora separar isso antes de você investir tempo montando uma automação que esbarra num limite…

Qwen Chat virou Qwen Studio: o que mudou

Se você procurou por "Qwen Chat" e achou que perdeu alguma coisa, calma

A renomeação foi anunciada em 10/04/2026: o Qwen Chat passou a se chamar Qwen Studio, mantendo dados, ajustes e funcionalidades

O acesso continua pelos endereços oficiais qwen.ai e chat.qwen.ai

O Qwen Studio é a plataforma oficial de acesso unificado aos modelos abertos e proprietários do Qwen, com uso livre

E é aqui que mora a parte gratuita da história: não existe assinatura mensal do chat equivalente a ChatGPT Plus ou Claude Pro

A cobrança aparece só no caminho de API/desenvolvedor, beleza? O chat de consumidor segue gratuito

E limite de mensagens por dia? Não achei página oficial documentando teto nenhum, e os blogs por aí dizem tanto "sem limites" quanto "limitado por taxa"

Então não vou chutar número aqui: o que dá pra afirmar é que o uso do chat é livre e não passa por assinatura

O nível gratuito de API por Qwen OAuth acabou

Essa é a parte que mais dói pra quem planejava usar Qwen sem pagar nada

O nível gratuito de API por Qwen OAuth foi encerrado em 15/04/2026, sem restauração posterior nem substituto anunciado

E ele não morreu de uma vez: antes do fechamento total, a cota gratuita caiu de 1.000 requisições por dia para 100 requisições por dia

Na documentação de autenticação do Qwen Code, o Qwen OAuth deixou de ser uma opção selecionável e consta como provedor descontinuado desde 15/04/2026

Só pra não gerar confusão: o que acabou naquela data foi ESSE caminho gratuito por OAuth, não a cobrança da API como um todo ter começado ali

Tanto que continua existindo uso gratuito no lado de desenvolvedor, pela cota inicial de conta nova no Model Studio (falo dela logo abaixo)

O impacto prático é direto: todo tutorial (e todo vídeo) que mostrava "loga com a tua conta Qwen no terminal e usa de graça" descreve um caminho que não existe mais

Se o teu plano era esse, ele precisa de plano B 🙃

Os caminhos de uso do Qwen e onde cada um custa

Dá pra resumir a vida em três portas, e cada uma cobra de um jeito:

  • Chat no Qwen Studio: gratuito, sem plano de assinatura pro usuário final
  • API no Alibaba Cloud Model Studio: pago por uso, com cota inicial pra conta nova
  • Pesos abertos do Qwen3: licença Apache 2.0, com distribuição em Hugging Face, ModelScope e Kaggle

A terceira porta é a mais subestimada: sendo Apache 2.0, você baixa e roda onde quiser, e aí o custo vira infraestrutura, não licença

Claro que rodar modelo grande em casa pede um PC da Nasa, mas a permissão tá lá

Se você quer entender melhor o que essa família de modelos entrega, tem um guia sobre o Qwen 3 da Alibaba em português aqui do blog

E o Qwen Code, é grátis?

O Qwen Code é um agente de codificação de terminal open source, no repositório QwenLM/qwen-code sob Apache 2.0

Instalar não custa nada, é um npm e pronto:

npm install -g @qwen-code/qwen-code@latest

Mas se liga na diferença: a ferramenta é gratuita, o combustível não necessariamente

Como o Qwen OAuth saiu de cena, não conte com autenticação gratuita embutida: o consumo de modelo vem pelo caminho de API

Planos e limites do Qwen na API: cota gratuita, pay-as-you-go e Coding Plan

Aqui é onde a pergunta "é gratuito?" vira "gratuito até quando?"

Contas novas do Alibaba Cloud Model Studio recebem cota gratuita ao ativar o serviço, e depois dela o jogo é pagar por uso ou assinar

CaminhoComo cobraTeto conhecidoDetalhe que pega
Cota gratuita (conta nova no Model Studio)Sem cobrança enquanto durar1.000.000 de tokens por modelo elegível, válida por 90 dias a partir da ativaçãoSó na região de Singapura e cobre apenas inferência em tempo real
Pay-as-you-go (Qwen3.8-Max)Por token consumidoSem exigência de assinatura de Token PlanUS$ 2 por milhão de tokens de entrada e US$ 6 por milhão de saída no Model Studio
Coding Plan ProAssinatura mensal de valor fixoAté 90.000 requisições por mêsOferta de quantidade limitada: esgotando, o plano deixa de ficar disponível
Coding Plan LiteFora de circulaçãoSem novas compras desde 20/03/2026Sem renovações e upgrades desde 13/04/2026

O Qwen3.8-Max foi apresentado em 02/08/2026 e entrou na API pay-as-you-go em 03/08/2026, como modelo de topo

O Coding Plan é a alternativa de valor fixo ao pagamento por uso, com acesso a modelos dentro de ferramentas de codificação

E quanto custa o Coding Plan por mês? A documentação oficial remete ao carrinho de compra e não exibe o valor, então não tem número aqui

Acho zoado botar preço por achismo, e tem blog citando cifras que a Alibaba não publica

Onde ficam as barreiras de uso na prática

Tem gente que trava sem nem chegar perto do fim do dinheiro, porque o limite que morde primeiro é outro

Limite duplo de taxa. As chamadas de API do Model Studio têm limite de requisições por minuto (RPM) e de tokens por minuto (TPM)

O erro Requests rate limit exceeded indica que você bateu no RPM

Allocated quota exceeded indica TPM

Saber ler esses dois é meio caminho pra corrigir: um pede espaçar as chamadas, o outro pede mandar menos texto por minuto

Cota compartilhada. A cota gratuita é dividida entre a conta Alibaba Cloud e seus usuários RAM

O exemplo da própria documentação deixa claro: cota de 1.000.000 de tokens em qwen-max, a conta usa 100.000, um usuário RAM usa 200.000, sobram 700.000

Ou seja, não é 1 milhão por pessoa do time, é 1 milhão pro conjunto

Freio de mão contra susto na fatura. Existe o recurso Free quota only, habilitado na página de detalhes do modelo

Ele interrompe o serviço quando a cota acaba, em vez de deixar escorrer pro pago

Tome cuidado com o escopo: vale só para modelos da região de Singapura e dentro do período de validade da cota

O custo real do Qwen em uso pesado: o que vi comparando com o GLM

Quando o caminho é pago por uso, o preço de tabela conta menos do que parece

O que pesa mesmo é quanto o modelo consome pra terminar a tarefa

No vídeo eu montei 4 projetos, cada um a partir de um único prompt, e coloquei Qwen e GLM pra tocar exatamente os mesmos projetos

Rodei os dois dentro do Claude Code pagando por uso, acompanhando o custo acumulado no painel de gasto a cada rodada (se você usa a ferramenta por assinatura, os planos do Claude Code seguem outra lógica de cobrança)

Na primeira rodada o Qwen gastou praticamente três vezes menos que o GLM

Na rodada seguinte o GLM custou pelo menos o dobro do Qwen

Um dos projetos o GLM entregou em 15 minutos na minha máquina, e mesmo com número de requisições e tokens parecidos, o custo final dos dois ficou bem distante

O Qwen chegou a fazer mais requisições em uma das rodadas e ainda assim saiu mais barato… minha hipótese é que ele aproveita melhor o fluxo do Claude Code

Nem tudo foi lindo, se liga: o Qwen subiu um projeto numa porta errada e eu precisei pedir pra reiniciar em outra, enquanto o concorrente achou porta livre sozinho

Abri cada entrega no navegador e testei o comportamento na prática, incluindo um projeto de caminho mais curto em que desenhei obstáculos na mão

Esperava que o GLM ganhasse e me surpreendi: pagar mais caro num modelo não garante entrega melhor, e benchmark não substitui teste próprio

Deixo claro o recorte: ali eu medi custo por tarefa em uso via API, não plano gratuito nem limite de assinatura

Ah, e uma coisa que ficou óbvia no processo: escrever prompt melhor economiza token, e token economizado é conta menor no fim do mês

Pra começar do zero nesse papo de custo do Qwen, esse vídeo do canal mostra os 4 projetos rodando lado a lado e o painel de gasto de cada rodada:

Vale usar o Qwen de graça? O veredito

Depende de quem você é nessa história, então vou por perfil:

Você só quer conversar, testar modelos e resolver coisa do dia a dia? O Qwen Studio te atende sem pagar nada e sem assinatura, ponto

É o cenário em que a resposta pra "Qwen é gratuito" é um sim seco

Você quer automatizar, plugar em script, rodar agente? Conte com custo desde cedo

O caminho gratuito por OAuth foi encerrado, e o que sobra é a cota inicial da conta nova (1.000.000 de tokens por modelo elegível, 90 dias, região de Singapura) e depois pay-as-you-go ou Coding Plan

Você tem infraestrutura e quer independência? Os pesos abertos do Qwen3 estão sob Apache 2.0 em Hugging Face, ModelScope e Kaggle

Aí o custo muda de natureza: vira máquina, energia e manutenção, não fatura de API

O que eu não faço é prometer o que ninguém documentou: teto de mensagens no chat, valor mensal do Coding Plan e disponibilidade atual do Pro ficam fora, porque a fonte oficial não mostra 🙂

Conclusão

Resumindo a novela: o Qwen é gratuito no chat, cobrado na API (com uma cota inicial pra conta nova) e livre nos pesos abertos

O próximo passo é escolher a porta ANTES de investir tempo: chat pra explorar, API com cota inicial pra prototipar, pesos abertos pra rodar por conta própria

Se a escolha for API, faça o dever de casa antes de montar automação: confira RPM e TPM, lembre que a cota é compartilhada com os usuários RAM e olhe a validade dos 90 dias

E se você for pagar por uso, compare gasto por tarefa, não só preço por milhão de token… foi exatamente aí que o resultado do meu teste me pegou de surpresa

Até o próximo post! =)

Perguntas frequentes

Dá pra usar o Qwen OAuth de graça em 2026?

Não. O nível gratuito de API por Qwen OAuth foi encerrado em 15/04/2026, sem restauração posterior nem substituto anunciado. Antes do fechamento total, a cota já tinha caído de 1.000 para 100 requisições por dia, e hoje ele consta como provedor descontinuado na documentação do Qwen Code. O que acabou foi esse caminho por OAuth: contas novas do Model Studio seguem recebendo cota gratuita ao ativar o serviço.

O Qwen Code funciona sem pagar nada?

Instalar o Qwen Code não custa nada: é um agente open source sob Apache 2.0, instalado com npm install -g @qwen-code/qwen-code@latest. Mas a ferramenta em si é gratuita, o consumo de modelo não, já que a autenticação gratuita via Qwen OAuth saiu de cena.

Quanto custa usar o Qwen3.8-Max pela API?

O Qwen3.8-Max custa US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída no Model Studio. Ele foi apresentado em 02/08/2026 e entrou na API pay-as-you-go em 03/08/2026, sem exigir assinatura de Token Plan.

Qual a diferença entre o Coding Plan e pagar por uso no Qwen?

O Coding Plan é uma assinatura mensal de valor fixo, alternativa ao pagamento por token. O Coding Plan Pro tem teto de até 90.000 requisições por mês e é oferta de quantidade limitada, enquanto o Coding Plan Lite já saiu de circulação: parou de aceitar novas compras em 20/03/2026 e parou renovações e upgrades em 13/04/2026.

Rodar os modelos Qwen3 localmente é gratuito?

Os pesos abertos do Qwen3 são licenciados em Apache 2.0 e distribuídos em Hugging Face, ModelScope e Kaggle, então baixar e rodar não tem custo de licença. O gasto que sobra é de infraestrutura, ou seja, o hardware necessário pra rodar o modelo na tua máquina.

Toda conta nova do Qwen no Model Studio ganha cota gratuita?

Sim, contas novas do Alibaba Cloud Model Studio recebem 1.000.000 de tokens por modelo elegível ao ativar o serviço, válidos por 90 dias. Essa cota vale só na região de Singapura, cobre apenas inferência em tempo real e é compartilhada entre a conta e os usuários RAM vinculados a ela.




Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted
Inline Feedbacks
View all comments

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares