O que é Ox Alpha, o modelo stealth que apareceu na OpenRouter?

Ox Alpha é um modelo de IA anônimo listado na OpenRouter dentro do programa Stealth, ou seja, um provedor terceiro disponibiliza um modelo ainda não lançado sem revelar quem é. Foi adicionado em 20 de agosto de 2026, com identificador stealth/ox-alpha, janela de 1.048.576 tokens de contexto, 131.072 tokens de saída, entrada de texto, imagem e vídeo, saída em texto e suporte a tools, tool_choice e response_format. O preço listado é zero durante o preview e ele também aparece no OpenCode. Quem desenvolveu segue sem revelação oficial
Ox Alpha: o modelo anônimo da OpenRouter que promete coding e ainda não provou
Fala aí, beleza? Se você viu o nome Ox Alpha circulando no timeline e ficou com aquela pulga atrás da orelha de "que raio é isso e de quem é", esse post é pra te dar o básico sem achismo
A gente vai ficar só no que a página oficial diz: o que ele aceita, quanto custa, onde acessar e o que ainda é incógnita
Spoiler: tem MUITA coisa que ninguém sabe ainda, e eu não vou inventar 😀
O que significa um modelo "stealth" na OpenRouter
Antes da ficha técnica, o porquê
A OpenRouter tem um programa chamado Stealth. A ideia é simples: um laboratório coloca um modelo ainda não lançado na plataforma sem revelar o nome, por tempo limitado, e essa janela é definida pelo provedor junto com a OpenRouter
Ou seja, o modelo é jogado no mundo real antes do anúncio oficial, com gente de verdade usando
Se você conhece aquele esquema de beta fechado de software, é a mesma vibe: uso real, identidade escondida
Formação Claude Code
Domine Claude Code do absoluto zero até o avançado
- 114 aulas
- 4 projetos
- 9h 18min
E quem desenvolve o Ox Alpha?
Essa é a parte honesta: não se sabe
A página do modelo na OpenRouter deixa claro que ele é desenvolvido e operado por um provedor terceiro que optou por permanecer anônimo durante o preview. A OpenRouter só roteia o tráfego, ela não desenvolve nem é dona dos pesos
Até hoje não houve revelação oficial de qual empresa está por trás
Tem palpite rolando na comunidade? Tem, aos montes. Mas palpite não é fato, e aqui eu não vou botar nome em ninguém por achismo
Outro detalhe importante: ele não é rastreado pelo Artificial Analysis. Não existe entrada oficial dele lá com intelligence index, coding score ou agentic score
Então qualquer número de benchmark que você ver por aí sobre esse modelo, desconfia e pede a fonte 🙂
A ficha de Ox Alpha: contexto, saída e o que ele aceita
Agora sim, o que dá pra afirmar com a página aberta na frente
O modelo foi adicionado à OpenRouter em 20 de agosto de 2026, e o identificador dele é stealth/ox-alpha
| Item | Detalhe |
|---|---|
| Identificador | stealth/ox-alpha |
| Janela de contexto | 1.048.576 tokens |
| Saída máxima (completion) | 131.072 tokens |
| Entrada | texto, imagem e vídeo |
| Saída | texto |
| Chamada de função | tools e tool_choice |
| Saída estruturada | response_format |
| Adicionado em | 20 de agosto de 2026 |
Esse 1.048.576 é o famoso "1M de contexto" que tu vê nos posts, só que na conta certa
E repara na combinação: entrada multimodal com vídeo, mais tools e JSON estruturado, mais janela gigante. É ficha de modelo feito pra trabalhar, não pra bater papo
O que a descrição oficial diz que ele é:
A própria OpenRouter apresenta o modelo como um modelo de raciocínio voltado a programação eficiente, trabalho agentico prolongado e cargas de produção
Isso é posicionamento do provedor, beleza? É o que ele DIZ ser
Sem benchmark verificado publicado, ninguém consegue afirmar se ele entrega isso. É a diferença entre a ficha e a prova, e por enquanto a gente só tem a ficha
Onde acessar Ox Alpha e quanto custa
Dois caminhos confirmados
O primeiro é a própria OpenRouter, pelo identificador stealth/ox-alpha, que funciona tanto pela API quanto pela página do modelo
O segundo é o OpenCode, que também dá acesso ao modelo
O preço:
Zero
O preço listado na OpenRouter é US$ 0,00 por milhão de tokens de entrada e US$ 0,00 por milhão de tokens de saída durante o preview. Não tem cobrança por prompt nem por completion
O OpenCode anunciou em 20 de agosto de 2026 que o modelo ficaria gratuito pela semana seguinte, citando o 1M de contexto, a multimodalidade e limites de uso generosos, com capacidade declarada de 100 trilhões de tokens por dia
Cem trilhões por dia é um número absurdo de se ler, mas é o que foi declarado no anúncio
Tome cuidado com os limites do tier gratuito:
Modelo de graça não significa requisição infinita
Na OpenRouter, os limites do tier gratuito funcionam assim:
- 50 requisições por dia para contas que nunca compraram crédito
- 1.000 requisições por dia para contas que já compraram ao menos US$ 10 em créditos
- teto de 20 requisições por minuto nos dois casos
Esse é o erro comum de quem sai rodando agente em cima de modelo gratuito: monta um loop agentico que dispara dezenas de chamadas, estoura o limite diário e acha que o modelo caiu
Não caiu, foi a cota 😛
Para que Ox Alpha serve na prática
Aqui eu não vou prometer desempenho, porque não tem benchmark verificado pra sustentar
Mas dá pra ligar a ficha aos usos que ela SUSTENTA, que é bem diferente de chutar resultado:
Leitura de base de código grande. Com 1.048.576 tokens de janela, dá pra jogar um monte de arquivo de uma vez sem ficar picotando em pedacinho e rezando pra ele lembrar do começo
Agente de longa duração. Suporte a tools e tool_choice significa que ele consegue chamar função, e response_format significa que ele devolve JSON no formato que teu código espera. Sem isso, agente vira parsing na mão e dor de cabeça
Entrada multimodal. Ele aceita texto, imagem e vídeo de entrada, então print de tela, diagrama e gravação entram no prompt. A saída é sempre texto, então nada de esperar imagem de volta
Saída longa. Os 131.072 tokens de completion abrem espaço pra resposta comprida sem ele cortar no meio da geração
O que essa ficha NÃO te diz é se ele acerta mais que o modelo que tu já usa. Isso só o teu caso de uso responde
O que pesar antes de mandar seu código para um modelo anônimo
Essa parte é a mais importante do post, então lê com calma
A página do modelo na OpenRouter afirma que os prompts e as respostas são retidos pelo provedor, e que esse provedor não treina com prompts nem com completions
Duas coisas diferentes, se liga: retenção sim, treino não
E os termos do programa Stealth avisam de forma direta que qualquer dado pessoal enviado no input de um modelo stealth é repassado ao provedor stealth
Junta as peças:
- o provedor é anônimo, tu não sabe pra qual empresa teu input está indo
- prompts e respostas ficam retidos do lado dele
- dado pessoal no input vai junto
- o preview roda por tempo limitado, definido pelo provedor junto com a OpenRouter, e quando essa janela fechar o modelo some da lista
Isso não quer dizer "não usa", quer dizer "usa sabendo"
Brincar com projeto pessoal, código de estudo, POC? Massa, vai fundo
Colar código proprietário de cliente, chave de API, dado de usuário ou qualquer coisa sob contrato de confidencialidade? Aí a conta muda, e a conta é tua
Já me ferrei uma vez colando coisa em ferramenta nova sem ler os termos, e é aquele frio na barriga que ninguém precisa passar 😅
Pra situar na corrida dos modelos:
Esse modelo não apareceu no vácuo, ele caiu num momento em que lançamento de modelo grande virou coisa de toda semana
Pra começar do zero e entender esse cenário, esse vídeo do canal mostra o lançamento do Kimi K3 e a briga dele com o Opus
Conclusão
Recapitulando o que é FATO sobre o Ox Alpha:
É um modelo stealth listado na OpenRouter desde 20 de agosto de 2026, de um provedor terceiro anônimo, com identificador stealth/ox-alpha, janela de 1.048.576 tokens, saída de até 131.072 tokens, entrada de texto, imagem e vídeo, saída em texto, suporte a tools, tool_choice e response_format, e preço listado zero durante o preview. Também dá pra acessar pelo OpenCode
E o que ainda é incógnita: quem treinou, como ele se sai medido em benchmark verificado e até quando o preview fica de pé
O próximo passo é simples: abre a página stealth/ox-alpha na OpenRouter ou testa pelo OpenCode enquanto o preview durar, mandando só dado que tu não se importa de ver retido
E quando a autoria for revelada, aí a gente volta nesse assunto com número na mão…
até o próximo post!
Perguntas frequentes
Ox Alpha vai continuar gratuito depois da semana de graça anunciada pelo OpenCode?
O OpenCode anunciou que o modelo ficaria gratuito pela semana seguinte ao anúncio de 20 de agosto de 2026. Na OpenRouter, o preço listado hoje é US$ 0,00 por milhão de tokens de entrada e de saída durante o preview, mas não há confirmação oficial sobre o que acontece quando esse período de preview terminar.
Dá pra usar Ox Alpha em outra ferramenta além da OpenRouter?
Sim, o modelo também está disponível pelo OpenCode, além da OpenRouter. Na OpenRouter o acesso é pelo identificador stealth/ox-alpha, tanto via API quanto pela página do modelo.
Qual o limite de requisições grátis de Ox Alpha na OpenRouter?
Contas sem crédito comprado têm direito a 50 requisições por dia, e contas que já compraram ao menos US$ 10 em créditos sobem para 1.000 requisições por dia. Nos dois casos o teto é de 20 requisições por minuto, então um agente disparando chamadas em loop estoura a cota rápido.
Existe algum benchmark oficial provando que Ox Alpha é bom em programação?
Não. O modelo não é rastreado pelo Artificial Analysis e não tem entrada oficial de intelligence index, coding score ou agentic score nesse tracker. O que existe é a descrição da própria OpenRouter, que apresenta ele como voltado a programação eficiente e trabalho agentico, mas isso é posicionamento do provedor, não prova de benchmark.
É seguro mandar código proprietário para um modelo anônimo como esse?
A página do modelo afirma que os prompts e as respostas são retidos pelo provedor, mas que ele não treina com prompts nem com completions. Ainda assim, os termos do programa Stealth avisam que qualquer dado pessoal enviado no input é repassado ao provedor anônimo, então vale pesar isso antes de usar o modelo com informação sensível.
Quando vamos saber quem é a empresa por trás do Ox Alpha?
Até hoje não houve revelação oficial de qual empresa desenvolve esse modelo. A página da OpenRouter só confirma que é um provedor terceiro que optou por ficar anônimo durante o preview, sem prazo público para o destravamento do nome.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares
Kimi K3, GLM ou DeepSeek: qual modelo barato aguenta refatorar código de verdade?
Kimi K3 vs GLM vs DeepSeek num teste real de refatoração: veja custo por token, erros e retrabalho para escolher o modelo barato certo no Claude Code.
O que é o Hy4 preview, o modelo de 770B da Tencent?
O Hy4 preview é o novo modelo da Tencent: MoE de 770B parâmetros (49B ativos), 1M de tokens de contexto e pesos abertos sob Apache 2.0. Veja o que ele faz.
Como dividir uma tarefa entre dois modelos de IA: o rápido tria e o forte decide
Roteamento de modelos: o Haiku 4.5 tria barato e só escala pro Opus 5 quando exige julgamento real. Veja o critério de corte e como montar o fluxo.
