Hy4 preview para desenvolvimento de jogos: dá pra ir do prompt ao protótipo jogável?

O Hy4 preview é o modelo de nova geração da equipe Hunyuan, lançado e aberto pela Tencent em 28 de agosto de 2026: 770 bilhões de parâmetros totais, 49 bilhões ativados por token, janela de 1.048.576 tokens e licença Apache 2.0. No anúncio oficial, a Tencent afirma que o modelo gera um protótipo jogável a partir de um único pedido em linguagem natural e trabalha com engines de jogos. Os casos divulgados (pinguim 3D na Unity/Tuanjie, o minigame Ilha dos Pinguins e a exploração lunar) mostram protótipo com loop fechado, não jogo comercial. Dá pra testar no CodeBuddy, no WorkBuddy ou via API no OpenRouter
Fala aí, beleza? Um pedido em linguagem natural virando protótipo jogável é a frase que a Tencent escolheu pra vender o modelo novo dela, e isso mexe direto com quem faz jogos
Em 28 de agosto de 2026 a Tencent lançou e abriu o código do Hy4 preview, o modelo de nova geração da equipe Hunyuan
E desenvolvimento de jogos é um dos casos de uso destacados no anúncio oficial, com casos de engine divulgados junto
O recorte deste post é bem específico: separar o que a fabricante afirma do que está de fato demonstrado, pra você decidir se isso entra (ou não) no seu fluxo de protótipo
O que é o Hy4 preview e por que ele apareceu agora
Ele é um modelo de linguagem de nova geração da equipe Hunyuan, e veio já com os pesos abertos no dia do lançamento
Os números da model card: 770 bilhões de parâmetros totais, com 49 bilhões ativados por token
Isso é arquitetura Mixture-of-Experts, ou MoE
E o que muda com MoE? Em vez de acender o modelo inteiro a cada token, só uma fatia de especialistas é ativada
Formação Claude Code
Domine Claude Code do absoluto zero até o avançado
- 120 aulas
- 4 projetos
- 9h 45min
Se você já mexeu com sistema de plugins, a analogia serve: o núcleo é enorme, mas só o módulo necessário roda na chamada
A estrutura interna é declarada com detalhe: 78 camadas, sendo a primeira uma FFN densa padrão e as outras 77 camadas MoE, cada uma com 256 experts roteados e 1 expert compartilhado
A janela de contexto é o outro número que salta: 1.048.576 tokens de contexto e até 64.000 tokens de saída, conforme a listagem do OpenRouter (a comunicação oficial descreve como contexto acima de 1M)
Os pesos estão no Hugging Face em tencent/Hy4-preview, com uma variante quantizada em tencent/Hy4-preview-FP8
O código fica em github.com/Tencent-Hunyuan/Hy4-preview
E a licença dos pesos é Apache License 2.0, o que já responde meia dúzia de perguntas jurídicas antes delas nascerem 🙂
De benchmark, o material de lançamento traz 85,4 no Terminal-Bench 2.1
Tome cuidado aqui: esse é número autodeclarado, saiu junto com o anúncio
Não é avaliação independente, então trate como sinal de intenção, não como veredito
Os três jogos divulgados no lançamento
A afirmação oficial é forte: o modelo gera um protótipo jogável a partir de um único pedido em linguagem natural, trabalha com engines de jogos e permite continuar refinando projetos complexos em interações de múltiplos turnos
Promessa é promessa
O que dá pra examinar são os casos divulgados junto com o lançamento
O demo de aventura 3D em terceira pessoa (Unity/Tuanjie):
Criação conversacional, do zero, de um demo de aventura em terceira pessoa com um pinguim de protagonista
O escopo divulgado inclui arte de ambiente da cena, movimentação e combate, rastreamento de missão e um fluxo de três cenas: menu principal, carregamento e fase
Repara no detalhe mais interessante: o fluxo de três cenas
Menu, loading e gameplay é o esqueleto que separa "cena rodando na engine" de "coisa que abre e fecha sozinha"
O minigame Ilha dos Pinguins (企鹅岛):
Aqui o loop é 3D e cronometrado: o jogador controla um pinguim sobre gelo que racha e se afasta durante 90 segundos
Coleta peixes, desvia de focas
E tem fluxos completos de início, derrota, vitória e reinício
Ou seja: estado de jogo fechado, com condição de vitória e de derrota, não só um personagem andando na tela
O jogo de exploração lunar:
Esse é o mais "sistêmico" dos três
Rover lunar com missões de transporte de carga para três bases diferentes, física de colisão e três câmeras: direção em primeira pessoa, seguimento em terceira pessoa e observação distante
Com progressão completa, do início até a conclusão da missão
O que os três casos dizem, juntos:
O padrão é o mesmo nos três: protótipo com loop fechado
Personagem, objetivo, obstáculo, vitória, derrota, reinício
Isso é MUITO diferente de jogo comercial, e é justamente por isso que o sinal é útil
Protótipo com loop fechado é exatamente o artefato que trava a semana de quem quer validar uma ideia de gameplay
O que muda no fluxo de quem faz jogos
A comunicação de lançamento em chinês cita Unreal 5 e Unity como engines que o modelo usa
E lista as áreas cobertas: construção de cena, lógica de gameplay, blend tree de animação de personagem e sistema de efeitos sonoros
Blend tree e efeito sonoro na mesma lista é o que chama atenção, porque são as duas pontas do protótipo: a que dá vida ao personagem e a que dá feedback ao jogador
E que engine é essa, Tuanjie? Boa pergunta, porque ela aparece nas demos e confunde
A Tuanjie (团结引擎) é uma engine 3D em tempo real desenvolvida pela joint venture Unity China e publicada pela Yousandi Technology (Shanghai), a empresa que responde pela publicação
Ela corresponde à versão chinesa da Unity e é construída sobre o Unity 2022 LTS
Isso importa na hora de ler as demos: quando você vê "Unity/Tuanjie", o alicerce é Unity mesmo, em uma distribuição local
A versão exata usada nos demos não foi divulgada, então não dá pra afirmar em qual build aquilo roda
E tem um ponto que precisa ficar cristalino antes de alguém sair procurando: não há página de produto confirmando plugin ou integração oficial do modelo dentro do editor Unity, Tuanjie ou Unreal
A leitura honesta é essa: a promessa mora em prototipagem e iteração em múltiplos turnos
É o "faz o esqueleto e depois eu vou lapidando na conversa", não o "substitui a produção do estúdio"
Onde testar o Hy4 preview hoje
Os caminhos disponíveis, sem inventar configuração que não está documentada:
- Produtos da própria Tencent. O modelo está disponível no WorkBuddy e no CodeBuddy (versões chinesa e internacional), no Yuanbao e no ima. O erro comum aqui é misturar produtos: instrução de um não vale pro outro, e cada um tem interface própria
- Período gratuito de duas semanas. No lançamento, o uso é gratuito por duas semanas no WorkBuddy e no CodeBuddy, contando a partir do lançamento. A pegadinha: a data exata de término e se a regra vale igual pra versão internacional não foram detalhadas, então confirme na fonte antes de planejar sprint em cima disso
- CodeBuddy no formato que combina com você. O CodeBuddy, produto da Tencent Cloud, existe como plugin para editores (VS Code e IDEs JetBrains), como IDE próprio e como ferramenta de linha de comando (CodeBuddy Code / CLI). Escolha pelo seu ambiente atual, não pelo hype
- API. Dá pra consumir via Tencent Cloud TokenHub e via OpenRouter. É o caminho mais direto se você quer plugar o modelo em um script seu de geração de cena ou de asset
- Rodar por conta própria. Os pesos são abertos, sob Apache 2.0, e existe a variante FP8 pra quem vai quantizar. O erro comum deste passo é subestimar o hardware: são 770 bilhões de parâmetros totais, e não há recomendação oficial de servidor de inferência nem de requisitos de máquina publicada junto ao lançamento. Sem PC da Nasa, nem tente pelo caminho local 😀
Custo, contexto e limites: os números da API
Os dados da listagem no OpenRouter:
| Item | Valor |
|---|---|
| Entrada | US$ 0,834 por milhão de tokens |
| Saída | US$ 2,501 por milhão de tokens |
| Leitura de cache | US$ 0,042 por milhão de tokens |
| Janela de contexto | 1.048.576 tokens |
| Saída máxima | 64.000 tokens |
| Function calling | aceita tools e tool_choice |
| Saída estruturada | JSON schema em response_format |
| Provedores | um único provedor, sem roteamento |
O suporte a function calling e a saída estruturada via JSON schema é o que interessa pra pipeline de jogo
É com isso que você pede um layout de fase e recebe JSON que o seu importador consegue engolir, em vez de texto pra ficar parseando na mão
O preço de leitura de cache é a linha que muda a conta em iteração longa, já que refinar protótipo em múltiplos turnos significa reenviar contexto o tempo inteiro
E o ponto de atenção real: provedor único, sem roteamento entre alternativas
Se esse provedor cair ou ficar lento, não existe fallback automático
Pra brincar de protótipo, tranquilo
Pra colocar em pipeline que a equipe depende, isso é risco que precisa entrar na planilha
Os valores ficam em dólar aqui de propósito, porque não tenho taxa de câmbio verificada pra converter
Vale colocar o Hy4 preview no seu pipeline de protótipo?
Vou separar em duas pilhas, porque elas não se misturam
O que está comprovado (documentado em fonte primária): o tamanho e a arquitetura do modelo, a janela de 1.048.576 tokens com até 64.000 de saída, a licença Apache 2.0, os pesos no Hugging Face com variante FP8, o código no GitHub, o preço de API no OpenRouter e o suporte a function calling e saída estruturada
O que é afirmação da fabricante: o protótipo jogável a partir de um único pedido, o trabalho com engines de jogos, o refinamento em múltiplos turnos e o 85,4 no Terminal-Bench 2.1
São coisas plausíveis e bem demonstradas nas demos, mas partiram de quem vende o produto
Então o veredito honesto
Se você prototipa rápido e gosta de iterar em conversa, o combo janela gigante + function calling + Apache 2.0 já justifica reservar uma tarde de teste
A licença sozinha resolve o incômodo de "posso usar isso no meu projeto?"
Se você pensa em produção, segure a onda: provedor único no OpenRouter e ausência de avaliação independente até agora pedem cautela
Espere o modelo aparecer em benchmark de terceiro antes de apostar uma feature nele
E seja qual for o caso, compare o resultado com o escopo das demos: protótipo com loop fechado
Se a sua expectativa for maior que isso, a frustração é sua, não do modelo
Deixando explícito: este post não testou o modelo
O que está aqui é leitura da documentação, do anúncio e dos casos divulgados, com os números vindo das fontes
Automação e agentes no fluxo de desenvolvimento
Pra começar do zero com o assunto de prompts virando trabalho automatizado, este vídeo do canal mostra como transformar prompts em automações com scheduled tasks no Antigravity 2.0
É o tipo de raciocínio que você vai reaproveitar na hora de encaixar qualquer modelo novo em pipeline
Conclusão
Recapitulando: o Hy4 preview chegou em 28 de agosto de 2026 com 770 bilhões de parâmetros totais e 49 bilhões ativados por token, 1.048.576 tokens de contexto, licença Apache 2.0 e pesos abertos no Hugging Face
E veio com desenvolvimento de jogos na vitrine, com três casos divulgados: o pinguim 3D em terceira pessoa na Unity/Tuanjie, o minigame Ilha dos Pinguins e a exploração lunar com rover
O próximo passo concreto é simples
Aproveita a janela gratuita de duas semanas no CodeBuddy ou no WorkBuddy, ou puxa os pesos no Hugging Face se você tem máquina pra isso
Roda contra o seu próprio projeto de engine, não contra um exemplo genérico
Aí compara o que saiu com o escopo das demos divulgadas: loop fechado, menu, fase, vitória e derrota
Se bateu, você achou uma ferramenta de prototipagem
Se não bateu, você economizou uma decisão ruim, o que também é lucro
até o próximo post!
Perguntas frequentes
O Hy4 preview tem plugin oficial para Unity ou Unreal Engine?
Não há página de produto confirmando plugin ou integração oficial do Hy4 preview dentro do editor Unity, Tuanjie ou Unreal. A comunicação de lançamento cita as duas engines como parte do que o modelo cobre (cena, gameplay, animação, som), mas isso não equivale a um plugin documentado. Por segurança, trate a promessa como prototipagem via conversa, não como instalação dentro do editor.
Quanto custa usar o Hy4 preview pela API?
No OpenRouter, o Hy4 preview sai a US$ 0,834 por milhão de tokens de entrada e US$ 2,501 por milhão de tokens de saída. A leitura de cache custa US$ 0,042 por milhão de tokens. O modelo é servido por um único provedor ali, sem roteamento entre alternativas.
Dá pra usar o Hy4 preview de graça antes de pagar por API?
Sim, o lançamento veio com duas semanas de uso gratuito no WorkBuddy e no CodeBuddy. Depois desse período, o caminho pago passa pela API, seja via Tencent Cloud TokenHub, seja via OpenRouter.
É possível rodar o Hy4 preview localmente, sem depender de API?
Sim, os pesos são abertos sob Apache License 2.0 e estão no Hugging Face em tencent/Hy4-preview, com uma variante quantizada em tencent/Hy4-preview-FP8. O repositório de código fica em github.com/Tencent-Hunyuan/Hy4-preview. Vale lembrar que o modelo tem 770 bilhões de parâmetros totais, então rodar por conta própria exige infraestrutura compatível com esse porte.
O Hy4 preview suporta function calling e resposta em JSON estruturado?
Sim, na listagem do OpenRouter o modelo aceita tools e tool_choice para function calling. Também suporta saídas estruturadas via JSON schema no parâmetro response_format. Isso é relevante pra quem quer plugar o modelo em pipeline automatizado, e não só em chat solto.
O CodeBuddy com Hy4 preview funciona direto no VS Code?
O CodeBuddy existe em três formatos: plugin para editores como VS Code e IDEs JetBrains, IDE próprio, e ferramenta de linha de comando (CodeBuddy Code / CLI). O Hy4 preview roda dentro dessas versões, chinesa e internacional, com o período gratuito de duas semanas valendo no lançamento.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares
Contexto de 1M de tokens no Hy4 preview: o que isso muda na prática?
Hy4 preview é o modelo MoE da Tencent com 1.048.576 tokens de contexto e pesos abertos no Hugging Face. Veja preço de API e o que muda na prática.
Hy4 preview em front-end e 3D: o que o modelo aberto da Tencent promete entregar?
Hy4 preview é o modelo aberto da Tencent com MoE, contexto de 1M tokens e foco em front-end e cenas 3D. Veja o que ele promete entregar.
Hy4 preview vale a pena para quem programa? Veredito honesto por perfil de dev
Hy4 preview vale a pena pra programar? Veja specs, preço da API, contexto de 1 milhão de tokens e o perfil de dev que mais aproveita esse modelo.
