Gemini Omni 1.1 Flash: o que muda na geração de vídeo com IA do Google?

O Gemini Omni 1.1 Flash é o modelo multimodal mais recente do Google para geração e edição de vídeo, anunciado como atualização production-ready para desenvolvedores e listado como Preview na documentação do Gemini Enterprise Agent Platform. A novidade é a suíte de controles criativos: extensão de cena com até 10 segundos de contexto anterior (antes era 1 segundo), incrementos de 10s até 40s acumulados, first e last frame, até 3 segundos de vídeo de referência e modo rascunho em 360p. O preço na Gemini API vai de US$ 0,03/s em 360p a US$ 0,30/s em 4K, com 720p em US$ 0,10/s
O Google mexeu de novo no seu modelo de vídeo generativo, e dessa vez o alvo é bem claro: quem constrói em cima da API
Fala aí, beleza? O Gemini Omni 1.1 Flash foi anunciado como o modelo multimodal mais recente do Google para geração e edição de vídeo, e o que veio junto não é só "mais qualidade": é uma suíte nova de controles criativos pensada pra desenvolvedor
Este post é o mapa de entrada: o que ele é, onde ele se encaixa e o que ele entrega de fato pra quem monta pipeline de vídeo
O que é o Gemini Omni 1.1 Flash e de onde ele vem
O anúncio oficial saiu no blog do Google, posicionando o modelo como atualização production-ready para desenvolvedores
Não é um produto do zero
Já existia uma versão anterior do Omni Flash, e a 1.1 é a iteração em cima dela, com os controles criativos como o grande diferencial da vez
Formação Claude Code
Domine Claude Code do absoluto zero até o avançado
- 114 aulas
- 4 projetos
- 9h 18min
Um detalhe importante de estágio: na documentação do Gemini Enterprise Agent Platform, o modelo aparece como Gemini Omni 1.1 Flash Preview
Ou seja, dá pra construir, mas você constrói sabendo que ainda é Preview naquele caminho
(guarda essa palavra "Preview", porque mais pra frente ela reaparece com outro sentido, e aí eu separo os dois pra não dar nó)
É o mesmo tipo de leitura que a gente já fazia com as novidades do Gemini 3.7 Flash: entender o que mudou em relação à geração anterior antes de sair trocando o modelo no seu código 🙂
O que muda na prática para quem gera vídeo com IA
Aqui mora o post inteiro
Cada controle novo resolve uma dor específica de quem tenta fazer vídeo generativo virar produto, e não demo bonita
Extensão de cena: até 10 segundos de contexto, e não mais 1
Esse é o item mais pesado da lista
A extensão de cena agora analisa até 10 segundos do vídeo já gerado como contexto, em vez de olhar apenas o último segundo, como faziam os modelos anteriores
Por que isso importa? Porque contexto curto é a raiz do vídeo que "perde o fio": o personagem muda de roupa, a luz vira outra, o movimento quebra na emenda
Com mais contexto pra ler, a continuação tem mais material pra manter coerência
As cenas podem ser estendidas em incrementos de até 10 segundos, chegando a 40 segundos acumulados
E atenção nesse ponto, porque é onde muita gente vai se confundir: os 40 segundos são duração cumulativa, resultado de extensões sucessivas
Cada saída individual fica entre 3 e 10 segundos, ou seja, o incremento é um teto, não um valor fixo
Não existe aqui o botão de gerar 40 segundos de uma vez
First frame e last frame: você define o começo e o fim do plano
O desenvolvedor pode definir o primeiro e o último frame de um plano
Com isso dá pra criar transições e movimentos de câmera entre keyframes, em vez de descrever o movimento em texto e torcer pro modelo entender
Se você já dirigiu qualquer coisa em vídeo, é a diferença entre pedir "faz uma câmera subindo" e marcar onde a câmera começa e onde ela termina
Controle de verdade, e não sorte no prompt
Vídeo de referência: até 3 segundos pra segurar o personagem
Dá pra enviar até 3 segundos de vídeo externo como referência visual
O objetivo declarado é manter personagem, movimento e contexto entre cenas
Esse é o tipo de recurso que separa "clipe isolado" de "sequência": sem referência, cada plano tende a ser um universo novo
Modo rascunho em 360p: itera barato antes de gastar caro
O modo rascunho em 360p roda até 60% mais rápido e custa um terço do preço em comparação com o 720p
A lógica é a mesma do storyboard: você não renderiza em alta pra descobrir que o enquadramento tá errado
Testa o prompt no feio, aprova a ideia, depois sobe a resolução
Resolução: 720p é o padrão, 1080p e 4K são upscale
Esse ponto merece leitura fria
A resolução padrão da API é 720p, e 1080p e 4K são entregues como upscale, não como geração nativa naquelas resoluções
Tome cuidado com a expectativa aqui: pagar mais por 4K não é o mesmo que o modelo ter gerado 4K do zero
Muda o que você promete pro cliente e muda como você calcula custo por entrega
Preço do Gemini Omni 1.1 Flash por resolução
Na Gemini API a cobrança é por segundo de vídeo de saída, variando conforme a resolução
| Resolução | Preço por segundo de vídeo de saída |
|---|---|
| 360p | US$ 0,03 |
| 720p | US$ 0,10 |
| 1080p | US$ 0,15 |
| 4K | US$ 0,30 |
Dois detalhes mudam a leitura dessa tabela
O primeiro: o preço do 720p permanece inalterado em relação à versão anterior do Omni Flash, seguindo em US$ 0,10 por segundo
O segundo: como 1080p e 4K são upscale, a conta de custo x qualidade não é linear, você está pagando pelo aumento de resolução aplicado em cima de uma geração que não nasceu naquele tamanho
E é por isso que o rascunho em 360p vira estratégia, e não gambiarra
A US$ 0,03 por segundo, ele custa um terço do 720p
Iterar dez versões no feio sai mais barato que errar três no caro 😀
Como acessar o modelo e o que muda no endpoint
São dois caminhos separados
Desenvolvedores acessam pelo Google AI Studio (Gemini API)
Empresas acessam pelo Gemini Enterprise Agent Platform, via Agent Platform API, que é onde o modelo aparece como Preview
Quem já pensa nesse recorte corporativo provavelmente lembra da discussão sobre modelos Flash em fluxos corporativos, e a divisão aqui segue a mesma lógica de plataforma
O identificador do modelo na Gemini API é gemini-omni-1.1-flash
E agora o detalhe que quebra código: a geração de vídeo com o Omni é feita pela Interactions API, e não por um endpoint separado de generateVideos
A chamada vai pra:
POST https://generativelanguage.googleapis.com/v1beta/interactions
Com o modelo e o formato de resposta declarados no corpo:
{
"model": "gemini-omni-1.1-flash",
"response_format": { "type": "video" }
}
Item de migração pra colocar no calendário agora: o endpoint anterior gemini-omni-flash-preview será descontinuado em 30 de setembro de 2026
Se você tem algo em produção apontando pra ele, essa data é sua
E aqui entra a confusão que eu avisei lá em cima, porque a palavra "preview" aparece em dois lugares com sentidos diferentes
Um é estágio de plataforma: o modelo listado como Gemini Omni 1.1 Flash Preview na documentação do Gemini Enterprise Agent Platform, ou seja, o caminho corporativo do modelo novo
O outro é nome de endpoint: gemini-omni-flash-preview é o identificador da versão anterior à 1.1, que já carregava "preview" no próprio nome, e é justamente esse que vai ser descontinuado
São coisas separadas: uma fala do estágio do modelo atual no caminho empresarial, a outra é o endereço velho que sai de cena
O Google publicou documentação, cookbooks e guias de prompting pra integrar extensão de cena, referências de vídeo e upscaling em aplicações, tudo na documentação oficial do Omni
Para quem o Gemini Omni 1.1 Flash faz sentido
Cada controle novo casa com um cenário bem concreto de quem constrói:
- Quem queima orçamento testando prompt: itera enquadramento e descrição em 360p, a um terço do custo do 720p, e só sobe a resolução no que já foi aprovado
- Quem precisa de sequência, não de clipe solto: encadeia cenas com extensões sucessivas de até 10 segundos cada, somando até 40 segundos acumulados
- Quem trabalha com personagem recorrente: usa até 3 segundos de vídeo de referência pra manter personagem, movimento e contexto entre planos
- Quem pensa em direção de câmera: define first frame e last frame e planeja a transição entre keyframes, em vez de descrever movimento no texto e cruzar os dedos
E tem o caminho de quem só quer usar, sem escrever uma linha de código
Aqui vale um aviso de nome: nesse trecho o anúncio do Google fala em Gemini Omni Flash, sem o 1.1, e o que ele descreve é o rollout global para assinantes Google AI Plus, Pro e Ultra, no app Gemini e no Google Flow
Ou seja, o "1.1" é o nome que aparece no caminho de desenvolvedor (model ID gemini-omni-1.1-flash e listagem no Gemini Enterprise Agent Platform), enquanto o app e o Flow são citados com o nome curto
Dá pra separar bem os dois públicos: quem quer usar vai pelo app, quem quer integrar vai pela API
Vale entrar agora no Gemini Omni 1.1 Flash?
Depende do que você chama de "entrar"
Pra experimentar e prototipar, sim: o modelo foi anunciado como production-ready para desenvolvedores, está no Google AI Studio, tem documentação, cookbooks e guias de prompting publicados
Pra apostar a operação inteira, vale o pé atrás de sempre: no Gemini Enterprise Agent Platform ele ainda aparece como Preview
E tem duas coisas que exigem atenção antes de prometer entrega pra alguém
Upscale não é geração nativa: 1080p e 4K saem de uma base 720p
E o gemini-omni-flash-preview some em 30 de setembro de 2026, então migração não é assunto pra depois
O caminho prático pra começar:
- Abra a documentação oficial em
ai.google.dev/gemini-api/docs/omnie confira os parâmetros atuais dos controles, porque no caminho corporativo o modelo está em Preview e detalhe de API muda - Rode um teste em 360p pelo Google AI Studio, usando
gemini-omni-1.1-flashpela Interactions API. O erro comum aqui é tentar chamar um endpoint degenerateVideosque não é o caminho do Omni - Valide a continuidade antes de escalar: estenda a cena uma vez, veja se o personagem e a luz seguem coerentes, e só então empilhe extensões até os 40 segundos acumulados
- Só depois de aprovar prompt e enquadramento, suba a resolução, sabendo que 720p custa US$ 0,10 por segundo e o rascunho em 360p custa um terço disso
Testa no barato, valida a ideia, depois paga pelo bonito
É um jeito bem menos doloroso de descobrir que o prompt tava errado, né? haha
até o próximo post!
Perguntas frequentes
O Gemini Omni 1.1 Flash já está liberado para produção ou ainda é experimental?
Depende do caminho de acesso. Pelo Google AI Studio e pela Gemini API, o Google anunciou o modelo como atualização production-ready para desenvolvedores. Já na documentação do Gemini Enterprise Agent Platform ele aparece como Gemini Omni 1.1 Flash Preview, ou seja, esse acesso corporativo ainda está em estágio de Preview.
Dá para gerar um vídeo de 40 segundos direto em uma única chamada?
Não. Os 40 segundos são duração acumulada, resultado de extensões sucessivas em incrementos de até 10 segundos. Cada saída individual do modelo fica entre 3 e 10 segundos, então o incremento é um teto e não um valor fixo, e não existe um modo de gerar os 40 segundos de uma vez só.
Qual identificador de modelo eu uso para chamar o Gemini Omni 1.1 Flash na Gemini API?
O identificador é gemini-omni-1.1-flash. Ele é usado na Interactions API, com uma chamada POST para o endpoint v1beta/interactions informando esse model e um response_format do tipo video.
O que acontece com quem ainda usa o endpoint gemini-omni-flash-preview?
Esse endpoint anterior será descontinuado em 30 de setembro de 2026. Quem tem integração em produção apontando pra ele precisa migrar para o fluxo atual via Interactions API antes dessa data. Vale notar que o preview no nome desse endpoint é só parte do identificador antigo, anterior à 1.1, e não tem relação com o estágio de Preview do modelo novo no Gemini Enterprise Agent Platform.
Vale a pena pedir a saída direto em 4K no Gemini Omni 1.1 Flash?
Vale avaliar com cuidado, porque 1080p e 4K não são gerados nativamente naquelas resoluções, eles são entregues como upscale em cima da geração padrão em 720p. O preço acompanha essa diferença: US$ 0,15 por segundo em 1080p e US$ 0,30 por segundo em 4K, contra US$ 0,10 por segundo no 720p.
Quem não é desenvolvedor consegue usar o modelo no app Gemini?
Sim. O anúncio do Google usa o nome curto Gemini Omni Flash nesse trecho e informa rollout global para assinantes do Google AI Plus, Pro e Ultra, direto no app Gemini e no Google Flow. Esse caminho é separado do acesso via Google AI Studio e Gemini API, onde o modelo aparece como gemini-omni-1.1-flash e é voltado a quem constrói aplicações.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares
Gemini Pro vale a pena para estudante? O que muda de verdade na rotina de estudo
Gemini Pro estudante: veja o preço atual do Google AI Pro, o que muda na rotina de estudo e se vale migrar do plano gratuito para universitários em 2026.
Gemini e NotebookLM: qual a relação entre as duas ferramentas de IA do Google?
Gemini e NotebookLM viraram uma dupla: em julho/2026 o Google renomeou o NotebookLM para Gemini Notebook. Veja a diferença e quando usar cada um.
Como excluir sua conta do Gemini e o que acontece com seus dados
Como excluir conta Gemini: apague só o histórico ou encerre a Conta Google inteira. Saiba exatamente o que acontece com seus dados antes de decidir.
