Como estender uma cena no Gemini Omni 1.1 Flash até 40 segundos

O Gemini Omni 1.1 Flash estende cena em incrementos de 10 segundos, até um total de 40 segundos. Ao estender, o modelo usa os últimos 10 segundos do vídeo original como contexto, o que segura movimento, personagens e áudio entre os blocos. A extensão é acionada por prompt em linguagem natural, do tipo ‘Extend this video’ ou ‘Continue the scene’. Dá pra estender vídeo gerado pelo próprio modelo ou arquivo enviado pela Files API, com a extensão rodando pela Interactions API. O identificador é gemini-omni-1.1-flash e a cobrança é por segundo de vídeo gerado
Fala aí, beleza? Vídeo por IA sempre teve o mesmo problema chato: o plano acaba antes da ideia acabar
Aí você gera de novo, muda o prompt, e o personagem volta com outro rosto, a câmera muda de humor, a trilha corta seco
O Google anunciou em 27 de agosto de 2026, no blog oficial, o Gemini Omni 1.1 Flash, o modelo multimodal de geração e edição de vídeo com novos controles criativos pra dev
E o controle que interessa aqui é a extensão de cena: você estende de 10 em 10 segundos, até um total de 40 segundos, e o modelo olha os últimos 10 segundos pra continuar a história em vez de começar outra
Bora ver como fazer isso na prática?
Formação Claude Code
Domine Claude Code do absoluto zero até o avançado
- 114 aulas
- 4 projetos
- 9h 18min
O que você precisa antes de estender a cena
Primeiro, onde a coisa vive
Pra desenvolvedor, o Omni 1.1 Flash está no Google AI Studio, na Gemini API e na Gemini Enterprise Agent Platform
Pra usuário final, o modelo chega ao Flow globalmente para assinantes Google AI Plus, Pro e Ultra, e a extensão de cena também chega a esses mesmos planos no app Gemini
O identificador do modelo:
Na Gemini API, o modelo é o gemini-omni-1.1-flash, que é a versão GA de geração e edição de vídeo
Se você veio do endpoint de preview, se liga nisso: o gemini-omni-flash-preview será depreciado em 30 de setembro de 2026
Ou seja, migrar não é opcional, é só questão de quando você vai sentir a dor
E o vídeo que já está no meu computador?
Dá pra estender tanto vídeo gerado antes pelo próprio modelo quanto arquivo enviado por você
No caso do arquivo enviado, ele entra pela Files API junto com o prompt de extensão, e a extensão em si roda pela Interactions API, como está na documentação da Gemini API
São duas peças com papéis diferentes: uma leva o arquivo pra dentro, a outra continua a cena
Passo a passo: estendendo um vídeo de 10 em 10 segundos até 40s
- Tenha o vídeo de partida na mão
Ou você já gerou o clipe com o próprio modelo, ou você sobe o seu arquivo pela Files API
O erro comum deste passo: achar que a extensão só funciona em vídeo nascido dentro do modelo
Não é o caso, o arquivo de fora também entra na brincadeira
- Escreva o prompt de extensão em linguagem natural
Nada de fórmula mágica aqui, é frase de gente mesmo
A própria documentação traz exemplos assim:
Extend this video
The scene continues
Continue the scene: the camera pans across the mountains
Repara que o prompt diz pra onde a cena vai, não recapitula o que já passou
O erro comum deste passo: escrever um resumo do filme inteiro esperando que o modelo lembre de tudo
Ele usa os últimos 10 segundos do vídeo original como contexto, então o que aconteceu antes disso não está na mesa
- Rode a extensão pela Interactions API e repita o ciclo
Cada rodada acrescenta um incremento de 10 segundos ao vídeo
E o contexto de toda extensão é sempre o mesmo: os últimos 10 segundos do vídeo original
Então a lógica é simples: estendeu, olhou o resultado, escreveu o próximo prompt de continuação, estendeu de novo
O erro comum deste passo: seguir apontando pro endpoint de preview porque o script antigo ainda funciona hoje
Ele tem data marcada, 30 de setembro de 2026, e você não quer descobrir isso com pipeline quebrado em produção
Se a ideia é automatizar esse ciclo dentro de um agente, vale entender antes como latência e pensamento ajustável mudam o comportamento de um fluxo desses
- Pare ao atingir o total de 40 segundos
O teto do comprimento total é 40 segundos, então são blocos de 10 até fechar a conta
O erro comum deste passo: escrever um roteiro de um minuto e meio e só descobrir o limite no meio da produção
Planeje a história em quatro blocos desde o começo, fica muito mais tranquilo
Por que 10 segundos de contexto mudam a continuidade
Aqui está o pulo do gato
Ao estender, o modelo usa os últimos 10 segundos do vídeo original como contexto pra manter vídeo, movimento, personagens e áudio coerentes
Na geração anterior, com Veo, esse contexto era de 1 segundo
Pensa no que 1 segundo te dá: praticamente só o último frame e um pedacinho de movimento
Com isso, o modelo sabe onde a cena estava, mas não sabe pra onde ela estava indo
Dez segundos é outra história: dá pra ler a direção do movimento de câmera, o jeito que o personagem anda, o clima da trilha
Na prática, isso é menos corte seco entre blocos, menos troca de rosto no meio da história, menos quebra de áudio quando a cena vira
Não é garantia de continuidade perfeita, é uma janela de contexto MUITO maior pro modelo trabalhar
Recursos que combinam com a extensão de cena
A extensão sozinha já resolve, mas ela fica bem mais interessante junto com os outros controles do Omni 1.1 Flash
Referência de vídeo externo: dá pra enviar até 3 segundos de outro vídeo como referência pra carregar personagens e padrões de movimento
É útil justamente quando a história é longa e você quer que o mesmo personagem apareça igual lá no bloco final
First frame e last frame: você define o primeiro e o último frame de um plano e deixa o modelo preencher o movimento entre eles
Isso é interpolação, e serve bem pra órbita de câmera, zoom e loop, aquele tipo de plano que precisa fechar exatamente onde começou
Com extensão em sequência, dá pra amarrar o fim de um bloco no começo do próximo com muito mais intenção
Resolução: o modelo oferece 360p, 720p (padrão), 1080p e 4K
Só que tem um detalhe importante: as saídas em 1080p e 4K são obtidas por upscaling, não por geração nativa nessas resoluções
O padrão continua sendo 720p, então trate 1080p e 4K como acabamento, não como um modelo diferente rodando por baixo
Rascunhe em 360p antes de fechar em 720p
Se você vai estender quatro vezes, você vai gerar vídeo quatro vezes, beleza?
E a cobrança da API é por segundo de vídeo gerado, variando conforme a resolução:
| Resolução | Preço por segundo de vídeo gerado |
|---|---|
| 360p | US$ 0,03 |
| 720p | US$ 0,10 |
| 1080p | US$ 0,15 |
| 4K | US$ 0,30 |
Por isso existe o modo de rascunho em 360p, que é até 60% mais rápido e custa um terço do 720p
A estratégia é bem direta: você monta a história inteira em 360p, bloco por bloco, vê se a continuidade aguenta o tranco, ajusta os prompts de extensão
Só depois que o roteiro visual está de pé você refaz na resolução de entrega
É a mesma cabeça de quem já aprendeu a escolher entre qualidade, custo e latência em vez de ligar tudo no máximo por padrão
E lembra que cada bloco de 10 segundos soma na conta, porque o que é cobrado é segundo gerado, não tentativa bem sucedida
Rascunho errado em 720p dói bem mais que rascunho errado em 360p 😀
Conclusão
O fluxo do Gemini Omni 1.1 Flash pra história mais longa cabe em três números: bloco de 10 segundos por extensão, até 10 segundos de contexto anterior, teto de 40 segundos no total
O prompt é linguagem natural, o arquivo de fora entra pela Files API e a extensão roda pela Interactions API
Próximo passo? Abre o Google AI Studio, faz um rascunho em 360p e estende duas vezes só pra sentir como a continuidade se comporta entre os blocos
E se o seu código ainda aponta pro gemini-omni-flash-preview, troca pro gemini-omni-1.1-flash antes de 30 de setembro de 2026
até o próximo post!
Perguntas frequentes
Quanto custa gerar vídeo no Gemini Omni 1.1 Flash em cada resolução?
O preço é cobrado por segundo de vídeo gerado e varia com a resolução: US$ 0,03 por segundo em 360p, US$ 0,10 em 720p, US$ 0,15 em 1080p e US$ 0,30 em 4K. O 360p é o modo rascunho, mais barato e mais rápido pra testar ideia antes de renderizar na resolução final.
Dá pra estender uma cena além dos 40 segundos?
Pelo que está documentado, o teto é 40 segundos no total, em blocos de 10 segundos por extensão. Vale planejar o roteiro em quatro blocos desde o início pra não esbarrar no limite no meio da produção.
As resoluções 1080p e 4K do Gemini Omni 1.1 Flash são geradas nativamente?
Não. As saídas em 1080p e 4K são obtidas por upscaling em cima da geração, e não nascem nativamente nessas resoluções. O padrão de geração continua sendo 720p.
Pra que serve o modo rascunho em 360p do Gemini Omni 1.1 Flash?
É um modo pensado pra iteração rápida: até 60% mais rápido que o 720p e um terço do custo. Faz sentido usar pra testar prompt e continuidade da cena antes de gastar em resolução final.
Até quando dá pra usar o endpoint gemini-omni-flash-preview?
O gemini-omni-flash-preview será depreciado em 30 de setembro de 2026. Quem ainda aponta pra esse endpoint precisa migrar pro identificador GA, gemini-omni-1.1-flash, antes dessa data.
A extensão de cena do Gemini Omni 1.1 Flash está disponível pra quem assina o Google AI?
Sim, pra assinantes Google AI Plus, Pro e Ultra. O modelo chega ao Flow globalmente pra esses planos, e a extensão de cena também chega ao app Gemini pros mesmos assinantes.
Formações
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Blog | Mais populares
Gemini Pro vale a pena para estudante? O que muda de verdade na rotina de estudo
Gemini Pro estudante: veja o preço atual do Google AI Pro, o que muda na rotina de estudo e se vale migrar do plano gratuito para universitários em 2026.
Gemini e NotebookLM: qual a relação entre as duas ferramentas de IA do Google?
Gemini e NotebookLM viraram uma dupla: em julho/2026 o Google renomeou o NotebookLM para Gemini Notebook. Veja a diferença e quando usar cada um.
Como excluir sua conta do Gemini e o que acontece com seus dados
Como excluir conta Gemini: apague só o histórico ou encerre a Conta Google inteira. Saiba exatamente o que acontece com seus dados antes de decidir.
