Como estender uma cena no Gemini Omni 1.1 Flash até 40 segundos

extensão de cena até 40 segundos no Gemini Omni 1.1 Flash
Resposta rápida

O Gemini Omni 1.1 Flash estende cena em incrementos de 10 segundos, até um total de 40 segundos. Ao estender, o modelo usa os últimos 10 segundos do vídeo original como contexto, o que segura movimento, personagens e áudio entre os blocos. A extensão é acionada por prompt em linguagem natural, do tipo ‘Extend this video’ ou ‘Continue the scene’. Dá pra estender vídeo gerado pelo próprio modelo ou arquivo enviado pela Files API, com a extensão rodando pela Interactions API. O identificador é gemini-omni-1.1-flash e a cobrança é por segundo de vídeo gerado

Fala aí, beleza? Vídeo por IA sempre teve o mesmo problema chato: o plano acaba antes da ideia acabar

Aí você gera de novo, muda o prompt, e o personagem volta com outro rosto, a câmera muda de humor, a trilha corta seco

O Google anunciou em 27 de agosto de 2026, no blog oficial, o Gemini Omni 1.1 Flash, o modelo multimodal de geração e edição de vídeo com novos controles criativos pra dev

E o controle que interessa aqui é a extensão de cena: você estende de 10 em 10 segundos, até um total de 40 segundos, e o modelo olha os últimos 10 segundos pra continuar a história em vez de começar outra

Bora ver como fazer isso na prática?

Formação Claude Code
Formação Recomendada

Formação Claude Code

Domine Claude Code do absoluto zero até o avançado

  • 114 aulas
  • 4 projetos
  • 9h 18min

O que você precisa antes de estender a cena

Primeiro, onde a coisa vive

Pra desenvolvedor, o Omni 1.1 Flash está no Google AI Studio, na Gemini API e na Gemini Enterprise Agent Platform

Pra usuário final, o modelo chega ao Flow globalmente para assinantes Google AI Plus, Pro e Ultra, e a extensão de cena também chega a esses mesmos planos no app Gemini

O identificador do modelo:

Na Gemini API, o modelo é o gemini-omni-1.1-flash, que é a versão GA de geração e edição de vídeo

Se você veio do endpoint de preview, se liga nisso: o gemini-omni-flash-preview será depreciado em 30 de setembro de 2026

Ou seja, migrar não é opcional, é só questão de quando você vai sentir a dor

E o vídeo que já está no meu computador?

Dá pra estender tanto vídeo gerado antes pelo próprio modelo quanto arquivo enviado por você

No caso do arquivo enviado, ele entra pela Files API junto com o prompt de extensão, e a extensão em si roda pela Interactions API, como está na documentação da Gemini API

São duas peças com papéis diferentes: uma leva o arquivo pra dentro, a outra continua a cena

Passo a passo: estendendo um vídeo de 10 em 10 segundos até 40s

  1. Tenha o vídeo de partida na mão

Ou você já gerou o clipe com o próprio modelo, ou você sobe o seu arquivo pela Files API

O erro comum deste passo: achar que a extensão só funciona em vídeo nascido dentro do modelo

Não é o caso, o arquivo de fora também entra na brincadeira

  1. Escreva o prompt de extensão em linguagem natural

Nada de fórmula mágica aqui, é frase de gente mesmo

A própria documentação traz exemplos assim:

Extend this video
The scene continues
Continue the scene: the camera pans across the mountains

Repara que o prompt diz pra onde a cena vai, não recapitula o que já passou

O erro comum deste passo: escrever um resumo do filme inteiro esperando que o modelo lembre de tudo

Ele usa os últimos 10 segundos do vídeo original como contexto, então o que aconteceu antes disso não está na mesa

  1. Rode a extensão pela Interactions API e repita o ciclo

Cada rodada acrescenta um incremento de 10 segundos ao vídeo

E o contexto de toda extensão é sempre o mesmo: os últimos 10 segundos do vídeo original

Então a lógica é simples: estendeu, olhou o resultado, escreveu o próximo prompt de continuação, estendeu de novo

O erro comum deste passo: seguir apontando pro endpoint de preview porque o script antigo ainda funciona hoje

Ele tem data marcada, 30 de setembro de 2026, e você não quer descobrir isso com pipeline quebrado em produção

Se a ideia é automatizar esse ciclo dentro de um agente, vale entender antes como latência e pensamento ajustável mudam o comportamento de um fluxo desses

  1. Pare ao atingir o total de 40 segundos

O teto do comprimento total é 40 segundos, então são blocos de 10 até fechar a conta

O erro comum deste passo: escrever um roteiro de um minuto e meio e só descobrir o limite no meio da produção

Planeje a história em quatro blocos desde o começo, fica muito mais tranquilo

Por que 10 segundos de contexto mudam a continuidade

Aqui está o pulo do gato

Ao estender, o modelo usa os últimos 10 segundos do vídeo original como contexto pra manter vídeo, movimento, personagens e áudio coerentes

Na geração anterior, com Veo, esse contexto era de 1 segundo

Pensa no que 1 segundo te dá: praticamente só o último frame e um pedacinho de movimento

Com isso, o modelo sabe onde a cena estava, mas não sabe pra onde ela estava indo

Dez segundos é outra história: dá pra ler a direção do movimento de câmera, o jeito que o personagem anda, o clima da trilha

Na prática, isso é menos corte seco entre blocos, menos troca de rosto no meio da história, menos quebra de áudio quando a cena vira

Não é garantia de continuidade perfeita, é uma janela de contexto MUITO maior pro modelo trabalhar

Recursos que combinam com a extensão de cena

A extensão sozinha já resolve, mas ela fica bem mais interessante junto com os outros controles do Omni 1.1 Flash

Referência de vídeo externo: dá pra enviar até 3 segundos de outro vídeo como referência pra carregar personagens e padrões de movimento

É útil justamente quando a história é longa e você quer que o mesmo personagem apareça igual lá no bloco final

First frame e last frame: você define o primeiro e o último frame de um plano e deixa o modelo preencher o movimento entre eles

Isso é interpolação, e serve bem pra órbita de câmera, zoom e loop, aquele tipo de plano que precisa fechar exatamente onde começou

Com extensão em sequência, dá pra amarrar o fim de um bloco no começo do próximo com muito mais intenção

Resolução: o modelo oferece 360p, 720p (padrão), 1080p e 4K

Só que tem um detalhe importante: as saídas em 1080p e 4K são obtidas por upscaling, não por geração nativa nessas resoluções

O padrão continua sendo 720p, então trate 1080p e 4K como acabamento, não como um modelo diferente rodando por baixo

Rascunhe em 360p antes de fechar em 720p

Se você vai estender quatro vezes, você vai gerar vídeo quatro vezes, beleza?

E a cobrança da API é por segundo de vídeo gerado, variando conforme a resolução:

Resolução Preço por segundo de vídeo gerado
360p US$ 0,03
720p US$ 0,10
1080p US$ 0,15
4K US$ 0,30

Por isso existe o modo de rascunho em 360p, que é até 60% mais rápido e custa um terço do 720p

A estratégia é bem direta: você monta a história inteira em 360p, bloco por bloco, vê se a continuidade aguenta o tranco, ajusta os prompts de extensão

Só depois que o roteiro visual está de pé você refaz na resolução de entrega

É a mesma cabeça de quem já aprendeu a escolher entre qualidade, custo e latência em vez de ligar tudo no máximo por padrão

E lembra que cada bloco de 10 segundos soma na conta, porque o que é cobrado é segundo gerado, não tentativa bem sucedida

Rascunho errado em 720p dói bem mais que rascunho errado em 360p 😀

Conclusão

O fluxo do Gemini Omni 1.1 Flash pra história mais longa cabe em três números: bloco de 10 segundos por extensão, até 10 segundos de contexto anterior, teto de 40 segundos no total

O prompt é linguagem natural, o arquivo de fora entra pela Files API e a extensão roda pela Interactions API

Próximo passo? Abre o Google AI Studio, faz um rascunho em 360p e estende duas vezes só pra sentir como a continuidade se comporta entre os blocos

E se o seu código ainda aponta pro gemini-omni-flash-preview, troca pro gemini-omni-1.1-flash antes de 30 de setembro de 2026

até o próximo post!

Perguntas frequentes

Quanto custa gerar vídeo no Gemini Omni 1.1 Flash em cada resolução?

O preço é cobrado por segundo de vídeo gerado e varia com a resolução: US$ 0,03 por segundo em 360p, US$ 0,10 em 720p, US$ 0,15 em 1080p e US$ 0,30 em 4K. O 360p é o modo rascunho, mais barato e mais rápido pra testar ideia antes de renderizar na resolução final.

Dá pra estender uma cena além dos 40 segundos?

Pelo que está documentado, o teto é 40 segundos no total, em blocos de 10 segundos por extensão. Vale planejar o roteiro em quatro blocos desde o início pra não esbarrar no limite no meio da produção.

As resoluções 1080p e 4K do Gemini Omni 1.1 Flash são geradas nativamente?

Não. As saídas em 1080p e 4K são obtidas por upscaling em cima da geração, e não nascem nativamente nessas resoluções. O padrão de geração continua sendo 720p.

Pra que serve o modo rascunho em 360p do Gemini Omni 1.1 Flash?

É um modo pensado pra iteração rápida: até 60% mais rápido que o 720p e um terço do custo. Faz sentido usar pra testar prompt e continuidade da cena antes de gastar em resolução final.

Até quando dá pra usar o endpoint gemini-omni-flash-preview?

O gemini-omni-flash-preview será depreciado em 30 de setembro de 2026. Quem ainda aponta pra esse endpoint precisa migrar pro identificador GA, gemini-omni-1.1-flash, antes dessa data.

A extensão de cena do Gemini Omni 1.1 Flash está disponível pra quem assina o Google AI?

Sim, pra assinantes Google AI Plus, Pro e Ultra. O modelo chega ao Flow globalmente pra esses planos, e a extensão de cena também chega ao app Gemini pros mesmos assinantes.



Escrito por | Matheus Battisti

Matheus Battisti
Fundador da Hora de Codar

Programador apaixonado pelo mundo das tecnologias, sempre buscando em aprender e se aprofundar em linguagens, frameworks e o que mais for necessário para executar um bom trabalho. Agora tem uma nova missão que é de passar seu conhecimento adiante para formar novos programadores e especializar mais os que já são.

Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares