Gemini Omni 1.1 Flash: o que muda na geração de vídeo com IA do Google?

modelo Gemini Omni 1.1 Flash do Google para geração de vídeo com IA
Resposta rápida

O Gemini Omni 1.1 Flash é o modelo multimodal mais recente do Google para geração e edição de vídeo, anunciado como atualização production-ready para desenvolvedores e listado como Preview na documentação do Gemini Enterprise Agent Platform. A novidade é a suíte de controles criativos: extensão de cena com até 10 segundos de contexto anterior (antes era 1 segundo), incrementos de 10s até 40s acumulados, first e last frame, até 3 segundos de vídeo de referência e modo rascunho em 360p. O preço na Gemini API vai de US$ 0,03/s em 360p a US$ 0,30/s em 4K, com 720p em US$ 0,10/s

O Google mexeu de novo no seu modelo de vídeo generativo, e dessa vez o alvo é bem claro: quem constrói em cima da API

Fala aí, beleza? O Gemini Omni 1.1 Flash foi anunciado como o modelo multimodal mais recente do Google para geração e edição de vídeo, e o que veio junto não é só "mais qualidade": é uma suíte nova de controles criativos pensada pra desenvolvedor

Este post é o mapa de entrada: o que ele é, onde ele se encaixa e o que ele entrega de fato pra quem monta pipeline de vídeo

O que é o Gemini Omni 1.1 Flash e de onde ele vem

O anúncio oficial saiu no blog do Google, posicionando o modelo como atualização production-ready para desenvolvedores

Não é um produto do zero

Já existia uma versão anterior do Omni Flash, e a 1.1 é a iteração em cima dela, com os controles criativos como o grande diferencial da vez

Formação Claude Code
Formação Recomendada

Formação Claude Code

Domine Claude Code do absoluto zero até o avançado

  • 114 aulas
  • 4 projetos
  • 9h 18min

Um detalhe importante de estágio: na documentação do Gemini Enterprise Agent Platform, o modelo aparece como Gemini Omni 1.1 Flash Preview

Ou seja, dá pra construir, mas você constrói sabendo que ainda é Preview naquele caminho

(guarda essa palavra "Preview", porque mais pra frente ela reaparece com outro sentido, e aí eu separo os dois pra não dar nó)

É o mesmo tipo de leitura que a gente já fazia com as novidades do Gemini 3.7 Flash: entender o que mudou em relação à geração anterior antes de sair trocando o modelo no seu código 🙂

O que muda na prática para quem gera vídeo com IA

Aqui mora o post inteiro

Cada controle novo resolve uma dor específica de quem tenta fazer vídeo generativo virar produto, e não demo bonita

Extensão de cena: até 10 segundos de contexto, e não mais 1

Esse é o item mais pesado da lista

A extensão de cena agora analisa até 10 segundos do vídeo já gerado como contexto, em vez de olhar apenas o último segundo, como faziam os modelos anteriores

Por que isso importa? Porque contexto curto é a raiz do vídeo que "perde o fio": o personagem muda de roupa, a luz vira outra, o movimento quebra na emenda

Com mais contexto pra ler, a continuação tem mais material pra manter coerência

As cenas podem ser estendidas em incrementos de até 10 segundos, chegando a 40 segundos acumulados

E atenção nesse ponto, porque é onde muita gente vai se confundir: os 40 segundos são duração cumulativa, resultado de extensões sucessivas

Cada saída individual fica entre 3 e 10 segundos, ou seja, o incremento é um teto, não um valor fixo

Não existe aqui o botão de gerar 40 segundos de uma vez

First frame e last frame: você define o começo e o fim do plano

O desenvolvedor pode definir o primeiro e o último frame de um plano

Com isso dá pra criar transições e movimentos de câmera entre keyframes, em vez de descrever o movimento em texto e torcer pro modelo entender

Se você já dirigiu qualquer coisa em vídeo, é a diferença entre pedir "faz uma câmera subindo" e marcar onde a câmera começa e onde ela termina

Controle de verdade, e não sorte no prompt

Vídeo de referência: até 3 segundos pra segurar o personagem

Dá pra enviar até 3 segundos de vídeo externo como referência visual

O objetivo declarado é manter personagem, movimento e contexto entre cenas

Esse é o tipo de recurso que separa "clipe isolado" de "sequência": sem referência, cada plano tende a ser um universo novo

Modo rascunho em 360p: itera barato antes de gastar caro

O modo rascunho em 360p roda até 60% mais rápido e custa um terço do preço em comparação com o 720p

A lógica é a mesma do storyboard: você não renderiza em alta pra descobrir que o enquadramento tá errado

Testa o prompt no feio, aprova a ideia, depois sobe a resolução

Resolução: 720p é o padrão, 1080p e 4K são upscale

Esse ponto merece leitura fria

A resolução padrão da API é 720p, e 1080p e 4K são entregues como upscale, não como geração nativa naquelas resoluções

Tome cuidado com a expectativa aqui: pagar mais por 4K não é o mesmo que o modelo ter gerado 4K do zero

Muda o que você promete pro cliente e muda como você calcula custo por entrega

Preço do Gemini Omni 1.1 Flash por resolução

Na Gemini API a cobrança é por segundo de vídeo de saída, variando conforme a resolução

Resolução Preço por segundo de vídeo de saída
360p US$ 0,03
720p US$ 0,10
1080p US$ 0,15
4K US$ 0,30

Dois detalhes mudam a leitura dessa tabela

O primeiro: o preço do 720p permanece inalterado em relação à versão anterior do Omni Flash, seguindo em US$ 0,10 por segundo

O segundo: como 1080p e 4K são upscale, a conta de custo x qualidade não é linear, você está pagando pelo aumento de resolução aplicado em cima de uma geração que não nasceu naquele tamanho

E é por isso que o rascunho em 360p vira estratégia, e não gambiarra

A US$ 0,03 por segundo, ele custa um terço do 720p

Iterar dez versões no feio sai mais barato que errar três no caro 😀

Como acessar o modelo e o que muda no endpoint

São dois caminhos separados

Desenvolvedores acessam pelo Google AI Studio (Gemini API)

Empresas acessam pelo Gemini Enterprise Agent Platform, via Agent Platform API, que é onde o modelo aparece como Preview

Quem já pensa nesse recorte corporativo provavelmente lembra da discussão sobre modelos Flash em fluxos corporativos, e a divisão aqui segue a mesma lógica de plataforma

O identificador do modelo na Gemini API é gemini-omni-1.1-flash

E agora o detalhe que quebra código: a geração de vídeo com o Omni é feita pela Interactions API, e não por um endpoint separado de generateVideos

A chamada vai pra:

POST https://generativelanguage.googleapis.com/v1beta/interactions

Com o modelo e o formato de resposta declarados no corpo:

{
  "model": "gemini-omni-1.1-flash",
  "response_format": { "type": "video" }
}

Item de migração pra colocar no calendário agora: o endpoint anterior gemini-omni-flash-preview será descontinuado em 30 de setembro de 2026

Se você tem algo em produção apontando pra ele, essa data é sua

E aqui entra a confusão que eu avisei lá em cima, porque a palavra "preview" aparece em dois lugares com sentidos diferentes

Um é estágio de plataforma: o modelo listado como Gemini Omni 1.1 Flash Preview na documentação do Gemini Enterprise Agent Platform, ou seja, o caminho corporativo do modelo novo

O outro é nome de endpoint: gemini-omni-flash-preview é o identificador da versão anterior à 1.1, que já carregava "preview" no próprio nome, e é justamente esse que vai ser descontinuado

São coisas separadas: uma fala do estágio do modelo atual no caminho empresarial, a outra é o endereço velho que sai de cena

O Google publicou documentação, cookbooks e guias de prompting pra integrar extensão de cena, referências de vídeo e upscaling em aplicações, tudo na documentação oficial do Omni

Para quem o Gemini Omni 1.1 Flash faz sentido

Cada controle novo casa com um cenário bem concreto de quem constrói:

  • Quem queima orçamento testando prompt: itera enquadramento e descrição em 360p, a um terço do custo do 720p, e só sobe a resolução no que já foi aprovado
  • Quem precisa de sequência, não de clipe solto: encadeia cenas com extensões sucessivas de até 10 segundos cada, somando até 40 segundos acumulados
  • Quem trabalha com personagem recorrente: usa até 3 segundos de vídeo de referência pra manter personagem, movimento e contexto entre planos
  • Quem pensa em direção de câmera: define first frame e last frame e planeja a transição entre keyframes, em vez de descrever movimento no texto e cruzar os dedos

E tem o caminho de quem só quer usar, sem escrever uma linha de código

Aqui vale um aviso de nome: nesse trecho o anúncio do Google fala em Gemini Omni Flash, sem o 1.1, e o que ele descreve é o rollout global para assinantes Google AI Plus, Pro e Ultra, no app Gemini e no Google Flow

Ou seja, o "1.1" é o nome que aparece no caminho de desenvolvedor (model ID gemini-omni-1.1-flash e listagem no Gemini Enterprise Agent Platform), enquanto o app e o Flow são citados com o nome curto

Dá pra separar bem os dois públicos: quem quer usar vai pelo app, quem quer integrar vai pela API

Vale entrar agora no Gemini Omni 1.1 Flash?

Depende do que você chama de "entrar"

Pra experimentar e prototipar, sim: o modelo foi anunciado como production-ready para desenvolvedores, está no Google AI Studio, tem documentação, cookbooks e guias de prompting publicados

Pra apostar a operação inteira, vale o pé atrás de sempre: no Gemini Enterprise Agent Platform ele ainda aparece como Preview

E tem duas coisas que exigem atenção antes de prometer entrega pra alguém

Upscale não é geração nativa: 1080p e 4K saem de uma base 720p

E o gemini-omni-flash-preview some em 30 de setembro de 2026, então migração não é assunto pra depois

O caminho prático pra começar:

  1. Abra a documentação oficial em ai.google.dev/gemini-api/docs/omni e confira os parâmetros atuais dos controles, porque no caminho corporativo o modelo está em Preview e detalhe de API muda
  2. Rode um teste em 360p pelo Google AI Studio, usando gemini-omni-1.1-flash pela Interactions API. O erro comum aqui é tentar chamar um endpoint de generateVideos que não é o caminho do Omni
  3. Valide a continuidade antes de escalar: estenda a cena uma vez, veja se o personagem e a luz seguem coerentes, e só então empilhe extensões até os 40 segundos acumulados
  4. Só depois de aprovar prompt e enquadramento, suba a resolução, sabendo que 720p custa US$ 0,10 por segundo e o rascunho em 360p custa um terço disso

Testa no barato, valida a ideia, depois paga pelo bonito

É um jeito bem menos doloroso de descobrir que o prompt tava errado, né? haha

até o próximo post!

Perguntas frequentes

O Gemini Omni 1.1 Flash já está liberado para produção ou ainda é experimental?

Depende do caminho de acesso. Pelo Google AI Studio e pela Gemini API, o Google anunciou o modelo como atualização production-ready para desenvolvedores. Já na documentação do Gemini Enterprise Agent Platform ele aparece como Gemini Omni 1.1 Flash Preview, ou seja, esse acesso corporativo ainda está em estágio de Preview.

Dá para gerar um vídeo de 40 segundos direto em uma única chamada?

Não. Os 40 segundos são duração acumulada, resultado de extensões sucessivas em incrementos de até 10 segundos. Cada saída individual do modelo fica entre 3 e 10 segundos, então o incremento é um teto e não um valor fixo, e não existe um modo de gerar os 40 segundos de uma vez só.

Qual identificador de modelo eu uso para chamar o Gemini Omni 1.1 Flash na Gemini API?

O identificador é gemini-omni-1.1-flash. Ele é usado na Interactions API, com uma chamada POST para o endpoint v1beta/interactions informando esse model e um response_format do tipo video.

O que acontece com quem ainda usa o endpoint gemini-omni-flash-preview?

Esse endpoint anterior será descontinuado em 30 de setembro de 2026. Quem tem integração em produção apontando pra ele precisa migrar para o fluxo atual via Interactions API antes dessa data. Vale notar que o preview no nome desse endpoint é só parte do identificador antigo, anterior à 1.1, e não tem relação com o estágio de Preview do modelo novo no Gemini Enterprise Agent Platform.

Vale a pena pedir a saída direto em 4K no Gemini Omni 1.1 Flash?

Vale avaliar com cuidado, porque 1080p e 4K não são gerados nativamente naquelas resoluções, eles são entregues como upscale em cima da geração padrão em 720p. O preço acompanha essa diferença: US$ 0,15 por segundo em 1080p e US$ 0,30 por segundo em 4K, contra US$ 0,10 por segundo no 720p.

Quem não é desenvolvedor consegue usar o modelo no app Gemini?

Sim. O anúncio do Google usa o nome curto Gemini Omni Flash nesse trecho e informa rollout global para assinantes do Google AI Plus, Pro e Ultra, direto no app Gemini e no Google Flow. Esse caminho é separado do acesso via Google AI Studio e Gemini API, onde o modelo aparece como gemini-omni-1.1-flash e é voltado a quem constrói aplicações.



Escrito por | Matheus Battisti

Matheus Battisti
Fundador da Hora de Codar

Programador apaixonado pelo mundo das tecnologias, sempre buscando em aprender e se aprofundar em linguagens, frameworks e o que mais for necessário para executar um bom trabalho. Agora tem uma nova missão que é de passar seu conhecimento adiante para formar novos programadores e especializar mais os que já são.

Subscribe
Notify of
guest

0 Comentários
Oldest
Newest Most Voted

Formações

Formação Vibe Coding

Formação Vibe Coding

Do Prompt ao Produto: Crie Software Real com IA

  • 474 aulas
  • 20 projetos
  • 39h 27min

Blog | Mais populares