Gemini API ou Gemini Enterprise Agent Platform: por onde acessar o Gemini Omni 1.1 Flash?

O Gemini Omni 1.1 Flash foi anunciado em 27 de agosto de 2026 como o modelo multimodal do Google para geração e edição de vídeo, e chegou em três superfícies oficiais: Google AI Studio (via Gemini API), Google Flow e Gemini Enterprise Agent Platform. Se o seu plano é integrar, a decisão é entre dois caminhos de código: na Gemini API o modelo está em GA com o ID gemini-omni-1.1-flash, no Agent Platform ele está em Preview com o ID gemini-omni-1.1-flash-preview. Mesmo modelo, contratos diferentes. Aqui eu comparo os dois, mostro o custo por segundo por resolução e digo por onde começar
Fala aí, beleza? O Google anunciou em 27 de agosto de 2026 o Gemini Omni 1.1 Flash, o novo modelo multimodal da casa pra geração e edição de vídeo
Até aí, ok, mais um lançamento
O problema aparece na hora de integrar: o modelo chegou em três superfícies oficiais, e DUAS delas são caminhos de código, com estágios diferentes, IDs diferentes e exigência de versão diferente da MESMA SDK
Ou seja, o mesmo modelo tem duas portas de entrada, e escolher a errada custa retrabalho
A ideia é você sair daqui sabendo por qual porta entrar, quanto isso custa por segundo de vídeo e qual erro operacional evitar logo no começo 🙂
O que é o Gemini Omni 1.1 Flash e onde ele está disponível
O Gemini Omni 1.1 Flash foi anunciado como o novo modelo multimodal do Google para geração e edição de vídeo
No lançamento, ele apareceu em três superfícies oficiais:
- Google AI Studio, via Gemini API
- Google Flow, a superfície de criação sem código
- Gemini Enterprise Agent Platform, o lado corporativo do Google Cloud
O recorte deste post são as duas superfícies de integração: Gemini API e Agent Platform
O Flow entra só como comparação, porque ele resolve a vida de quem quer o vídeo pronto e não quer escrever uma linha de código
Se você ainda está mais atrás nessa trilha e quer entender por onde começar a usar o Gemini antes de decidir superfície de integração, vale passar por lá primeiro
Formação Vibe Coding
Do Prompt ao Produto: Crie Software Real com IA
- 474 aulas
- 20 projetos
- 39h 27min
Gemini API x Gemini Enterprise Agent Platform: a comparação lado a lado
| Critério | Gemini API (Google AI Studio) | Gemini Enterprise Agent Platform |
|---|---|---|
| Estágio no lançamento | GA (generally available) | Preview |
| ID do modelo | gemini-omni-1.1-flash |
gemini-omni-1.1-flash-preview |
| SDK | google-genai, chamada pela Interactions API |
google-genai versão 2.0.0 ou superior |
| Superfície de entrada | Google AI Studio | Gemini Enterprise Agent Platform (evolução e novo nome do Vertex AI) |
| Tipo de projeto que atende | Projeto novo de vídeo, protótipo, integração direta | Projeto de agentes e times já dentro do Google Cloud |
| O que vem junto | Interactions API, GA desde junho de 2026 e recomendada pra todos os projetos novos | Agent Studio (sem código), Agent Development Kit e Agent Garden, com acesso a mais de 200 modelos de fundação |
Lendo a tabela em uma frase: é o MESMO modelo, com dois contratos diferentes
A SDK é a mesma nos dois lados, o google-genai, o que muda é a exigência de versão: no Agent Platform, recursos novos só saem no google-genai 2.0.0 ou superior
Um lado te dá estabilidade de GA e um caminho curto pra chamar o modelo. O outro te dá ferramental de agente em volta, mas com o modelo ainda em Preview e um ID que não é o mesmo
E é exatamente esse detalhe do ID que derruba gente no primeiro dia, se liga
Quando cada caminho faz mais sentido para o seu projeto
Projeto novo ou protótipo de vídeo: Gemini API
Se você está começando agora, o caminho é a Gemini API pelo Google AI Studio
O motivo é simples: lá o Gemini Omni 1.1 Flash está em disponibilidade geral, não em preview
E a chamada é feita pela Interactions API, que está GA desde junho de 2026 e é a recomendada pra todos os projetos novos na Gemini API
Ou seja, você não está apostando em superfície experimental nem em caminho que vai virar legado na sua mão
Time já dentro do Google Cloud construindo agentes: Agent Platform
Aqui a conta muda
O Gemini Enterprise Agent Platform é a evolução e o novo nome do Vertex AI, anunciado em 22 de abril de 2026 no Google Cloud Next ’26. Todos os serviços e o roadmap do Vertex AI passaram a ser entregues pelo Agent Platform
Então, se a sua stack já vive nesse mundo, faz pouco sentido sair dele só pra chamar um modelo de vídeo
O que vem junto pesa bastante pra quem constrói agente: Agent Studio (sem código), Agent Development Kit (framework modular) e Agent Garden (biblioteca de agentes e templates), com acesso a mais de 200 modelos de fundação
É um cenário parecido com o de quem monta um agente de IA no WhatsApp e descobre que o modelo é só uma peça: o resto é orquestração
O preço a pagar: nessa superfície o modelo está em Preview, e não GA
Só quer gerar vídeo sem escrever código: Flow
Se você não vai integrar nada, o Flow resolve
A extensão de cena chegou também aos assinantes finais por lá, disponível pra Google AI Plus, Pro e Ultra globalmente
Não é caminho de dev, e tudo bem: nem todo projeto precisa de API
Como fica a chamada do modelo em cada caminho
O caminho, na ordem:
- Na Gemini API, a chamada passa pela Interactions API, com o SDK
google-genai
response = client.interactions.create(
model="gemini-omni-1.1-flash",
input=...,
)
O erro comum deste passo: usar o ID do Agent Platform aqui. gemini-omni-1.1-flash-preview é o ID da OUTRA superfície, e ID de um caminho não vale pro outro
- No Agent Platform, o ID é
gemini-omni-1.1-flash-previewe o SDK continua sendo ogoogle-genai, só que na versão 2.0.0 ou superior
O erro comum deste passo: continuar no Vertex AI SDK. Releases do Vertex AI SDK posteriores a junho de 2026 não suportam Gemini, e recursos novos só saem no google-genai 2.0.0 ou superior
- Defina a resolução em
video_config
Os valores aceitos são quatro: 360p, 720p (padrão), 1080p e 4K
Detalhe que muda decisão de projeto: 1080p e 4K são gerados por upscaling
O erro comum deste passo: assumir que subir a resolução é sempre ganho de detalhe nativo. Não é bem isso, e você paga mais caro por segundo (o custo aparece na próxima seção)
- Pra interpolar entre imagens, use a task específica
A task image_to_video aceita até 2 imagens, definindo primeiro e último frame
O erro comum deste passo: tentar resolver interpolação no texto do prompt em vez de usar a task certa
- Revise qualquer código antigo que ainda aponte pro endpoint da geração anterior
gemini-omni-flash-preview será depreciado em 30 de setembro de 2026
O erro comum deste passo: deixar isso pra depois. Tome cuidado! Código em produção apontando pra endpoint com data de validade é o tipo de coisa que quebra no pior dia possível
Custo por segundo de vídeo: o que você vai pagar em cada resolução
Aqui o desenho do projeto encosta direto no bolso
| Resolução | Preço por segundo de vídeo gerado |
|---|---|
| 360p | US$ 0,03 |
| 720p (padrão) | US$ 0,10 |
| 1080p | US$ 0,15 |
| 4K | US$ 0,30 |
A base de cobrança do vídeo na Gemini API é por tokens de saída: US$ 17,50 por 1 milhão de tokens de saída, com 5.792 tokens por segundo de vídeo 720p, o que dá cerca de US$ 0,10 por segundo
A entrada é cobrada à parte: US$ 1,50 por 1 milhão de tokens, valendo pra texto, imagem, vídeo e áudio
E aqui vai a estratégia que eu acho mais massa do lançamento: iterar em 360p
O modo rascunho em 360p é até 60% mais rápido e custa um terço do 720p
Ou seja, você erra prompt barato e rápido, e só sobe a resolução quando a cena já está do jeito que você quer
Os limites também mexem no desenho do seu projeto:
- Cada saída tem de 3 a 10 segundos, a 24fps
- Com extensões sucessivas de cena, chega a 40 segundos acumulados
- Ao estender, o modelo analisa até 10 segundos de footage anterior, contra apenas o último segundo na geração anterior
- Dá pra usar até 3 segundos de footage externo como referência de estilo, pra carregar personagens ou padrões de movimento
Esse salto de contexto na extensão (de um segundo pra até dez) é o que muda o jogo pra quem quer continuidade de personagem entre cenas
O que eu vi na prática testando o Gemini 3.1 Pro no Google AI Studio
O modelo que eu rodei de verdade aqui foi o Gemini 3.1 Pro
E vale demais falar de expectativa versus prática quando você vai integrar modelo do Google, porque o padrão se repete
Quando testei, abri o Google AI Studio (aistudio.google.com) e encontrei o modelo novo já sinalizado na interface, disponível pra teste direto no playground
O acesso estava bem concentrado ali no playground, e o modelo ainda não aparecia estabelecido em todas as superfícies do Google, incluindo a interface web do Gemini
Isso é EXATAMENTE o ponto deste post: lançamento não chega igual em todo lugar ao mesmo tempo
Nos testes, pedi no playground uma landing page pra uma formação minha de vibe coding e consegui visualizar o resultado pelo próprio preview da ferramenta
Gerei também um app de desenho em pixel funcional, com undo e outras funções, a partir de um prompt único. Esse ficou mto massa 😀
Aí veio a parte que ninguém mostra: pedi um RPG roguelike, ele rodou, mas ficou visualmente bagunçado no meu teste
Pedi pra trocar os elementos por SVG e a alteração funcionou, mas o botão de respawn não
O jogo de corrida com seleção de carro e som saiu de um prompt único e funcionou
O SVG de dragão? Irreconhecível haha
Depois eu rodei um projeto mais complexo de Tower Defense em outra ferramenta agêntica, fora do AI Studio, e acompanhei o modelo fazendo build, iterando e testando no navegador sozinho
Ali ele demorou bem mais pra responder, mas eu não senti preguiça: senti que ele insistia até o projeto funcionar
O menu e a interface continuaram ruins e as waves não iniciavam no primeiro teste, e só depois de correção o jogo ficou jogável
Nas chamadas feitas no AI Studio logo após o lançamento, a resposta veio muito rápida
A conclusão que eu tirei: gostei do que vi, e o acesso liberado via Google AI Studio é um ponto forte de verdade, porque dá pra testar projeto pequeno e projeto grande sem barreira
Mas classifiquei como análise muito precoce. Pra código eu ainda prefiro o Opus, e pretendo testar mais antes de decidir se troco
No vídeo abaixo eu mostro esses testes rodando, os que deram certo e os que deram ruim:
Veredito: por onde começar hoje
Pra maioria de quem está começando a integrar agora: Gemini API no Google AI Studio
Dois motivos objetivos, sem hype: o modelo está em GA por lá, e a Interactions API é a recomendada pra todos os projetos novos desde que virou GA, em junho de 2026
O Gemini Enterprise Agent Platform entra quando o projeto é de agentes ou quando o time já vive dentro do Google Cloud
Aí faz sentido aceitar o custo de estar em Preview, porque o que você ganha em volta (Agent Studio, Agent Development Kit, Agent Garden e mais de 200 modelos de fundação) compensa
E o que eu NÃO vou afirmar, por falta de dado público confiável:
- Se existe free tier pro modelo na Gemini API
- Se o preço no Agent Platform é idêntico ao da Gemini API
- Quais regiões e endpoints atendem o
gemini-omni-1.1-flash-preview - Cotas e rate limits de cada caminho
- O caminho de cliques exato pra habilitar o modelo no console, e se o preview exige allowlist
Se eu não checei, não vira instrução aqui. Acho zoado botar algo por achismo e o leitor pagar a conta depois
Conclusão
O Gemini Omni 1.1 Flash chegou em três superfícies oficiais, e a sua decisão real é entre duas: Gemini API (GA, ID gemini-omni-1.1-flash) e Gemini Enterprise Agent Platform (Preview, ID gemini-omni-1.1-flash-preview)
Próximo passo concreto, na ordem:
- Escolha a superfície pelo perfil do projeto, não pelo hype: projeto novo de vídeo vai de Gemini API, projeto de agente dentro do Google Cloud vai de Agent Platform
- Comece iterando em 360p pra segurar custo (US$ 0,03 por segundo contra US$ 0,10 do 720p) e só suba a resolução quando a cena estiver fechada
- Revise agora qualquer código que ainda aponte pro
gemini-omni-flash-preview, que será depreciado em 30 de setembro de 2026
O resto (cotas, regiões, free tier) a gente cobre quando o dado sair oficial…
Bora acompanhar o blog e o canal que tem mais coisa vindo por aí, até o próximo post! 😀
Perguntas frequentes
Quanto custa gerar um vídeo com o Gemini Omni 1.1 Flash por segundo?
O preço varia por resolução: US$ 0,03 por segundo em 360p, US$ 0,10 em 720p, US$ 0,15 em 1080p e US$ 0,30 em 4K. Na Gemini API essa cobrança também pode ser lida em tokens de saída, com 5.792 tokens por segundo de vídeo 720p a US$ 17,50 por 1 milhão de tokens, o que dá os mesmos US$ 0,10 por segundo. A entrada (texto, imagem, vídeo ou áudio) sai à parte, a US$ 1,50 por 1 milhão de tokens.
O que acontece com o modelo gemini-omni-flash-preview antigo?
Esse endpoint da geração anterior em preview será depreciado em 30 de setembro de 2026. Quem ainda chama esse ID precisa migrar pro gemini-omni-1.1-flash (Gemini API) ou pro gemini-omni-1.1-flash-preview (Gemini Enterprise Agent Platform), dependendo da superfície usada.
Qual SDK usar pra chamar o Gemini Omni 1.1 Flash em cada superfície?
Nos dois caminhos a biblioteca é a mesma, o google-genai. Na Gemini API a chamada passa pela Interactions API, com client.interactions.create(model="gemini-omni-1.1-flash", input=…). No Gemini Enterprise Agent Platform o que muda é a versão: recursos novos de Gemini só saem no google-genai 2.0.0 ou superior, já que releases do Vertex AI SDK posteriores a junho de 2026 não suportam Gemini.
Quanto tempo de vídeo dá pra gerar estendendo uma cena no Gemini Omni 1.1 Flash?
Cada geração produz de 3 a 10 segundos a 24fps. Com extensões sucessivas de cena, esse total acumulado chega a 40 segundos. Pra estender, o modelo analisa até 10 segundos de footage anterior, contra apenas o último segundo que a geração passada considerava.
Dá pra usar um vídeo externo como referência de estilo no Gemini Omni 1.1 Flash?
Sim, o modelo aceita até 3 segundos de footage externo como referência, útil pra carregar personagens ou padrões de movimento específicos. Isso é diferente da extensão de cena, que usa o próprio vídeo gerado como contexto.
Qual a diferença entre gerar em modo rascunho e gerar direto em 720p?
O modo rascunho em 360p é até 60% mais rápido que 720p e sai por um terço do custo. Vale pra testar enquadramento e movimento antes de gastar com a resolução final, já que 720p é o padrão do parâmetro de resolução em video_config.
Como interpolar entre duas imagens usando o Gemini Omni 1.1 Flash?
É preciso usar a task image_to_video, que aceita até 2 imagens definindo o primeiro e o último frame do vídeo. Não é algo pra resolver descrevendo no texto do prompt: a task específica é o caminho certo pra esse tipo de interpolação.
Formações
Formação SAAS com IA
Tire usas ideias do papel criando softwares com IA, integre pagamentos e lance seu projeto!
- 291 aulas
- 18 projetos
- 24h 17min
Blog | Mais populares
As diferenças de var, let e const
Como fazer redirecionamento com PHP
Neste artigo você vai aprender a como fazer redirecionamento com PHP, utilizaremos abordagens fáceis de entender e de aplicar Fala programador(a), beleza? Bora aprender mais […]
Checklist de segurança n8n VPS pública: guia essencial para proteger sua instalação
Checklist de segurança n8n VPS pública: guia essencial para proteger sua instalação A popularidade da automação de processos com o n8n está em alta, principalmente […]
