Atualização Gemini Omni 1.1 Flash: Geração de Vídeo IA com Mais Controle
O Gemini Omni 1.1 Flash chega com extensão de cenas até 40 segundos, upscaling 4K e modo de pré-visualização 360p mais rápido e econômico para criadores.
O Google DeepMind liberou o Gemini Omni 1.1 Flash no dia 27 de agosto de 2026, trazendo controle muito mais granular sobre a geração de vídeo por IA. Se você já usou a primeira versão do Gemini Omni, sabe que os clipes curtos eram úteis, mas difíceis de dirigir. Essa atualização mudou isso. Com extensão de cenas em incrementos de 10 segundos, interpolação de quadros, upscaling para 4K e um modo de pré-visualização mais rápido e barato, o modelo de vídeo generativo do Google ficou consideravelmente mais prático para criadores e desenvolvedores. A atualização chega num momento de competição acirrada na área de geração de vídeo por IA, e o Google quer marcar posição.
O que muda no Gemini Omni 1.1 Flash
A versão anterior do Gemini Omni analisava apenas 1 segundo de contexto prévio para continuar um vídeo. Isso limitava bastante a continuidade das cenas. Agora, o modelo consegue examinar até 10 segundos de material anterior antes de gerar a próxima sequência. O resultado é uma continuidade visual muito mais coerente, sem aqueles cortes deslocados que aconteciam quando o contexto era muito curto.
A extensão acontece em incrementos de 10 segundos, podendo alcançar até 40 segundos no total. Para quem trabalha com conteúdo curto para redes sociais ou protótipos de vídeo, essa janela ampliada faz diferença. Dá para construir narrativas visuais mais longas sem precisar editar manualmente os trechos gerados.
A tabela abaixo resume as principais diferenças entre as duas versões:
| Recurso | Gemini Omni 1.0 | Gemini Omni 1.1 Flash |
|---|---|---|
| Contexto prévio para extensão | 1 segundo | 10 segundos |
| Extensão máxima | Limitada | 40 segundos em incrementos de 10s |
| Interpolação de quadros | Não | Sim, primeiro e último quadro |
| Upscaling máximo | 720p | 1080p ou 4K |
| Modo de pré-visualização | Não | 360p, até 60% mais rápido |
| Custo do modo pré-visualização | Igual ao 720p | 1/3 do custo do 720p |
| Referência de vídeo na entrada | Não | Até 3 segundos |
Extensão de cenas com mais contexto
A maior mudança prática dessa atualização está na forma como o Gemini Omni 1.1 Flash lida com continuidade. Antes, quando você pedia para o modelo estender um clip, ele tinha apenas 1 segundo de referência. Isso significava que cortes de câmera, mudanças de iluminação e movimento de personagens frequentemente se perdiam na transição. Um clip de alguém andando podia ter a direção do movimento invertida na extensão, ou o estilo de iluminação mudava abruptamente.
Com 10 segundos de análise prévia, o modelo identifica padrões de movimento, direção de objetos e até ritmo de cena. Se um personagem está correndo da esquerda para a direita, a extensão mantém essa direção. Se a câmera estava fazendo um movimento lateral, a continuação respeita esse movimento. Não é perfeito em todos os casos, mas a diferença é visível.
Os criadores que produzem conteúdo para Reels e Shorts vão sentir essa melhora logo nos primeiros testes. Em vez de gerar vários clips de 10 segundos e costurá-los na edição, dá para pedir ao modelo que estenda uma cena até 40 segundos, mantendo consistência visual. Isso reduz o tempo de pós-produção e permite testar variações de continuação sem recomeçar do zero. Para quem produz conteúdo em volume, a economia de tempo de edição é onde o impacto aparece primeiro.
Interpolação de quadros para transições suaves
Outra adição importante é a interpolação entre o primeiro e o último quadro. Você define uma imagem inicial e uma final, e o modelo preenche os quadros intermediários para criar uma transição fluida. Isso é particularmente útil para transições criativas entre cenas, onde um corte seco não funciona.
Pense em um vídeo de produto onde você quer ir da embalagem fechada até o produto em uso. Com a interpolação, você fornece as duas imagens e o modelo gera a transição completa. Isso reduz o trabalho de animação manual e abre espaço para criatividade sem precisar de software de motion graphics. Para pequenos criadores e equipes enxutas, isso significa produzir transições que antes exigiam conhecimento técnico de animação.
A qualidade da interpolação depende da complexidade do movimento entre os dois quadros. Transições simples, como mudanças de cor ou movimento linear, saem mais limpas. Movimentos complexos, como rotações em três eixos, podem apresentar artefatos. Vale testar com diferentes níveis de complexidade para entender onde o modelo se sai melhor e onde vale mais fazer a transição manualmente. O importante é tratar o resultado como um rascunho visual que pode ser refinado, não como produto final em todos os casos.
Upscaling para 4K e modo de pré-visualização 360p
O Gemini Omni 1.1 Flash traz duas melhorias que afetam diretamente o bolso: a qualidade de saída e o custo de iteração. A primeira é o upscaling para 1080p ou 4K. Os vídeos gerados saem em resolução mais baixa internamente e passam por um processo de refinamento para alcançar a resolução final. O resultado é um vídeo com mais nitidez, pronto para uso em plataformas que exigem alta resolução, como YouTube e Vimeo.
A segunda é o modo de pré-visualização em 360p. Esse modo é até 60% mais rápido e custa um terço do preço comparado à geração em 720p. Para desenvolvedores e criadores que precisam iterar rapidamente, testar prompts e ajustar parâmetros, o modo 360p permite fazer mais tentativas no mesmo tempo e orçamento. Quando o resultado estiver satisfatório, basta gerar a versão final em 1080p ou 4K.
Essa abordagem de pré-visualizar barato e renderizar caro faz sentido para qualquer fluxo de trabalho de geração de vídeo IA. A diferença de custo entre iterar em 720p e em 360p pode parecer pequena por clip, mas se acumula rapidamente em projetos maiores. Para quem usa a Gemini API de forma programática e paga por uso, a economia no modo 360p é real e mensurável. Em um projeto com 100 iterações de teste, a diferença de custo fica clara no relatório de consumo.
Referências de vídeo na entrada multimodal
O Gemini Omni 1.1 Flash agora aceita referências de vídeo de até 3 segundos como parte da entrada multimodal. Antes, você podia usar imagens como referência, mas não trechos de vídeo. Isso muda a forma como você pode dirigir a geração, dando ao modelo informações de movimento e ritmo que imagens estáticas não conseguem transmitir.
Na prática, você fornece um clip curto de referência junto com o prompt de texto, e o modelo usa o estilo, movimento ou composição desse clip como base para o vídeo gerado. É diferente da extensão de cena, que continua um vídeo existente. Aqui, a referência serve como inspiração visual. Se você fornecer um clip de uma câmera com tremor em ambiente urbano, o modelo pode gerar um vídeo novo com aquele estilo de movimento e iluminação.
Para criadores de conteúdo, isso abre possibilidades interessantes. Você pode gravar um clip rápido no celular como referência de movimento e pedir ao modelo que gere uma versão estilizada. Para desenvolvedores que usam a Gemini API, esse recurso amplia as opções de entrada sem precisar converter vídeo em frames manualmente. A limitação de 3 segundos é suficiente para capturar um movimento ou estilo, mas curta o suficiente para exigir clareza na referência.
Onde usar o Gemini Omni 1.1 Flash
O modelo está disponível em três canais principais. O Google AI Studio é a opção para desenvolvedores que querem testar a Gemini API diretamente, com controle completo sobre parâmetros como temperatura, duração e estilo. A Agent Platform API permite integração em aplicações e fluxos automatizados que precisam de geração de vídeo programática. O Google Flow, por sua vez, é a interface visual para assinantes AI Plus, Pro e Ultra, que ganham acesso à ferramenta de criação sem precisar escrever código.
A extensão de cenas também está disponível no app Google Gemini para assinantes. Isso significa que dá para gerar e editar vídeos curtos diretamente no celular, sem precisar abrir o estúdio no desktop. Para quem produz conteúdo em movimento, essa flexibilidade é uma vantagem real. Você começa um projeto no celular, ajusta no estúdio no desktop e publica.
Para quem se preocupa com privacy, o Google declara que os dados enviados pela Gemini API não são usados para treinamento de modelos. O Google Gemini no Android centraliza o acesso a esses recursos. Se você já tem uma assinatura AI Plus, Pro ou Ultra, as novas funcionalidades estão disponíveis sem custo adicional. Para quem busca uma ferramenta de Google IA vídeo no celular, o app oferece o caminho mais direto. A disponibilidade global do Google Flow para assinantes significa que não há barreira geográfica para começar.
Vale a pena atualizar agora
Se você depende de geração de vídeo por IA no seu fluxo de trabalho, o Gemini Omni 1.1 Flash resolve dois problemas que limitavam a versão anterior: a falta de contexto na extensão de cenas e o custo alto de iteração. O modo 360p sozinho já justifica a mudança para quem itera muito. A interpolação de quadros e o upscaling para 4K ampliam o leque de uso para projetos que exigem qualidade final maior. Faça o download do app Google Gemini pela APKPure para acessar os novos recursos de geração de vídeo por IA no seu celular e comece a testar as possibilidades de extensão e interpolação de cenas hoje mesmo.
