MADRID 28 ago. (Portaltic/EP) -
O Google lançou a atualização do seu modelo Gemini Omni Flash para a versão 1.1, que oferece produção de vídeo aprimorada, adicionando a capacidade de estender uma cena por até 40 segundos, interpolação do primeiro e do último quadro, escalonamento nítido para 4K e criação de protótipos mais rápida, entre outras novidades.
A empresa de tecnologia divulgou seu modelo de inteligência artificial (IA) generativa Gemini Omni no âmbito de seu evento anual para desenvolvedores, o Google I/O 2026. Posteriormente, foi lançada oficialmente a versão Gemini Omni Flash, juntamente com o Nano Banana 2 Lite, como uma ferramenta de vídeo multimodal capaz de gerar vídeos de 10 segundos com um nível de produtividade empresarial em alta velocidade.
Agora, o Google lançou a atualização Gemini Omni 1.1 Flash, que traz melhorias para tornar a produção de vídeo mais controlável e com iterações mais rápidas, além de incluir recursos como a função para estender uma cena.
Foi o que explicou a empresa em um comunicado em seu blog, onde detalhou que essa função permite utilizar um vídeo existente e continuar gerando filmagem “sem interrupções” a partir do ponto em que foi interrompida.
Para isso, o Omni 1.1 analisa até 10 segundos do contexto anterior (em vez de se limitar a analisar apenas o último segundo, como na versão anterior) e, em seguida, gera mais tempo de cena com maior coerência visual e uma “melhor coesão narrativa”. Isso permite que os usuários criem histórias mais longas, de até 40 segundos, ampliando as cenas de 10 segundos em incrementos de 10 segundos.
Outra das melhorias aplicadas ao modelo é a capacidade de gerar transições e movimentos de câmera fluidos, interpolando o primeiro e o último quadro de cada tomada. Isso é útil na hora de gerar “órbitas complexas de câmera, transições de zoom ou loops sem interrupções”, conforme explicou o Google.
O Omni 1.1 também gera pré-visualizações leves na resolução de 360p até 60% mais rápido e “a um terço do custo” em comparação com a resolução padrão de 720p. Além disso, também permite o redimensionamento de vídeo para uma resolução de 4K, ou seja, gera imagens de alta resolução em 1.080p ou 4K para produção profissional.
O Google também especificou que é possível adicionar referências de vídeo na entrada multimodal para gerar o conteúdo. Especificamente, os usuários podem utilizar até três segundos de vídeo como referência para criar uma cena. Como resultado, o modelo manterá o contexto visual e a coerência dos personagens que aparecerem com base nessas referências.
Além disso, o Omni 1.1 está sendo implementado no Google AI Studio, na API da plataforma Gemini Enterprise Agent e para todos os assinantes do Google AI Plus, Pro e Ultra em todo o mundo no Google Flow. Vale destacar que o recurso de extensão de cenas também está disponível para os assinantes em todo o mundo no aplicativo Gemini.
Esta notícia foi traduzida por um tradutor automático