Google Gemini Omni 1.1 Flash Otimiza Geração de Vídeo com Novos Controles
O Google lançou o Gemini Omni 1.1 Flash, uma atualização para desenvolvedores que aprimora o controle sobre a geração de vídeo por IA. A novidade permite estender cenas em até 40 segundos, definir quadros de início e fim para transições suaves, gerar vídeos em 4K e realizar prototipagem rápida com pré-visualizações em 360p, tornando a criação de vídeo mais flexível e econômica.

O Google revelou o Gemini Omni 1.1 Flash, uma atualização robusta para sua ferramenta de geração de vídeo por inteligência artificial, que oferece aos desenvolvedores controles significativamente aprimorados. Essa novidade é crucial para profissionais e criadores que buscam maior precisão, consistência e eficiência na produção de conteúdo audiovisual utilizando IA.
O que muda na prática
- Extensão de cenas: Agora é possível expandir vídeos existentes em incrementos de 10 segundos, chegando a um total de 40 segundos, com o modelo analisando até 10 segundos de contexto prévio para manter a consistência visual e narrativa.
- Transições e movimentos de câmera suaves: O Omni 1.1 permite especificar quadros de início e fim para criar transições fluidas, movimentos de câmera complexos, como órbitas e zooms, e clipes em loop contínuos.
- Prototipagem rápida e econômica: Pré-visualizações em resolução 360p podem ser geradas até 60% mais rápido e a um terço do custo, ideal para testar ideias e iterar rapidamente em storyboards.
- Saída em alta resolução: Projetos finais podem ser aprimorados para resoluções de 1080p ou 4K, garantindo um acabamento profissional.
- Referências de vídeo aprimoradas: É possível usar até três segundos de vídeo como referência na entrada multimodal, ajudando a manter a consistência visual de personagens e contextos.
Segundo o DeepMind Blog, o Gemini Omni 1.1 Flash representa uma suíte de controles criativos e capacidades de vídeo generativo projetada para apoiar desenvolvedores. A atualização torna o Omni 1.1 pronto para uso profissional através da API Gemini no Google AI Studio. As melhorias visam tornar a geração de vídeo mais controlável, rápida para iterar e polida para implementação no mundo real.
A capacidade de estender cenas é um dos destaques, permitindo que o modelo analise uma porção maior do vídeo anterior – até 10 segundos, um avanço significativo em relação aos modelos anteriores que consideravam apenas o último segundo. Conforme o The Decoder, essa análise aprofundada resulta em maior consistência visual e aderência narrativa, facilitando a construção de histórias mais longas ou a exploração de novas direções criativas.
Para transições e movimentos de câmera, o Omni 1.1 possibilita que os desenvolvedores especifiquem quadros-chave para criar vídeos contínuos entre eles. Isso é particularmente útil para movimentos complexos de câmera, como rotações orbitais ou transições de zoom, garantindo um resultado profissional e sem cortes abruptos.
A otimização de custo e tempo é outro ponto forte. O DeepMind Blog detalha que as pré-visualizações em 360p são geradas até 60% mais rápido e com um terço do custo em comparação com a resolução padrão de 720p do Omni 1.1. Esse "modo rascunho" é uma ferramenta valiosa para prototipagem rápida e iteração, permitindo que os criadores explorem diversas variações de forma eficiente.
A qualidade final também foi aprimorada, com a possibilidade de escalar projetos para resoluções de 1080p ou 4K, atendendo às demandas de produções profissionais. Além disso, o modelo agora suporta a adição de referências de vídeo em entradas multimodais, permitindo o uso de até três segundos de vídeo para manter o contexto visual e a consistência dos personagens.
Grandes players do mercado já estão utilizando o Gemini Omni Flash em produção. A Adobe, por exemplo, integrou o modelo ao Adobe Firefly, conforme destacado pelo DeepMind Blog. Itay Schiff, Diretor Criativo da Figma Weave, observou que o Gemini Omni Flash é um dos modelos de vídeo mais fortes disponíveis na plataforma, ajudando as equipes criativas a "dirigir" seus vídeos, e não apenas gerá-los. Louisa Guo, VP de Marketing da GMI Cloud, ressaltou a precisão do modelo, crucial para conteúdos educacionais e explicativos. Jamie Umpherson, Diretor Criativo da Runway, afirmou que o Omni Flash se encaixa naturalmente no fluxo de trabalho de seus usuários, permitindo que movam rapidamente entre ideias.
O Gemini Omni 1.1 Flash está sendo implementado em todo o ecossistema de desenvolvedores do Google, incluindo Google AI Studio e a Plataforma Gemini Enterprise Agent. Além disso, a funcionalidade de extensão de cena está disponível para todos os assinantes Google AI Plus, Pro e Ultra globalmente no aplicativo Gemini e o Omni 1.1 em si está disponível no Google Flow para esses assinantes. O material não especifica próximas atualizações ou um cronograma de lançamentos futuros, mas o foco em controles detalhados e otimização de custos sugere uma contínua evolução na direção de ferramentas de IA mais acessíveis e poderosas para a produção de vídeo.
Achou um erro nesta matéria? Avise a redação — corrigimos e registramos a data da correção.



Comentarios
Troque ideia com outros leitores, responda em contexto e mantenha a conversa útil.
Faça login para comentar
Entre com sua conta Google para participar da discussão com nome e avatar.
Os comentários já publicados continuam visíveis mesmo sem login.