← Voltar Inteligência Artificial Link da matéria
Gemini Omni 1.1 Flash, Geração de Vídeo, IA

Google Gemini Omni 1.1 Flash Otimiza Geração de Vídeo com Novos Controles

O Google lançou o Gemini Omni 1.1 Flash, uma atualização para desenvolvedores que aprimora o controle sobre a geração de vídeo por IA. A novidade permite estender cenas em até 40 segundos, definir quadros de início e fim para transições suaves, gerar vídeos em 4K e realizar prototipagem rápida com pré-visualizações em 360p, tornando a criação de vídeo mais flexível e econômica.

Redação USO IA Edição de Emerson Zanoti 📖 4 min 👁 12
Imagem gerada por IA · Gemini Omni 1.1 Flash, Geração de Vídeo, IA · Assunto apurado por: DeepMind Blog
Imagem gerada por IA · Gemini Omni 1.1 Flash, Geração de Vídeo, IA · Assunto apurado por: DeepMind Blog

O Google revelou o Gemini Omni 1.1 Flash, uma atualização robusta para sua ferramenta de geração de vídeo por inteligência artificial, que oferece aos desenvolvedores controles significativamente aprimorados. Essa novidade é crucial para profissionais e criadores que buscam maior precisão, consistência e eficiência na produção de conteúdo audiovisual utilizando IA.

O que muda na prática

  • Extensão de cenas: Agora é possível expandir vídeos existentes em incrementos de 10 segundos, chegando a um total de 40 segundos, com o modelo analisando até 10 segundos de contexto prévio para manter a consistência visual e narrativa.
  • Transições e movimentos de câmera suaves: O Omni 1.1 permite especificar quadros de início e fim para criar transições fluidas, movimentos de câmera complexos, como órbitas e zooms, e clipes em loop contínuos.
  • Prototipagem rápida e econômica: Pré-visualizações em resolução 360p podem ser geradas até 60% mais rápido e a um terço do custo, ideal para testar ideias e iterar rapidamente em storyboards.
  • Saída em alta resolução: Projetos finais podem ser aprimorados para resoluções de 1080p ou 4K, garantindo um acabamento profissional.
  • Referências de vídeo aprimoradas: É possível usar até três segundos de vídeo como referência na entrada multimodal, ajudando a manter a consistência visual de personagens e contextos.

Segundo o DeepMind Blog, o Gemini Omni 1.1 Flash representa uma suíte de controles criativos e capacidades de vídeo generativo projetada para apoiar desenvolvedores. A atualização torna o Omni 1.1 pronto para uso profissional através da API Gemini no Google AI Studio. As melhorias visam tornar a geração de vídeo mais controlável, rápida para iterar e polida para implementação no mundo real.

A capacidade de estender cenas é um dos destaques, permitindo que o modelo analise uma porção maior do vídeo anterior – até 10 segundos, um avanço significativo em relação aos modelos anteriores que consideravam apenas o último segundo. Conforme o The Decoder, essa análise aprofundada resulta em maior consistência visual e aderência narrativa, facilitando a construção de histórias mais longas ou a exploração de novas direções criativas.

Para transições e movimentos de câmera, o Omni 1.1 possibilita que os desenvolvedores especifiquem quadros-chave para criar vídeos contínuos entre eles. Isso é particularmente útil para movimentos complexos de câmera, como rotações orbitais ou transições de zoom, garantindo um resultado profissional e sem cortes abruptos.

A otimização de custo e tempo é outro ponto forte. O DeepMind Blog detalha que as pré-visualizações em 360p são geradas até 60% mais rápido e com um terço do custo em comparação com a resolução padrão de 720p do Omni 1.1. Esse "modo rascunho" é uma ferramenta valiosa para prototipagem rápida e iteração, permitindo que os criadores explorem diversas variações de forma eficiente.

A qualidade final também foi aprimorada, com a possibilidade de escalar projetos para resoluções de 1080p ou 4K, atendendo às demandas de produções profissionais. Além disso, o modelo agora suporta a adição de referências de vídeo em entradas multimodais, permitindo o uso de até três segundos de vídeo para manter o contexto visual e a consistência dos personagens.

Grandes players do mercado já estão utilizando o Gemini Omni Flash em produção. A Adobe, por exemplo, integrou o modelo ao Adobe Firefly, conforme destacado pelo DeepMind Blog. Itay Schiff, Diretor Criativo da Figma Weave, observou que o Gemini Omni Flash é um dos modelos de vídeo mais fortes disponíveis na plataforma, ajudando as equipes criativas a "dirigir" seus vídeos, e não apenas gerá-los. Louisa Guo, VP de Marketing da GMI Cloud, ressaltou a precisão do modelo, crucial para conteúdos educacionais e explicativos. Jamie Umpherson, Diretor Criativo da Runway, afirmou que o Omni Flash se encaixa naturalmente no fluxo de trabalho de seus usuários, permitindo que movam rapidamente entre ideias.

O Gemini Omni 1.1 Flash está sendo implementado em todo o ecossistema de desenvolvedores do Google, incluindo Google AI Studio e a Plataforma Gemini Enterprise Agent. Além disso, a funcionalidade de extensão de cena está disponível para todos os assinantes Google AI Plus, Pro e Ultra globalmente no aplicativo Gemini e o Omni 1.1 em si está disponível no Google Flow para esses assinantes. O material não especifica próximas atualizações ou um cronograma de lançamentos futuros, mas o foco em controles detalhados e otimização de custos sugere uma contínua evolução na direção de ferramentas de IA mais acessíveis e poderosas para a produção de vídeo.

Achou um erro nesta matéria? Avise a redação — corrigimos e registramos a data da correção.

Discussao

Comentarios

Troque ideia com outros leitores, responda em contexto e mantenha a conversa útil.

Carregando comentários...