No dia 19 de maio de 2026, durante o Google I/O realizado em Mountain View, na Califórnia, o Google anunciou o Gemini Omni Flash como modelo multimodal capaz de gerar e editar vídeos a partir de comandos em linguagem natural. Se o anúncio promete transformar a edição de vídeos em uma conversa simples, então é preciso verificar exatamente quais recursos estão confirmados nas fontes oficiais e quais ainda dependem de versões futuras.

O que o Gemini Omni Flash realmente oferece hoje

O Gemini Omni Flash combina imagens, áudio, vídeo e texto em um único fluxo de trabalho, permitindo que o usuário modifique cenas, mantenha consistência de personagens em sequências e remova objetos indesejados preenchendo automaticamente o espaço. Segundo a página oficial do Gemini, o modelo substitui o Veo 3.1 no app do Gemini e integra inteligência central do Gemini com recursos avançados de mídia generativa, o que significa que prompts como “Mude o cenário de fundo para um pôr do sol na praia” ou “Altere a roupa do personagem para um traje espacial” já podem ser executados diretamente no aplicativo.

Se o usuário for assinante Google AI Plus, Pro ou Ultra, então o acesso está disponível mundialmente no app Gemini e no Google Flow; caso contrário, a funcionalidade aparece de forma gratuita no YouTube Shorts e no YouTube Create nesta mesma semana do anúncio. Todo conteúdo gerado recebe a marca SynthID, conforme confirmado em todas as fontes consultadas, garantindo rastreabilidade obrigatória.

Integrações com Workspace e diferenças em relação ao Veo 3

Enquanto o Gemini Omni Flash foca na criação e edição generativa de vídeos dentro do app Gemini, do Google Flow e no YouTube, ferramentas como o Google Pics e o Google Vids atuam diretamente integradas ao Google Docs, Slides e Workspace para fluxos de trabalho corporativos e de design. Diferente do Veo 3.1, que era focado em geração, o Omni é multimodal nativo, permitindo edição conversacional sem necessidade de alternar entre ferramentas separadas.

Além disso, o anúncio incluiu menções ao Gemini Spark como agente pessoal 24 horas conectado a Gmail, Docs e Slides, e ao Gemini 3.5 disponível em múltiplas plataformas, incluindo API e ambientes empresariais. Se essas integrações se confirmarem na prática, então o impacto se estenderá além da criação de conteúdo para fluxos corporativos completos.

Próximos passos anunciados e limitações ainda por esclarecer

A versão do Gemini 3.5 Pro está prevista para o mês seguinte ao evento, conforme informado no comunicado, enquanto modelos mais avançados da própria linha Gemini Omni estão planejados para o futuro, mas ainda não há data exata ou detalhes sobre limites de resolução, duração máxima dos vídeos ou custos adicionais para uso intensivo. Para entender melhor o contexto de evolução dessa tecnologia, vale conferir a cobertura interna do portal sobre o mesmo tema.