O Google revelou o Gemini Omni, um modelo inovador que promete criar “qualquer coisa a partir de qualquer prompt”. O anúncio foi feito durante o evento Google I/O, destacando a evolução das tecnologias de inteligência artificial da empresa.
Demis Hassabis, CEO da DeepMind, explicou que o Omni combina as capacidades dos modelos Gemini, elevando o entendimento de conceitos complexos como gravidade e energia cinética. Essa inovação permite a geração de vídeos e simulações com uma nova profundidade de realismo.
Funcionalidades e Aplicações Práticas
Uma das características marcantes do Gemini Omni é sua habilidade de operar através de linguagem conversacional. Isso significa que os usuários podem interagir com a IA de forma natural, criando e ajustando conteúdos como se estivessem conversando com uma pessoa.
Além de criar novos conteúdos, o modelo também permite editar imagens existentes. Durante a demonstração, Hassabis mostrou como o Omni pode distorcer a realidade de um vídeo, oferecendo uma nova perspectiva sobre o que é possível com a edição digital.
O Gemini Omni Flash, a primeira versão disponível ao público, pode ser acessado através do aplicativo Gemini, YouTube Shorts e no modelo Flow. Essa acessibilidade promete democratizar o uso da tecnologia, permitindo que mais pessoas explorem suas capacidades criativas.
A próxima versão, chamada Omni Pro, foi anunciada, mas detalhes sobre seu lançamento ainda não foram divulgados. Essa expectativa gera curiosidade sobre as futuras inovações que o Google pode trazer ao mercado.
A introdução do Gemini Omni pode ter um impacto significativo em diversas áreas, desde a educação até o entretenimento. No Brasil, essa tecnologia pode transformar a maneira como criadores de conteúdo e educadores interagem com seus públicos, oferecendo novas formas de engajamento e aprendizado.











