Gemini Omni : l'IA de Google pour modifier des vidéos à la voix
Google a lancé Gemini Omni, un outil IA multimodal permettant de modifier ou créer des vidéos en combinant images, sons et textes. Présenté lors de Google I/O 2026, il promet une édition vidéo par commande vocale naturelle.
« "D’emblée, nous avons conçu Gemini pour qu’il soit multimodal dès sa conception, et nous franchissons aujourd’hui une nouvelle étape", commente le groupe. » — Numerama
Que faut-il retenir ?
- Gemini Omni traite simultanément images, vidéos, sons et textes pour générer/modifier des vidéos HD.
- L'outil permet d'éditer des vidéos existantes ou d'en créer de nouvelles via commandes vocales/textuelles.
- Google a présenté Gemini Omni lors de sa conférence I/O le 19 mai 2026.
- Un premier modèle nommé Gemini Omni Flash est déployé, avec d'autres versions prévues ultérieurement.
Public concerné : développeurs, entreprises
Comment Gemini Omni simplifie-t-il l'édition vidéo ?
Gemini Omni permet de modifier des vidéos simplement en parlant à l'IA, sans maîtriser les logiciels de montage traditionnels. Il combine automatiquement différents médias (images, sons, textes) pour créer des vidéos cohérentes sur simple demande.
🔧 Outils mentionnés