Google lance Gemini Omni 1.1 Flash pour créer et modifier des vidéos
Le nouveau modèle prend en charge le texte, les images, l’audio et la vidéo, avec le contrôle des points de début et de fin ainsi que l’extension de scènes existantes
Google a officiellement lancé Gemini Omni 1.1 Flash le 27 août 2026 en disponibilité générale. Ce modèle multimodal est destiné à la génération et au montage vidéo par IA.
Sa fonction phare, Scene Extension, analyse jusqu’à 10 secondes du contexte vidéo précédent avant de générer la suite du contenu. Elle permet de mieux préserver l’ambiance et les éléments des séquences antérieures. Les utilisateurs peuvent également contrôler les premières et dernières images afin de définir la direction et la continuité des transitions.
Le modèle prend en charge des vidéos jusqu’en 4K. Il propose aussi un mode Draft en 360p pour tester des idées avant de produire un fichier de haute qualité, ce qui réduit les coûts lors des ajustements et des essais de prompts. Les entrées acceptées comprennent le texte, les images, l’audio et la vidéo, qui peuvent être combinés pour orienter le résultat.
Gemini Omni 1.1 Flash est accessible via Google AI Studio, Gemini Enterprise Agent Platform et Google Flow. Ce lancement montre que les outils vidéo par IA évoluent de la simple création de clips à partir de texte vers un contrôle plus précis des séquences et la modification de contenus existants. La qualité finale dépend toutefois du type de vidéo, des prompts et du processus de révision de l’utilisateur.
Les développeurs et producteurs de contenus thaïlandais disposent d’une option supplémentaire pour prototyper, prolonger des scènes et structurer le rythme des vidéos avec l’IA. Le mode 360p permet de tester un projet avant de générer un fichier 4K plus gourmand en ressources.