Gemini Omni 1.1 Flash : Google affine le contrôle vidéo IA
Google DeepMind a annoncé le 27 août 2026 le lancement de Gemini Omni 1.1 Flash, une mise à jour de son modèle vidéo génératif conçue pour offrir aux développeurs et aux créateurs un contrôle professionnel sans précédent. Disponible via l'API Gemini sur Google AI Studio et la plateforme Agent Platform Enterprise, cette version introduit des fonctionnalités visant à transformer la vidéo par intelligence artificielle en un outil fluide et adapté aux workflows de production. Les améliorations centrales portent sur la manipulation précise du contenu vidéo. Les développeurs peuvent désormais étendre des séquences de dix secondes en dix secondes, jusqu'à atteindre un total de quarante secondes, en s'appuyant sur une analyse contextuelle allant jusqu'à dix secondes pour garantir une cohérence visuelle et narrative. Le modèle permet également d'insérer des images de début et de fin pour générer des transitions continues, idéal pour les mouvements de caméra complexes ou les boucles parfaites. Pour accélérer le prototypage, une version de brouillon en résolution 360p est disponible, offrant un rendu jusqu'à soixante pour cent plus rapide et à un tiers du coût des sorties standards en 720p. À l'inverse, les productions finales peuvent être exportées en 1080p ou 4K grâce à un module de mise à l'échelle optimisé pour la haute définition. La version 1.1 Flash intègre aussi la possibilité d'incorporer jusqu'à trois secondes de référence vidéo dans les requêtes textuelles, permettant aux créateurs de préserver la consistance des personnages et des environnements tout en remplaçant des éléments visuels par de nouveaux sujets. Ces capacités placent le modèle au cœur des écosystèmes créatifs modernes. Des entreprises comme Adobe, Figma, Runway et GMI Cloud ont déjà commencé à intégrer Gemini Omni Flash dans leurs outils respectifs. Adobe l'utilise dans Firefly pour le montage, Figma Weave s'en sert pour la mise en scène collaborative, et Runway l'exploite pour accélérer les cycles d'idéation. GMI Cloud souligne sa fiabilité pour la création de contenu éducatif, où la précision technique est primordiale. Le déploiement s'effectue progressivement dans l'écosystème Google. Les développeurs peuvent tester et déployer la technologie dès maintenant via Google AI Studio et la documentation technique dédiée. Les abonnés aux formules Google AI Plus, Pro et Ultra bénéficient également d'un accès immédiat dans Google Flow et l'application Gemini, avec l'extension de scènes activée pour tous. Avec cette version, Google positionne son modèle multimodal comme une solution prête pour l'industrie, répondant aux exigences de rythme, de précision et de contrôle qui caractérisent la production audiovisuelle contemporaine.
