Brief IA : Gemini Omni 1.1 Flash : plus de contrôle pour la vidéo générative

Gemini Omni 1.1 Flash : plus de contrôle pour la vidéo générative

Brief IA
Tom Levy·3 min·3 vues

Gemini Omni 1.1 Flash permet d'étendre des scènes jusqu'à 40 secondes avec une meilleure cohérence visuelle et propose des transitions entre images clés ainsi que des rendus en 4K pour les développeurs. Ce modèle est déjà intégré dans Adobe Firefly et utilisé dans Figma Weave et GMI Cloud, marquant une avancée significative dans le contrôle et la production vidéo générative.

En bref
1Gemini Omni 1.1 Flash permet d’étendre des scènes jusqu’à 40 secondes avec une meilleure cohérence visuelle
2Les transitions entre images clés et les rendus en 4K sont désormais accessibles aux développeurs
3Le modèle est déjà intégré dans Adobe Firefly et utilisé dans Figma Weave et GMI Cloud
💡Pourquoi c'est importantCette mise à jour marque l’arrivée de fonctionnalités avancées de contrôle et de production vidéo générative, déjà adoptées par des acteurs majeurs du secteur.
Le brief IA que lisent les pros

La recherche en IA te passionne ?

Les papers et avancées qui comptent, expliqués simplement, chaque soir. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

La mise à jour Gemini Omni 1.1 Flash met l’accent sur la maîtrise des plans et la qualité de sortie, tout en accélérant les itérations peu coûteuses. Des intégrations chez Adobe et dans Figma Weave, ainsi que des usages via l’API Agent, attestent d’un déploiement en conditions réelles. Le modèle est accessible via Google AI Studio et la plateforme Gemini Enterprise Agent.

Des usages en production et des intégrations affichées

Des clients utilisent déjà Gemini Omni Flash pour des productions via l’API de la plateforme Agent. Adobe a intégré le modèle dans Adobe Firefly, avec une vidéo illustrant ses capacités d’édition vidéo. Itay Schiff, directeur créatif de Figma Weave, considère Gemini Omni Flash comme l’un des modèles vidéo les plus puissants disponibles dans l’outil, et décrit un canevas permettant d’attacher des références, de ramifier des versions et de façonner des résultats uniques. GMI Cloud met en avant la précision du modèle, jugée essentielle pour la création de contenus éducatifs et explicatifs, car les détails générés résistent à l’examen.

Transitions pilotées par images clés et boucles continues

Omni 1.1 offre la possibilité de définir une image initiale et une image finale pour un plan. Le modèle crée ensuite une animation fluide reliant ces images clés, adaptée aux mouvements complexes de caméra, aux effets de zoom progressifs ou à la création de boucles vidéo sans rupture.

Allonger un plan jusqu’à 40 secondes avec contexte étendu

L’extension de scènes permet de prendre une vidéo existante et de poursuivre la génération de séquences de manière transparente. Le modèle peut analyser jusqu’à 10 secondes de contexte précédent, alors que les versions antérieures ne prenaient en compte qu’une seconde. Les séquences peuvent être étendues par incréments de 10 secondes, jusqu’à une durée totale de 40 secondes, avec une cohérence visuelle et un récit améliorés.

Itérer en 360p à moindre coût, livrer en 1080p ou 4K

Les rendus de prévisualisation en 360p peuvent être produits jusqu’à 60 % plus vite et pour un tiers du prix par rapport à la 720p standard. Cette fonctionnalité s’avère pertinente pour tester rapidement, ajuster un storyboard ou accélérer le rendu sur des outils de développement. Pour la livraison finale, Omni 1.1 permet de produire des sorties en 1080p ou en 4K, prêtes pour une production professionnelle.

Accès développeur et scénarios d’usage proposés

Le modèle est accessible via Google AI Studio et la plateforme Gemini Enterprise Agent, dans une version annoncée comme prête pour la production et axée sur un contrôle accru. Les fonctionnalités incluent l’extension de scènes, la définition d’images clés et la génération en 4K. Plusieurs scénarios sont suggérés : une application permettant de générer une transition entre une première et une dernière image à l’aide de préréglages ou d’une saisie libre, en s’appuyant sur le raisonnement contextuel du modèle ; une application qui déplace la caméra à travers différentes pièces d’une maison sans ajouter d’éléments inexistants ; et un concept de Draft Room pour produire 3 à 4 variantes de brouillons en 360p, en faisant varier un paramètre à la fois et en comparant les résultats côte à côte.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires