ActualitéIT, Data & IATechnologies

Gemini Omni 1.1 Flash : Google réduit fortement le coût de création de vidéos par IA

Gemini Omni 1.1 Flash arrive avec un objectif clair : rendre la génération de vidéos par IA moins coûteuse et plus facile à contrôler. Google annonce notamment des brouillons en 360p jusqu’à 60 % plus rapides, un coût réduit d’environ deux tiers face au 720p et une exportation finale possible en 4K. Le modèle améliore aussi la continuité des scènes et les mouvements de caméra.

Des vidéos prolongées jusqu’à 40 secondes

Gemini Omni 1.1 Flash peut analyser jusqu’à 10 secondes de contexte précédent avant de prolonger une séquence.

Les extensions s’effectuent par blocs successifs de 10 secondes, avec une durée cumulée pouvant atteindre 40 secondes.

Le gain est concret.

Les personnages, l’éclairage et la composition devraient rester plus cohérents d’une séquence à l’autre. Les versions précédentes ne prenaient en compte qu’environ une seconde de contexte.

Le modèle accepte aussi une vidéo de référence pouvant durer jusqu’à 3 secondes lors de la demande initiale.

Google améliore fortement le contrôle de la caméra

Le nouveau modèle permet de définir plus précisément les mouvements de caméra.

Les créateurs peuvent notamment demander des dolly zooms, des rotations orbitales ou des mouvements d’approche tout en conservant la perspective de la scène.

Il est également possible de fixer une image de départ et une image finale. L’IA génère alors les images intermédiaires afin d’obtenir une transition continue.

Pratique pour créer des rotations à 360 degrés, des visites virtuelles ou des mouvements complexes sans multiplier les coupes.

La génération en 360p coûte beaucoup moins cher

C’est probablement l’une des nouveautés les plus intéressantes pour les professionnels.

A lire :  Xiaomi et Apple utilisent désormais exactement la même IA : le cerveau de Gemini s’impose

Le mode brouillon en 360p serait jusqu’à 60 % plus rapide et coûterait environ deux tiers de moins que le 720p.

L’idée est simple : tester plusieurs cadrages, éclairages ou versions d’une scène à faible coût avant de lancer le rendu final.

Une fois le résultat validé, la vidéo peut être exportée en 1080p ou en 4K.

Cela évite de gaspiller des ressources sur des essais qui ne seront jamais utilisés.

Images et vidéos de référence peuvent être combinées

Gemini Omni 1.1 Flash accepte plusieurs types de contenus comme références.

Un créateur peut par exemple fournir une image fixe et une vidéo afin de transférer certains mouvements vers un personnage ou une scène générée.

Le modèle peut ainsi reproduire une action corporelle ou une trajectoire observée dans une vidéo de référence tout en conservant l’apparence d’une autre image.

Cette approche donne davantage de contrôle qu’une génération reposant uniquement sur une description textuelle.

Gemini Omni 1.1 Flash arrive dans plusieurs outils

Le modèle est accessible via l’API Gemini, Google AI Studio et la plateforme Gemini Enterprise Agent.

Google le propose également dans son environnement Flow pour certains abonnements professionnels.

Des services comme Adobe Firefly, Runway et Figma Weave ont aussi intégré ou pris en charge le modèle dans leurs outils créatifs.

L’objectif est clairement professionnel : produire plus de variantes, plus vite, sans lancer immédiatement un coûteux rendu haute définition.

Avec le 360p pour les essais, la continuité jusqu’à 40 secondes et la sortie en 4K, Gemini Omni 1.1 Flash cherche surtout à rendre la vidéo générative plus exploitable dans de vrais workflows de production.

Eric Thomas

Eric Thomas suit l’actualité de Windows, des logiciels, de la cybersécurité grand public et des outils web. Il s’intéresse aux mises à jour système, aux nouveautés informatiques et aux solutions pratiques qui améliorent l’expérience numérique au quotidien.

Voir tous les articles

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *