Générateur de vidéos par IA Gemini Omni Flash

Le modèle vidéo nativement multimodal de Google accepte texte, images, vidéo et audio, et propose dans Virse des entrées guidées par images clés ou par références.

Ouvrez cette page sur un navigateur de bureau pour commencer à créer.

Le terme Omni désigne les entrées

Gemini Omni Flash est le modèle vidéo rapide de Google, annoncé en juin 2026. Pour le comprendre, il faut regarder ce qu’il accepte en entrée.

La plupart des modèles vidéo prennent une image et un paragraphe. Celui-ci est nativement multimodal : texte, images, vidéo et audio passent par une même interface plutôt que par des adaptateurs distincts ajoutés après coup. C’est une propriété architecturale, pas une liste de fonctions, qui se manifeste dans la cohérence avec laquelle il concilie des entrées divergentes. Google l’a aussi conçu pour l’affinement conversationnel : on ajuste un clip en poursuivant l’échange plutôt qu’en réécrivant le descriptif.

Utilisez Gemini Omni Flash lorsque vos entrées sont variées et que votre chaîne d’image repose déjà sur Google. Animez des images Nano Banana ou Gemini, guidez les plans par des références et améliorez un clip en lui répondant.

The Omni in the Name Is the Input Side

Qu’est-ce que Gemini Omni Flash ?

Gemini Omni Flash est un modèle de génération vidéo par IA développé par Google DeepMind, dans la gamme Gemini Flash qui privilégie la rapidité de réponse. Il a été annoncé en juin 2026 comme une option économique de génération et de montage vidéo conversationnel.

Le modèle repose sur trois atouts majeurs :

  • Une multimodalité native acceptant texte, images, vidéo et audio
  • Un affinement conversationnel pour ajuster un clip par des instructions successives
  • Une provenance SynthID intégrée à chaque résultat

Virse propose deux entrées. Gemini Omni Flash accepte une première image, une dernière image ou les deux, avec un descriptif écrit. Gemini Omni Flash Reference utilise plutôt des images d’exemple fournies. L’entrée proposée dans Virse est la configuration 720P, qui produit un audio natif à chaque génération : les instructions audio ne font donc pas partie du descriptif ici.

What Is Gemini Omni Flash?

Caractéristiques de Gemini Omni Flash en un coup d’œil

Nativement multimodal

Texte, images, vidéo et audio acceptés dans une seule interface.

Deux entrées

Guidage par images clés et par références, proposés séparément dans Virse.

720P Output

Sortie 720P

La taille proposée dans Virse. L’audio est généré nativement avec l’image.

Vitesse de la gamme Flash

Un modèle de la gamme Flash, dont la vitesse compte encore plus en vidéo qu’en image fixe.

Affinement conversationnel

Ajustez un résultat en poursuivant l’instruction plutôt qu’en la réécrivant.

Provenance SynthID

Un signal imperceptible intégré à chaque clip généré.

Fonctionnalités clés du générateur de vidéos par IA Gemini Omni Flash

Two Entries

Une interface pour tous les types d’entrée

La multimodalité native signifie que texte, images, vidéo et audio sont traités par le même modèle plutôt que par des encodeurs distincts. Des entrées qui entreraient en conflit dans un système assemblé sont ici conciliées.

Refinement by Conversation

Une entrée par références absente du modèle phare

Veo 3.1, le modèle vidéo plus lourd de Google, est guidé par images clés. Gemini Omni Flash ajoute un parcours par images de référence, seul moyen d’obtenir ce type de contrôle de continuité dans la famille Google.

Refinement by Conversation

Affinement par la conversation

Plutôt que de réécrire un descriptif pour corriger un détail, le modèle permet des ajustements itératifs : le premier résultat est conçu comme un point de départ.

Speed as the Design Target

La vitesse comme objectif de conception

La gamme Flash privilégie la rapidité. En vidéo, où une génération lente brise entièrement la concentration, cela compte encore davantage qu’en image fixe.

Refinement by Conversation

Cohérence avec les modèles d’image Google

Les images de Nano Banana Pro, Nano Banana 2 ou Gemini 2.5 Flash Image proviennent de la même famille, ce qui préserve le caractère visuel lors du passage au mouvement.

Speed as the Design Target

Une provenance sans configuration

SynthID s’intègre automatiquement à chaque clip et l’identifie comme généré par IA, sans marque visible ni option à activer.

Créez avec Gemini Omni Flash dans Virse

Rester dans une même famille de modèles tout au long du processus semble une préférence, jusqu’au jour où changer de fournisseur en cours de projet vous coûte un après-midi à comprendre pourquoi la version animée diffère de l’image fixe. Virse facilite le parcours au sein d’une même famille. Une image créée par un modèle d’image Google sur le canevas passe directement à Gemini Omni Flash sans export : la transition du fixe au mouvement se fait sur place.

Animez l’image que vous venez de générer

Envoyez une image Nano Banana ou Gemini directement au modèle vidéo sur le même canevas.

Provenance Without Configuration

Gardez le fil des itérations visible

Chaque affinement reste près de la version dont il provient : le parcours conversationnel peut ainsi être revu après coup.

Animate the Still You Just Generated

Accédez à plus de 30 modèles créatifs

Passez de Gemini Omni Flash à plus de 30 autres modèles d’image et de vidéo sans quitter le canevas ni réécrire le descriptif.

Keep the Iteration Thread Visible

Comparez avec l’option plus lourde

Testez la même image avec Veo 3.1 juste à côté pour savoir si sa lourdeur supplémentaire en vaut la peine.

Compare Against the Heavier Option

Que pouvez-vous créer avec Gemini Omni Flash ?

Animated Stills

Images fixes animées

Du mouvement ajouté aux images générées ailleurs dans la famille Google.

Reference-Driven Clips

Clips guidés par références

Plans dont le sujet est défini par des exemples visuels plutôt que décrit.

Short Social Video

Vidéos sociales courtes

Clips rapides où le délai compte davantage que la résolution.

Product Motion

Produits en mouvement

Révélations et rotations simples à partir d’une image d’ouverture définie.

Concept Previz

Prévisualisation de concepts

Référence animée d’une idée de plan avant tout engagement.

Iterative Sequences

Séquences itératives

Clips affinés en plusieurs passes plutôt que parfaitement spécifiés d’avance.

Comment utiliser Gemini Omni Flash dans Virse

  1. Choisissez l’entrée adaptée

    Avec des images clés, utilisez l’entrée standard. Pour maintenir un sujet entre plusieurs clips, utilisez Reference.

  2. Chargez vos données

    Ajoutez les compositions ou l’ensemble d’exemples, en précisant le rôle de chaque image.

  3. Décrivez ce qui se passe

    Décrivez les mouvements de la scène, le comportement de caméra et le rythme. L’audio est rendu avec l’image : les indications de dialogue et d’ambiance méritent donc d’être incluses.

  4. Affinez au lieu de recommencer

    Ajustez le résultat avec une instruction de suivi plutôt que de réécrire le descriptif initial.

Comment rédiger un prompt Gemini Omni Flash

Un prompt Gemini Omni Flash utile comprend généralement quatre éléments :

  • État initial
  • Ce qui bouge
  • Caméra
  • État final

Au lieu d’écrire

Une personne ouvre une fenêtre, joli mouvement naturel, cinématographique.

Écrivez

Une personne se tient devant une fenêtre à guillotine, les deux mains sur le cadre inférieur, vue de dos à hauteur de taille. Elle pousse la fenêtre vers le haut d’un geste fluide jusqu’à ouverture complète, puis baisse les mains. La caméra reste fixe, sans rapprochement ni travelling. Terminez avec la fenêtre ouverte et les bras le long du corps.

Exemples de prompts Gemini Omni Flash

gemini-omni-flash-prompt-examples-tea-curtain-19.jpg

D’une image clé à l’autre

Commencez sur l’image 1 : une tasse de thé sur un rebord de fenêtre, vapeur montante, rideau immobile. Une brise soulève le rideau par la droite pendant la première moitié du clip, puis il retombe. La vapeur monte sans interruption. La caméra tient un gros plan fixe, sans mouvement ni coupe. Terminez sur l’image 2 : rideau retombé, tasse inchangée.

Reference-Driven Continuity

Continuité guidée par références

Utilisez la personne de l’image 1, le tablier de l’image 2 et le comptoir de boulangerie de l’image 3. Il pose un plateau de pains sur le comptoir, se redresse et s’essuie les mains sur le tablier. Plan moyen fixe depuis le côté client du comptoir, caméra immobile. Préservez exactement son visage, ses cheveux ainsi que la couleur et la coupe du tablier. Terminez avec ses mains le long du corps.

Simple Camera Move

Mouvement de caméra simple

Un vélo appuyé contre un mur de briques peintes, vu de face. Rien ne bouge dans la scène. La caméra effectue un travelling lent vers la gauche à vitesse constante, garde le vélo dans le cadre et dévoile une entrée à sa droite. Lumière homogène de ciel couvert tout au long du plan. Terminez avec le vélo au bord droit et l’entrée au centre.

Gemini Omni Flash face à Veo 3.1

CritèreGemini Omni FlashVeo 3.1
Types d’entréeTexte, images, vidéo et audioTexte et images clés
Entrée par référencesOui, proposée séparémentNon
Sortie dans Virse720P, sans son720p à 4K, audio facultatif
Objectif de conceptionRapidité de réponsePlafond de sortie
Construction de séquencesAffinement conversationnelExtension de scène
À choisir lorsqueLes entrées sont variées ou un sujet doit persisterLe projet exige de la durée, de l’audio ou de la 4K

Conseils pour de meilleurs résultats avec Gemini Omni Flash

Une action délimitée par clip

Donnez au mouvement un début et une fin clairs plutôt qu’une description ouverte.

Précisez le rôle des références

Dans l’entrée Reference, précisez quelle image fournit le sujet et laquelle fournit le décor.

Restez dans la même famille pour les images clés

Les images Nano Banana ou Gemini 2.5 Flash Image passent à ce modèle sans changement de caractère visuel.

Affinez sans réécrire

Le modèle est conçu pour les instructions de suivi. Réécrire tout le descriptif fait perdre ce qui fonctionnait déjà.

FAQ Gemini Omni Flash

Qu’est-ce que Gemini Omni Flash ?
Gemini Omni Flash est le modèle vidéo nativement multimodal de Google DeepMind, annoncé en juin 2026 pour une génération rapide et un montage conversationnel. Il accepte texte, images, vidéo et audio.
Que signifie ici « nativement multimodal » ?
Cela signifie que texte, images, vidéo et audio sont traités par un seul modèle dans une même interface, plutôt que par des composants distincts assemblés. Les entrées sont conciliées au lieu d’être traitées séparément.
Gemini Omni Flash est-il gratuit et combien coûte-t-il ?
Gemini Omni Flash est disponible dans les offres payantes de Virse. La génération est facturée à la seconde sur une allocation mensuelle de crédits ; les offres supérieures la rendent illimitée dans le cadre d’un usage raisonnable. Les tarifs actuels figurent sur la page des tarifs de Virse.
Gemini Omni Flash génère-t-il de l’audio ?
Oui. Gemini Omni Flash génère un audio natif avec l’image, et l’entrée proposée dans Virse le produit à chaque génération : aucune configuration silencieuse n’est proposée.
Qu’est-ce que Gemini Omni Flash Reference ?
Une entrée distincte qui accepte des images de référence plutôt que des images clés, pour les projets où un sujet doit rester reconnaissable dans plusieurs clips.
En quoi diffère-t-il de Veo 3.1 ?
Veo 3.1 atteint la 4K, génère de l’audio et allonge les séquences par prolongement de scène. Gemini Omni Flash est plus rapide, accepte davantage de types d’entrée et propose une entrée par références absente de Veo 3.1.
Ajoute-t-il un filigrane ?
Il intègre SynthID, un signal de provenance imperceptible. Aucune marque n’apparaît sur l’image visible.
Comment utiliser Gemini Omni Flash dans Virse ?
Sélectionnez l’une des entrées, fournissez des images clés ou de référence, décrivez le mouvement et générez.

La même famille, de l’image au mouvement

Animez les images déjà produites par vos modèles Google ou guidez le plan à partir de références, dans les deux cas sans quitter le canevas.