Sortie 4K native
Produisez directement en 4K au lieu d’agrandir ensuite une image plus petite.
Générez des images 4K de qualité studio avec Nano Banana Pro, en combinant plusieurs références tout en préservant la cohérence des personnages, produits et textes.
Ouvrez cette page sur un navigateur de bureau pour commencer à créer.
Nano Banana Pro est le modèle d’image phare de Google, conçu pour livrer des images qui résistent à l’examen professionnel plutôt que simplement impressionner au premier regard.
Au lieu de réinterpréter le descriptif à chaque essai, le modèle maintient ce que vous avez fixé. Les visages restent identiques dans une série, les produits conservent leur forme exacte et les mots écrits apparaissent comme des mots, pas comme une texture évoquant des lettres. Une génération peut utiliser plusieurs références simultanément et préserver plusieurs personnes reconnaissables dans la même scène.
Utilisez Nano Banana Pro lorsque l’image doit être livrée. Créez des visuels clés de campagne, maquettes d’emballage, séries de personnages, schémas annotés, images éditoriales et visuels principaux prêts à imprimer, avec la cohérence exigée par une échéance de production.

Nano Banana Pro est un modèle de génération d’images par IA développé par Google DeepMind et publié sous le nom Gemini 3 Pro Image. Il crée et retouche des images en suivant des instructions détaillées sur les sujets, la composition, l’éclairage, la caméra, la typographie et le rôle des références fournies.
Le modèle repose sur trois atouts majeurs :
Nano Banana Pro génère nativement en 1K, 2K et 4K. Il combine plusieurs images en une passe et préserve plusieurs sujets dans une scène ; des évaluations tierces situent sa précision de rendu du texte autour de 94 pour cent.

Produisez directement en 4K au lieu d’agrandir ensuite une image plus petite.
Combinez sujets, produits, environnements et styles de plusieurs sources en une génération.
Préservez l’identité de plusieurs personnes dans une même scène.
Formats carré, vertical, paysage ou large à partir du même descriptif écrit.
Rendez lisibles titres, étiquettes et longs passages, y compris dans des mises en page multilingues.
Ajustez une zone, l’éclairage, la mise au point ou la position de caméra sans régénérer l’image.

La typographie apparaît comme du langage, pas une décoration, et tient dans les affiches, emballages, maquettes d’interface et enseignes. Les longs passages et mises en page multilingues sont pris en charge, évitant de générer une composition vierge puis d’y ajouter le texte à la main.

Combinez plusieurs images dans un descriptif et donnez un rôle à chacune. Une référence définit un visage, une autre un vêtement, une autre un environnement ou une direction lumineuse : le modèle les reprend toutes au lieu d’en moyenner les influences.

Gardez plusieurs personnes reconnaissables dans une scène et au fil des générations. Les séries de campagne deviennent ainsi possibles lorsque les mêmes personnes doivent figurer dans six scénarios sans devenir six individus différents.

Modifiez une zone, rééclairez la scène, déplacez la mise au point ou la caméra par instructions écrites. Les parties non mentionnées restent en l’état, sans masquage ni sélection.

Détails fins, petits caractères et textures tiennent en 4K car l’image est rendue à cette taille plutôt qu’agrandie ensuite.

Les légendes étant lisibles, graphiques, coupes annotées et schémas explicatifs deviennent accessibles, contrairement à la plupart des modèles d’image.
Ce modèle demande davantage qu’un champ de prompt ne peut contenir. Il faut réunir et identifier des références. Un visage doit résister à six générations, pas une. Un titre doit être relu en taille réelle avant validation. Virse offre un espace à ce travail. Références, versions et images finales restent ensemble sur un même canevas : un ensemble construit en un après-midi reste un ensemble, pas un dossier d’exports sans lien.
Réunissez une fois les visages, produits et planches de style, puis utilisez ces mêmes entrées pour toute la campagne au lieu de les réimporter chaque fois.

Ouvrez le rendu en taille réelle sur le canevas et lisez-y le titre, au lieu de découvrir un caractère cassé après export.

Passez de Nano Banana Pro à plus de 30 autres modèles d’image et de vidéo sans quitter le canevas ni réécrire le descriptif.

Transmettez une image 4K finalisée directement à Seedance 2.0, Kling 3.0 ou Veo 3.1 comme plan d’ouverture ou de clôture.


Créez des visuels principaux à la typographie de marque, aux personnes cohérentes et à la résolution prête à imprimer.

Placez des noms, descriptions et volumes de produits exacts sur des emballages plausibles en une seule passe.

Générez la même personne dans plusieurs scènes, tenues et angles de caméra sans dérive.

Composez l’image et son titre ensemble plutôt que de superposer l’un à l’autre.

Produisez des coupes, graphiques et schémas explicatifs aux légendes correctes.

Rééclairez, recomposez ou changez le style d’une photo existante en préservant exactement le sujet.
Importez les photographies, portraits, images de produits ou planches de style sur lesquels le modèle doit s’appuyer.
Précisez ce que le modèle doit tirer de chaque image : le visage de l’une, la palette de l’autre.
Décrivez le sujet, le décor et la lumière, puis saisissez les mots exacts à faire apparaître dans le cadre.
Choisissez 2K pour les écrans et présentations, 4K pour les grandes impressions ou les recadrages.
Un prompt Nano Banana Pro utile comprend généralement six éléments :
Au lieu d’écrire
Une photo professionnelle de sachet de café, haute qualité, 8k, primée.
Écrivez
Un sachet de café noir mat debout sur du béton pâle, vu de trois quarts légèrement en plongée. Lumière douce de fenêtre à gauche avec une ombre visible vers la droite. L’étiquette porte BLACKWOOD ROASTERS dans une police sans empattement condensée, puis « Single Origin — Ethiopia » en plus petit. Faible profondeur de champ, arrière-plan flou. Reprenez la forme du sachet de l’image 1 et la palette de l’image 2.
À partir de la personne de l’image 1, générez un portrait de studio sur fond gris moyen sans raccord. Lumière principale à 45 degrés à gauche de la caméra et remplissage doux à droite. Le sujet regarde directement la caméra, avec une expression neutre. Préservez sans modification les traits, les cheveux et les détails de peau de la référence. Changez uniquement la lumière, le fond et le cadrage. Prise de vue à 85mm, cadrée à la taille, faible profondeur de champ.
Un flacon cylindrique de soin en verre dépoli avec un bouchon en aluminium brossé, centré sur une surface de grès chaud. L’étiquette avant porte AURELIA au milieu dans une police à empattements espacée, puis « Hydrating Serum · 30ml » en petites capitales dessous. Lumière zénithale diffuse, ombre douce juste sous le flacon, palette sable et crème assourdie partout. Composition carrée avec beaucoup d’espace au-dessus du flacon pour ajouter du texte ensuite.
Un schéma en coupe épuré d’un mouvement de montre mécanique sur fond blanc. Identifiez cinq composants avec de fins traits de rappel et des textes courts : mainspring, balance wheel, escapement, gear train, rotor. Utilisez une seule couleur d’accent pour les traits et une même petite police sans empattement, de taille constante, pour toutes les légendes. Style vectoriel à plat sans ombrage ni texture.
| Critère | Nano Banana 2 | Nano Banana Pro |
|---|---|---|
| Niveaux de résolution | 0.5K, 1K, 2K, 4K | 1K, 2K, 4K |
| Images de référence | Gère bien une référence unique | Combine plusieurs sources en une génération |
| Cohérence d’identité | Bon pour les sujets uniques | Préserve plusieurs sujets dans une série |
| Rendu du texte | Exploitable pour les textes courts | Longs passages et mises en page multilingues, environ 94 % de précision |
| Contrôle des retouches | Ajustement par prompt | Retouches localisées, rééclairage, transformations de mise au point et de caméra |
| Particulièrement adapté à | Travail en volume et exploration | Visuels finaux, impression et travail destiné aux clients |
Saisissez les mots exacts à afficher. Décrire la présence de texte sans le fournir produit du remplissage.
Préciser l’apport de chaque image donne un autre résultat que d’en importer plusieurs en espérant. Le modèle suit le rôle attribué lorsqu’il est explicite.
Avec plusieurs personnes dans le cadre, placez chacune selon sa référence : « la femme de l’image 1 à gauche, l’homme de l’image 2 derrière elle ». L’identité tient bien mieux lorsque le modèle sait qui va où.
Si un détail est faux, réimportez le résultat et ne nommez que ce détail. Une retouche localisée protège tout ce qui est validé ; un prompt réécrit régénère toute l’image.
Réunissez vos références, votre descriptif et vos essais précédents sur un seul canevas, puis confiez à Nano Banana Pro la passe qui doit être réussie. Combinez plusieurs sources, préservez personnages et typographie et exportez en 4K dans le même espace de travail.