Le modèle Gemini 2.0 Flash Image de Google, connu ici sous le nom de Nano Banana 2, est plus rapide, moins cher et, selon notre collaborateur Brian de Litanie de l'allumage, « nettement meilleur sur les riblets ». On a demandé à Brian de le tester à fond sur OpenArt et de documenter ce qu'il a trouvé. Le résultat est un tutoriel de 12 minutes rempli d'astuces, de prompts et d'un nombre surprenant de visites chez Applebee's. Voici le décryptage complet.
NB2 vs Nano Banana Pro : le comparatif honnête

Derrière la banane se cache désormais un moteur de réflexion dynamique capable de raisonner sur des prompts complexes, de tirer de vraies informations du web plutôt que de les halluciner, et d'analyser les images en entrée pour maintenir la cohérence des personnages d'une génération à l'autre. C'est ce qui rend NB2 vraiment différent de son prédécesseur — pas seulement une amélioration de vitesse et de coût, mais une nouvelle catégorie de capacités.
Astuce 1 : Ne modifie pas depuis l'interface d'édition
Le premier conseil de Brian est aussi le plus immédiatement applicable : évite complètement l'interface d'édition. À la place, fais glisser ton image de base directement dans la fenêtre de référence visuelle et structure ton prompt comme ceci :
« Modifie l'image un selon le prompt. [Ta modification ici]. »
Sur OpenArt, cette approche donne à NB2 un accès direct à l'image et produit systématiquement des retouches plus nettes et plus précises. Brian recommande aussi de passer ta résolution en 4K avant de générer. Ce n'est pas la même chose qu'un upscaling, mais ça donne au modèle beaucoup plus d'espace en pixels pour travailler les détails fins comme le texte, les badges de nom ou les petits accessoires. Ça devient particulièrement important quand tu prompt quoi que ce soit avec un travail de détail complexe.
Astuce 2 : le prompt de fiche de personnage
C'était l'élément le plus demandé dans les commentaires. Brian a épinglé le prompt complet après la publication de la vidéo, et le voici :

Deux choses à garder en tête pour utiliser ce prompt. D'abord, tague toujours ton image de référence manuellement avec @image1 — le prompt ne fonctionnera pas sans ça. Ensuite, NB2 peut accepter jusqu'à cinq fiches de personnages taguées dans la même scène, ce que Brian met à l'épreuve plus loin dans la vidéo avec des résultats vraiment impressionnants. À noter que NB2 et Nano Banana Pro gèrent bien ce prompt, même si NB2 a l'avantage de prendre en charge davantage d'entrées de personnages simultanées.
Astuce 3 : Un ancrage dans le réel grâce à Google Search
This is where NB2 pulls most clearly ahead of its predecessor. The model can perform a web search when it determines it does not have enough information to complete a task, which opens up a genuinely new category of prompting. Brian tested this by photographing grocery store ingredients and asking NB2 to generate recipe infographics without telling it what the recipe should be. The model had to identify the ingredients from the photos, look up a relevant recipe, and render everything as a visual layout.
Pour le test de la lasagne, il a utilisé 12 images de référence distinctes. OpenArt en accepte jusqu'à 14.
Les résultats étaient globalement impressionnants, même si Brian avait quelques remarques :
« Beaucoup de résultats étaient un peu légers sur les quantités d'ingrédients, sous-entendant plus ou moins que je devais juste vider des boîtes ou des pots entiers dans les bols, tout empiler et savourer ma lasagne yolo. »
L'enseignement pratique, c'est que le prompting ancré sur le web fonctionne bien pour les tâches riches en références où tu veux que le modèle synthétise des infos issues de plusieurs sources. Il est nettement meilleur que NB Pro pour ce type de tâche, même si les résultats demandent parfois un peu d'interprétation.
Astuce 4 : génération de texte multilingue
NB2 arrive avec un rendu de texte multilingue amélioré, que Brian a testé en lui demandant de traduire son infographie sur le cheesecake en japonais. La traduction s'est affichée correctement, même si Brian reconnaît honnêtement les limites de sa capacité à en vérifier l'exactitude. Il a invité les personnes parlant japonais à donner leur avis dans les commentaires. Le verdict reste en suspens.
Astuce 5 : Le raisonnement spatial dans les retouches de scènes complexes
Brian brought NB2 to Times Square, photographically speaking, and asked it to remove all the LED billboards and signage from a rainy night shot. What makes this test genuinely interesting is the difficulty of what the model has to do: it must remove the signs, extrapolate what the buildings look like underneath them, and recalculate the lighting, since most of the illumination in a wet Times Square shot is reflected bounce light from those very signs. That is a significant amount of spatial and physical reasoning happening in a single generation.
Les résultats sont impressionnants, avec quelques imperfections attendues vers le centre de l'image. Brian a poursuivi ce test avec une série de modifications supplémentaires : suppression des piétons, passage à une journée ensoleillée, puis transformation de la scène en tempête de neige. Cette dernière a suffisamment bien fonctionné pour qu'il déclare pouvoir désormais générer du B-roll hivernal sans sortir de chez lui.
Astuce 6 : scènes multi-personnages avec jusqu'à cinq personnages cohérents
Le test le plus ambitieux de la vidéo. Brian a généré cinq fiches de personnages distinctes et les a toutes intégrées dans une même scène de restaurant Applebee's, en demandant des angles de caméra variés pendant que les personnages mangeaient des côtes levées. La plupart des personnages sont restés cohérents d'une génération à l'autre. La ménagère rétro a été la plus délicate, ce que Brian attribue à la sensibilité accrue de notre cerveau aux moindres incohérences dans les visages humains réalistes.
Quelques surprises ont émergé en chemin : le robot voulait absolument ressembler à Bender de Futurama malgré l'absence de tout prompt en ce sens, et certains rendus montraient des artefacts flottants de fiches de personnage. Mais le moment fort incontestable est arrivé quand NB2 a inventé des noms pour les cinq personnages sans qu'on le lui demande : Blonde Ambition, Steel Resolve, The Gentle Toad, Mew Pawsome, et Skull Rider. Le verdict de Brian : « Je retire toutes mes critiques. C'est le meilleur modèle d'imagerie de tous les temps. »
Référence rapide : quel modèle pour quoi

En résumé
NB2 est une évolution majeure par rapport à Nano Banana Pro, en particulier pour l'édition d'images, les prompts ancrés sur le web et la cohérence multi-personnages. Le moteur de réflexion sous-jacent lui permet de faire des choses que son prédécesseur ne pouvait tout simplement pas faire, et il les fait plus vite et à moindre coût. Ce n'est pas un outil parfait, mais il est vraiment puissant, et il est disponible sur OpenArt dès maintenant.
Le tutoriel de Brian mérite d'être regardé en entier. Une chose que les commentaires ont sans cesse saluée, c'est sa volonté de montrer là où le modèle produit des résultats inattendus ou imparfaits, et pas seulement les rendus soignés. Cette honnêteté te donne une idée bien plus réaliste de ce à quoi t'attendre quand tu t'y mets toi-même.