- Google confirme que « Nano Banana » est l'alias de Gemini 2.5 Flash Image pour la génération et l'édition d'images.
- Montage conversationnel avec des personnages et des objets cohérents et des résultats cohérents.
- Disponible gratuitement dans l'application Gemini et pour les développeurs via l'API, AI Studio et Vertex AI.
- Renforts de sécurité avec SynthID et filtres pour contenus sensibles.
Ces derniers jours, le nom « Nano Banana » s'est répandu comme une traînée de poudre sur les forums et réseaux techniques grâce à ses performances lors de tests de retouche d'images par intelligence artificielle. Ce qui semblait un mystère a désormais un auteur : il s'agit de Google et de son nouveau moteur d'images intégré à Gemini.
La société confirme que Nano Banana est le nom commercial de Gemini 2.5 Flash Image , un système capable de générer et de retoucher des photographies en utilisant le langage naturel, en conservant le style, les caractères et les objets avec une cohérence qui était auparavant difficile à obtenir pour ces modèles.
Qu'est-ce que Nano Banana et qui se cache derrière ?
Lors de ses premières apparitions, le modèle figurait dans les classements LM Arena sous le surnom de « Nano Banana », suscitant spéculations et plaisanteries sur la banane, jusqu'à ce que Google l'intègre officiellement à Gemini. L'idée sous-jacente est claire : unifier la génération et la retouche d'images dans un flux de travail simple, interactif et rapide.
Google souligne que son approche repose sur la connaissance du monde de Gemini et sur des modèles d'IA avancés , ce qui permet de comprendre le contexte des instructions et d'appliquer des modifications plus précises que celles des générateurs purement visuels.

Édition conversationnelle : de l'invite à la mise au point
Le modèle fonctionne avec des commandes en langage naturel et vous permet d'interagir avec l'image : vous pouvez demander « rendez le ciel plus dramatique », « supprimez ce panneau » ou « changez la couleur de la voiture en rouge » et affiner le résultat par étapes successives sans repartir de zéro.
Cette interaction en plusieurs étapes réduit les frictions généralement rencontrées avec les outils traditionnels. Selon Google, il est possible de sélectionner des zones spécifiques pour ajuster la couleur, l'éclairage ou la texture, supprimer les éléments indésirables, remplacer les arrière-plans et ajouter des objets qui s'intègrent parfaitement tout en respectant les ombres et la perspective.
En plus des retouches de base, la plateforme comprend des instructions telles que « placer le même personnage dans une autre scène » ou « montrer le produit sous différents angles », préservant ainsi le sujet et son apparence avec une cohérence entre les modifications.
Cohérence, qualité et rapidité
L'une des avancées les plus remarquables est l'amélioration de la cohérence visuelle d'une édition à l'autre : les traits du visage, les mains, les animaux domestiques ou les objets restent stables avec moins de distorsion, un point qui, historiquement, posait problème aux modèles génératifs.
Le photoréalisme est amélioré grâce à un éclairage et des textures plus naturels, et Google affirme offrir des performances ultra-rapides qui accélèrent les cycles créatifs pour des tâches telles que les variantes de produits ou les scènes thématiques.
Lors des tests communautaires, le système a gravi les échelons de LM Arena pour l'édition d'images, se plaçant parmi les moteurs offrant la meilleure expérience utilisateur selon les évaluations des utilisateurs.
Principaux outils et cas d'utilisation
Gemini 2.5 Flash Image propose des fonctionnalités conçues aussi bien pour les utilisateurs occasionnels que pour les équipes créatives. Parmi ses atouts majeurs, on retrouve la possibilité de composer des images issues de sources multiples et de les intégrer dans un environnement harmonieux.
- Retouche contextuelle : ajustements de couleur, d'exposition, de texture ou de style sans perdre les éléments clés de l'original.
- Dépose et repose : effacez des objets, modifiez les arrière-plans ou ajoutez des éléments avec intégration de lumière et d'ombre.
- Composition et mélange : combiner deux photos en une seule scène et transférer motifs ou styles d'une image à l'autre.
- Édition multi-équipes : changements en chaîne (peindre les murs, ajouter des meubles, modifier la garde-robe) sans recommencer le processus.
En marketing, décoration, mode ou contenu pour les réseaux sociaux, cet outil permet de créer rapidement des variantes, de maintenir des ressources de marque cohérentes et de tester des idées visuelles sans recourir aux logiciels traditionnels.
Limites de sécurité et d'utilisation
Pour limiter les abus, Google applique des filtres qui bloquent les contenus violents ou à caractère sexuel explicite et restreignent la modification des photos de personnes réelles ou de personnalités publiques. L'objectif est de réduire les risques de désinformation et de deepfakes.
Toutes les images générées ou modifiées intègrent SynthID , un filigrane numérique imperceptible au sein même du fichier, permettant de vérifier son origine. L'entreprise mentionne également d'autres indicateurs et des contrôles proactifs pour renforcer la traçabilité.
La politique d'utilisation interdit expressément la création de contenu intime sans consentement et d'autres catégories sensibles, renforçant ainsi l'accent mis sur une IA responsable dans les services de Gemini.
Comment utiliser Nano Banana dans l'application Gemini
L'accès est simple : aucune installation supplémentaire ni modèle spécifique ne sont nécessaires. Ouvrez Gemini, importez une photo et décrivez les modifications . Si vous souhaitez conserver tous les éléments sauf un, commencez par « Sur la photo originale… » pour préciser que le reste doit être préservé.
Quelques exemples utiles : « convertir en noir et blanc », « supprimer le poteau d’angle », « ajouter un chien sur le banc » ou « changer la robe en verte ». Le système tente de conserver les traits et les proportions du sujet lors de l’application de la modification.
Vous pouvez également télécharger deux photos et demander que le contenu de l'une apparaisse dans l'autre, ou que le style d'un motif (par exemple, des ailes de papillon) soit transféré sur un vêtement ou un objet de la seconde image.
Disponibilité et accès pour les développeurs
Cette fonctionnalité est disponible dans l' application Gemini pour le grand public. Pour les intégrations professionnelles, elle est accessible via l'API Gemini, Google AI Studio et Vertex AI, ouvrant ainsi la voie aux flux de travail en entreprise et dans les applications tierces.
L'utilisation au sein de l'application est gratuite avec des limites raisonnables. Pour les développeurs, Google propose une tarification à l'usage ; un coût de 30 $ par million de jetons est mentionné à titre indicatif dans l'API, les estimations approximatives situant le coût de chaque image à quelques centimes, selon le cas d'utilisation.
Contexte concurrentiel
Cette initiative vise directement des concurrents comme Midjourney et DALL·E (OpenAI). La stratégie de Google repose sur l'édition conversationnelle et la cohérence des résultats, grâce à la compréhension contextuelle de Gemini.
Avec l'intégration de la marque Nano Banana à son écosystème, l'entreprise tente de combler le fossé dans un domaine où la rapidité, la qualité et le contrôle sont essentiels pour l'utilisateur final.
Questions fréquentes
Nano Banana est-elle une application autonome ?
Non. C'est un modèle interne à Gemini , il est donc utilisé depuis l'interface propre à l'application.
Y a-t-il un coût pour les utilisateurs finaux ?
L'application Gemini est gratuite , mais soumise à des limites d'utilisation. L'intégration de l'API est payante.
Dois-je sélectionner le modèle manuellement ?
Non. La sélection est automatique lorsque vous effectuez des fonctions de génération ou d'édition d'images dans Gemini.
Avec un accent mis sur le montage conversationnel, la cohérence du sujet entre les prises de vue et des mesures de sécurité intégrées, Nano Banana (Gemini 2.5 Flash Image) s'annonce comme une option solide pour la création et la retouche d'images, aussi bien dans la vie quotidienne que dans les projets professionnels, que ce soit à partir de l'application Gemini ou via ses API.
