Nano Banana: cos'è e come funziona il modello di Google

Ultimo aggiornamento: 28 agosto 2025
  • Google conferma che "Nano Banana" è l'alias di Gemini 2.5 Flash Image per la generazione e la modifica delle immagini.
  • Editing conversazionale con personaggi e oggetti coerenti e risultati coerenti.
  • Disponibile gratuitamente nell'app Gemini e per gli sviluppatori tramite API, AI Studio e Vertex AI.
  • Rinforzi di sicurezza con SynthID e filtri per contenuti sensibili.

Modello di intelligenza artificiale per l'editing e la generazione di immagini

Negli ultimi giorni, il nome "Nano Banana" si è diffuso a macchia d'olio nei forum e nelle reti tecniche grazie alle sue prestazioni nei test di fotoritocco basati sull'intelligenza artificiale. Quello che sembrava un mistero ora ha un autore: dietro a tutto ciò c'è Google e il suo nuovo motore di elaborazione delle immagini integrato in Gemini.

L'azienda conferma che Nano Banana è lo pseudonimo di Gemini 2.5 Flash Image , un sistema in grado di generare e ritoccare fotografie utilizzando il linguaggio naturale, mantenendo stile, caratteri e oggetti con una coerenza che in precedenza era difficile da raggiungere per questi modelli.

Cos'è Nano Banana e chi c'è dietro?

Durante le sue prime apparizioni, il modello è stato inserito nelle classifiche di LM Arena con il soprannome di "Nano Banana", scatenando speculazioni e battute sulle "banane", finché Google non lo ha ufficialmente introdotto come parte di Gemini. L'idea di fondo è chiara: unificare la generazione e l'editing delle immagini in un flusso di lavoro semplice, colloquiale e veloce.

Google sottolinea che il suo approccio si basa sulla conoscenza del mondo di Gemini e su modelli di intelligenza artificiale avanzati , che aiutano a comprendere il contesto delle istruzioni e ad applicare modifiche più precise rispetto a quelle dei generatori puramente visivi.

Modifica delle immagini tramite intelligenza artificiale in Gemini

Editing conversazionale: dalla richiesta alla messa a punto

Il modello funziona con comandi in linguaggio naturale e permette di interagire con l'immagine: si possono chiedere "rendi il cielo più drammatico", "rimuovi quel cartello" o "cambia il colore dell'auto in rosso" e perfezionare il risultato in fasi successive senza dover ricominciare da capo.

Questa interazione a più passaggi riduce l'attrito tipico degli strumenti tradizionali. Secondo Google, è possibile selezionare aree specifiche per regolare colore, illuminazione o texture, rimuovere elementi indesiderati, sostituire gli sfondi e aggiungere oggetti che si integrano perfettamente, rispettando ombre e prospettiva.

  Intelligenza artificiale - Un approccio moderno

Oltre al ritocco di base, la piattaforma comprende istruzioni come "inserisci lo stesso personaggio in un'altra scena" o "mostra il prodotto da diverse angolazioni", preservando il soggetto e il suo aspetto con coerenza tra le modifiche.

Coerenza, qualità e velocità

Uno dei progressi più significativi è il miglioramento della coerenza visiva tra le diverse edizioni: tratti del viso, mani, animali domestici e oggetti rimangono stabili con una minore distorsione, un aspetto che storicamente rappresentava un problema per i modelli generativi.

Il fotorealismo è migliorato grazie a un'illuminazione e a texture più naturali, e Google promette prestazioni fulminee che accelerano i cicli creativi per attività come le varianti di prodotto o le scene a tema.

Nei test della community, il sistema ha scalato le classifiche di LM Arena per l'editing di immagini, posizionandosi tra i motori con la migliore esperienza utente secondo le valutazioni degli utenti.

Strumenti principali e casi d'uso

Gemini 2.5 Flash Image include funzionalità pensate sia per gli utenti generici che per i team creativi. Alcune delle caratteristiche più interessanti consentono di comporre immagini provenienti da diverse fonti e di inserirle in un ambiente coerente.

  • Ritocco contestuale: modifiche di colore, esposizione, consistenza o stile senza perdere elementi chiave dell'originale.
  • Rimozione e sostituzione: cancellare oggetti, cambiare sfondi o aggiungere elementi integrando luci e ombre.
  • Composizione e miscela: combinare due foto in una scena e trasferirle modelli o stili da un'immagine all'altra.
  • Edizione multi-turno: modifiche a catena (pitturare pareti, aggiungere mobili, modificare il guardaroba) senza dover riavviare il processo.

Nel marketing, nell'arredamento, nella moda o nei contenuti per i social media, questo strumento viene utilizzato per creare rapidamente varianti, mantenere la coerenza delle risorse del marchio e testare idee visive senza ricorrere a software tradizionali.

Limiti di sicurezza e utilizzo

Per ridurre al minimo gli abusi, Google applica filtri che bloccano i contenuti violenti o sessualmente espliciti e limita la modifica di persone reali o personaggi pubblici. L'obiettivo è ridurre il rischio di disinformazione e deepfake.

  OpenAI Codex CLI: tutto ciò che devi sapere sull'assistente del codice terminale

Tutte le immagini generate o modificate incorporano SynthID , una filigrana digitale impercettibile all'interno del file stesso che aiuta a verificarne l'origine. Inoltre, l'azienda menziona ulteriori segnali e controlli proattivi per rafforzare la tracciabilità.

La politica di utilizzo vieta espressamente la creazione di materiale intimo senza consenso e di altre categorie sensibili, rafforzando l'attenzione all'intelligenza artificiale responsabile nei servizi di Gemini.

Come usare Nano Banana nell'app Gemini

L'accesso è semplice: non è necessario installare nulla di aggiuntivo o scegliere un modello specifico. Basta aprire Gemini, caricare una foto e descrivere le modifiche . Se si desidera conservare tutte le modifiche tranne una, è possibile iniziare con "Nella foto originale,..." per specificare che il resto deve essere mantenuto.

Alcuni esempi utili: "converti in bianco e nero", "rimuovi il palo d'angolo", "aggiungi un cane sulla panchina" o "cambia il vestito in verde". Il sistema cerca di mantenere le caratteristiche e le proporzioni del soggetto durante l'applicazione della modifica.

È inoltre possibile caricare due foto e richiedere che il contenuto di una appaia nell'altra, oppure che lo stile di un motivo (ad esempio, ali di farfalla) venga trasferito su un capo di abbigliamento o un oggetto presente nella seconda immagine.

Disponibilità e accesso per gli sviluppatori

Questa funzionalità è disponibile nell'app Gemini per il pubblico generico. Per le integrazioni professionali, è possibile accedervi tramite l'API Gemini, Google AI Studio e Vertex AI, aprendo la strada a flussi di lavoro in aziende e app di terze parti.

L'utilizzo all'interno dell'app è gratuito con limiti ragionevoli. Per gli sviluppatori, Google offre un modello di prezzo a consumo ; nell'API viene menzionato un costo di riferimento di 30 dollari per milione di token, con stime approssimative che collocano ogni immagine a pochi centesimi, a seconda del caso d'uso.

  Microsoft Copilot: differenze tra i piani e cosa include ciascuno

Contesto competitivo

Questa mossa è mirata direttamente a competere con rivali come Midjourney e DALL·E (OpenAI). La strategia di Google si concentra sulla modifica conversazionale e su risultati coerenti, supportati dalla comprensione contestuale di Gemini.

Con l'integrazione del marchio Nano Banana nel suo ecosistema, l'azienda sta cercando di colmare il divario in un settore in cui velocità, qualità e controllo sono cruciali per l'utente finale.

Domande frequenti

Nano Banana è un'app autonoma?

No. È un modello interno a Gemini , quindi viene utilizzato dall'interfaccia stessa dell'applicazione.

C'è un costo per gli utenti finali?

L'app Gemini offre un utilizzo gratuito con limiti di utilizzo. Le integrazioni API, invece, prevedono dei costi.

Devo selezionare manualmente il modello?

No. La selezione è automatica quando si eseguono funzioni di generazione o modifica delle immagini in Gemini.

Grazie all'attenzione rivolta all'editing conversazionale, alla coerenza del soggetto tra gli scatti e alle misure di sicurezza integrate, Nano Banana (Gemini 2.5 Flash Image) si sta affermando come un'ottima soluzione per la creazione e il ritocco di immagini, sia nella vita di tutti i giorni che nei progetti professionali, sia tramite l'app Gemini che attraverso le sue API.

studio dei sogni
Articolo correlato:
DreamStudio: cos'è e come creare immagini con l'intelligenza artificiale