Metà prezzo per immagine e una qualità più alta in tutte le prove interne. Con queste due promesse Google ha lanciato ieri martedì 6 ottobre Nano Banana 2.1, il nuovo modello per creare e modificare immagini che prende il posto di Nano Banana 2 nell’app Gemini, su Google Flow, nella Modalità AI della Ricerca e nelle piattaforme per sviluppatori.
Alla base c’è Gemini 3.6 Flash, la versione veloce ed economica della terza generazione, mentre Banana resta il nome scherzoso che dal 2025 accompagna i generatori visivi dell’azienda. Le novità annunciate riguardano soprattutto tre aspetti: la composizione grafica, la modifica tramite maschera limitata a una parte dell’immagine e la coerenza dei soggetti tra un ritocco e l’altro.
Sull’API il prezzo di un’immagine in risoluzione 1K scende da 0,067 a 0,0336 dollari, e su Arena, la classifica basata sui voti degli appassionati, il modello sale subito al quinto posto nella generazione da testo. Resta però dietro a GPT Image 2.5 di OpenAI.
Fino a 14 immagini di riferimento, panoramiche 8:1 e ragionamento regolabile
Nano Banana 2.1 accetta in ingresso testo, foto, video e documenti PDF, e restituisce immagini insieme a eventuali risposte testuali. Nell’API di Gemini la richiesta può contenere fino a 131.072 token, cioè le unità con cui il sistema misura testo e immagini, mentre la risposta arriva a 32.768. Le sue conoscenze si fermano a marzo 2026.
Le immagini escono in tre risoluzioni, 1K, 2K e 4K, con proporzioni che vanno dal quadrato fino ai formati panoramici 8:1 e 1:8, pensati per banner e striscioni. Google dichiara di aver corretto anche i difetti di giunzione che comparivano in queste proporzioni estreme in 2K e 4K.
La funzione più utile per chi lavora su progetti grafici è la fusione multi-immagine. Si possono caricare fino a 14 immagini di riferimento, e il modello mantiene riconoscibili al massimo quattro personaggi e dieci oggetti nella scena finale, per esempio la stessa persona in pose diverse o un prodotto inserito in ambienti differenti.
Come i modelli testuali, anche Nano Banana 2.1 può ragionare prima di disegnare. Il livello di thinking si sceglie fra minimal, medium e high, e più tempo di riflessione aiuta nelle composizioni complesse e nelle infografiche. Il modello può inoltre appoggiarsi a Google Search e alla ricerca per immagini così da raffigurare luoghi, oggetti e dati reali con più precisione.
Mancano però alcune funzioni comuni ai modelli Gemini, come la chiamata di strumenti esterni, gli output strutturati e la cache dei prompt. Sulla piattaforma per aziende, inoltre, non è possibile generare immagini di persone reali.
Arena e i test di Google premiano il salto, ma GPT Image 2.5 resta davanti
I dati di Google provengono da confronti a coppie in cui valutatori umani scelgono l’immagine migliore, con i risultati tradotti in punteggi Elo, lo stesso sistema degli scacchi. In modalità thinking Nano Banana 2.1 ottiene 1050 punti nella preferenza generale, contro i 990 di Nano Banana 2 e i 935 di Nano Banana Pro, il modello più grande della generazione precedente. Nella coerenza tra più personaggi in fase di modifica arriva a 1106.
Il progresso più netto riguarda l’accuratezza delle infografiche, cioè la correttezza di dati, etichette e testi inseriti nelle immagini. Qui il punteggio sale a 0,521, contro lo 0,179 di Nano Banana 2 e lo 0,265 di Nano Banana Pro.
Le prime misure esterne arrivano da Arena, dove gli appassionati confrontano alla cieca due immagini generate dallo stesso prompt. Nano Banana 2.1 si piazza quinto nella generazione da testo con 1328 punti, sesto nella modifica di una singola immagine con 1428 e quarto, con 1431, nel ritocco di più immagini insieme. Rispetto a Nano Banana 2 guadagna rispettivamente 80, 38 e 67 punti, e nelle classifiche per categoria spicca in fotorealismo, design commerciale e resa del testo.
La distanza dal vertice resta però ampia: GPT Image 2.5 Sunburst guida la generazione da testo con 1425 punti e la modifica con 1524, mentre la variante Flare segue con 1398 e 1481 punti.
Nano Banana 2.1 alla prova
Per capire quanto valgano i progressi dichiarati ho messo alla prova Nano Banana 2.1 con un prompt pensato per colpire i suoi punti deboli, cioè testo piccolo, rappresentazione di dati e proporzioni corrette. Ho poi dato la stessa richiesta a Grok Image e a GPT Image 2.5, così da confrontare i tre risultati.
A detailed vintage-style infographic poster titled "The Solar System at a Glance", 4K, 16:9 format. Show all eight planets in correct order from the Sun with accurate relative sizes. Under each planet, a small caption in a clean serif font with: name, average distance from the Sun in million km, number of known moons, and length of one day. Add a footer with three lines of small print explaining the data sources. All text must be sharp, correctly spelled and legible at full size.
Il prompt chiede gli otto pianeti in ordine con dimensioni relative fedeli, didascalie in un carattere serif, con distanza dal Sole, numero di lune e durata del giorno, più un piè di pagina con le fonti. Per giudicare ho confrontato ogni valore con le schede della NASA.

Grok consegna un poster ordinato (sopra), con testi nitidi e un piè di pagina su tre righe che cita la Planetary Fact Sheet della NASA. Distanze e durata del giorno sono corrette, ma i conteggi delle lune non sono coerenti tra loro, perché accanto alle 146 di Saturno compaiono 27 lune per Urano e 14 per Nettuno. Il sottotitolo afferma che le dimensioni sono in scala, mentre Giove appare poco più grande della Terra.

ChatGPT ha la tipografia più curata dei tre, con un carattere serif elegante e testi leggibili, ma è anche il risultato con gli errori più gravi. Urano sparisce dalle didascalie, al posto di Marte compare una seconda Terra e le colonne finiscono sfalsate rispetto ai disegni. Saturno riceve poi le 28 lune e le 17,2 ore di rotazione di Urano.

Nano Banana 2.1 (sopra) è l’unico che interpreta lo stile vintage richiesto come un vero manifesto d’epoca, con il Sole inciso, cornici decorate e carta invecchiata, e soprattutto non sbaglia un dato. Distanze, lune e durata del giorno tornano per tutti gli otto pianeti, le proporzioni sono plausibili e compaiono dettagli non richiesti come la Luna accanto alla Terra e gli anelli verticali di Urano. I difetti non mancano. Phobos compare due volte accanto a Marte, sotto Venere si legge EARTH BAYS al posto di EARTH DAYS e il piè di pagina inventa l’Unione Astronomica Internazionale.
Tra i tre risultati il migliore è Nano Banana 2.1. ChatGPT ha il testo più pulito ma sbaglia la sostanza, Grok è ordinato ma sbaglia i conteggi delle lune, mentre il modello di Google è l’unico che si potrebbe pubblicare correggendo pochi dettagli (vedi sotto).

Su questo tipo di immagine il salto nell’accuratezza delle infografiche annunciato da Google ha trovato riscontro.
Un netto miglioramento sul modello precedente
Nano Banana 2.1 non conquista il primo posto, ma migliora il predecessore su tutti i fronti dichiarati e dimezza il costo delle immagini, che è la voce principale della spesa per chi produce grafica in grandi volumi. La fusione di 14 immagini, i formati panoramici e il collegamento con Google Search lo rendono adatto a cataloghi di prodotti, materiali pubblicitari e infografiche, dove contano coerenza e dati corretti più dell’effetto artistico.
GPT Image 2.5 è ancora davanti di quasi cento punti su Arena, un divario che si traduce in una chiara preferenza per il modello di OpenAI. Per chi usa l’API la scadenza è vicina, perché Nano Banana 2 verrà spento il 29 ottobre. Conviene quindi provare subito la versione 2.1 sui propri prompt, misurare i token di ragionamento consumati e, per le immagini semplici in 1K, valutare anche Nano Banana 2 Lite, che ha lo stesso prezzo ed è pensato per rispondere in meno di due secondi.












