Google rilascia Nano Banana 2.1, dimezzando i costi API del suo modello di immagini più potente
Punti chiave
- •Google ha lanciato Nano Banana 2.1, un modello aggiornato di generazione e modifica delle immagini con design visivo migliorato, modifica basata su maschere precisa e maggiore coerenza dei soggetti, disponibile sull'app Gemini, sull'AI Mode, su Google Ads e su strumenti per sviluppatori come AI Studio, Flow e Stitch.
- •Il nuovo modello ha ottenuto 1.050 punti ELO nei benchmark di preferenza text-to-image, davanti a Nano Banana 2 con 990 e Nano Banana Pro con 935.
- •Il prezzo API per un'immagine standard 1K è sceso a 0,0336 dollari da 0,067 dollari, riducendo il costo di generazione di 1.000 immagini a risoluzione standard a circa 33,60 dollari da 67 dollari, con un ulteriore sconto del 50% per l'elaborazione in batch.
- •Nano Banana 2.1 può elaborare fino a 14 immagini di riferimento simultanee, mantenere la coerenza per un massimo di quattro personaggi e la fedeltà per un massimo di dieci oggetti, e generare output a risoluzioni 1K, 2K e 4K con artefatti di tiling corretti su proporzioni panoramiche estreme.
- •Il modello Nano Banana originale ha portato Gemini al vertice di entrambi i principali app store a settembre 2025, ponendo fine al vantaggio di quasi tre anni di ChatGPT e coincidendo con il superamento dei 3.000 miliardi di dollari di capitalizzazione di Alphabet.

Martedì Google ha rilasciato Nano Banana 2.1, l'ultima versione del suo modello di generazione e modifica delle immagini, con miglioramenti su larga scala nella qualità visiva, nel rispetto dei prompt, nel rendering del testo e nella coerenza dei personaggi in più turni, mantenendo la velocità e l'efficienza dei costi di livello Flash della linea di prodotti. Il modello funge da controparte più efficiente di Gemini 3 Pro Image, noto anche come Nano Banana Pro.
L'aggiornamento è in distribuzione sull'app Gemini, sull'AI Mode di Google Search, su Google Ads e su strumenti per sviluppatori tra cui Google AI Studio, Flow e Stitch. Arriva in un momento in cui la famiglia Nano Banana è diventata un pilastro centrale della strategia di Google per l'AI consumer. A settembre 2025, la capacità del modello originale di trasformare i selfie in statuette da collezione ha portato Gemini al vertice di entrambi i principali app store, ponendo fine a quasi tre anni di dominio di ChatGPT e coincidendo con il superamento dei 3.000 miliardi di dollari di capitalizzazione di Alphabet. La versione 2 è seguita a febbraio, basata su Gemini 3.1 Flash Image, e ha introdotto il grounding in Google Search per rendere più accurate le immagini di eventi o persone reali.
Google ha annunciato il rilascio su X:
Meet Nano Banana 2.1, our latest image generation and editing model This upgraded version outperforms our previous models across the board, with notable leaps in visual design, mask-based editing, and subject consistency to help you create more natural-looking images. pic.twitter.com/d858DrzrF3
— Google (@Google) October 6, 2026
Modifiche più precise e benchmark più solidi
Google ha evidenziato tre aggiornamenti principali nella nuova versione: un design visivo migliorato, una modifica basata su maschere più precisa che altera solo l'area contrassegnata di un'immagine e una maggiore coerenza dei soggetti, così che una persona o un oggetto resti riconoscibile attraverso più modifiche. Questa coerenza è alla base dei flussi di lavoro multi-immagine — storyboard, set di prodotti, opere seriali — dove l'alternativa è ritoccare ogni fotogramma a mano. Sulla carta, il modello gestisce fino a 14 immagini di riferimento simultanee, mantenendo la coerenza per un massimo di quattro personaggi e la fedeltà per un massimo di dieci oggetti. Genera output a risoluzioni 1K, 2K e 4K, corregge gli artefatti di tiling su proporzioni panoramiche estreme come 1:4, 1:8, 4:1 e 8:1 e rendering il testo e i layout infografici in modo più accurato.
I progressi si riflettono anche nei benchmark. Nella preferenza complessiva nei test text-to-image, Nano Banana2.1 ha ottenuto 1.050 punti ELO, contro i 990 di Nano Banana 2 e i 935 di Nano Banana Pro — un divario significativo in un sistema di classifica basato su confronti diretti di preferenza umana.
Gli sviluppatori ottengono ulteriore controllo tramite livelli di pensiero configurabili, dal minimo all'alto, e tramite il grounding con Google Web e Image Search, che di fatto consente al modello di cercare informazioni prima di generare un'immagine.
I guadagni di efficienza si estendono anche ai costi. Attraverso l'API per sviluppatori di Google, un'immagine standard 1K costa ora 0,0336 dollari — circa la metà degli 0,067 dollari addebitati per Nano Banana 2 — mentre un'immagine 4K costa 0,0756 dollari contro gli 0,151 dollari precedenti. L'elaborazione in batch riceve un ulteriore sconto del 50%. In termini pratici, generare mille immagini a risoluzione standard costa ora circa 33,60 dollari, rispetto ai 67 dollari precedenti, posizionando Nano Banana 2.1 sia come leader di qualità sia come una delle opzioni più convenienti nel mercato delle immagini generative. Per i prodotti che generano immagini in grande volume, il prezzo per immagine è un elemento diretto dei costi operativi, ed è per questo che il taglio conta oltre ai miglioramenti di qualità annunciati. La capacità dei progressi nei benchmark di reggere nell'uso quotidiano man mano che la disponibilità si allarga è la prova immediata delle dichiarazioni di Google.
Fonte: Metaverse Post