ActualitésActionsGoogle lance Nano Banana 2.1 et divise par deux les coûts d'API de son meilleur modèle d'image à ce jour

Google lance Nano Banana 2.1 et divise par deux les coûts d'API de son meilleur modèle d'image à ce jour

Auteur: Metaverse Post·

Points clés

  • •Google a lancé Nano Banana 2.1, un modèle de génération et d'édition d'images amélioré offrant un design visuel perfectionné, une édition par masque précise et une meilleure cohérence des sujets, disponible sur l'application Gemini, l'AI Mode, Google Ads et des outils pour développeurs comme AI Studio, Flow et Stitch.
  • •Le nouveau modèle a obtenu 1 050 points ELO dans les benchmarks de préférence texte-image, devant Nano Banana 2 à 990 et Nano Banana Pro à 935.
  • •Le prix d'API d'une image standard 1K est passé à 0,0336 $ contre 0,067 $, ramenant le coût de génération de 1 000 images en résolution standard à environ 33,60 $ contre 67 $, le traitement par lot bénéficiant en outre d'une remise supplémentaire de 50 %.
  • •Nano Banana 2.1 peut traiter jusqu'à 14 images de référence simultanément, maintenir la cohérence pour jusqu'à quatre personnages et la fidélité pour jusqu'à dix objets, et produire en résolutions 1K, 2K et 4K avec des artefacts de tuilage corrigés sur les ratios panoramiques extrêmes.
  • •Le modèle Banana original a propulsé Gemini en tête des deux principales boutiques d'applications en septembre 2025, mettant fin à près de trois ans d'avance de ChatGPT, au moment où la capitalisation boursière d'Alphabet dépassait 3 000 milliards de dollars.
Google lance Nano Banana 2.1 et divise par deux les coûts d'API de son meilleur modèle d'image à ce jour

Google a publié mardi Nano Banana 2.1, la dernière version de son modèle de génération et d'édition d'images, apportant des améliorations étendues en qualité visuelle, en respect des prompts, en rendu du texte et en cohérence multi-tours des personnages, tout en maintenant la vitesse et l'efficacité des coûts de niveau Flash de la gamme. Ce modèle constitue le pendant plus efficient de Gemini 3 Pro Image, également connu sous le nom de Nano Banana Pro.

La mise à jour est déployée sur l'application Gemini, l'AI Mode de Google Search, Google Ads et des outils pour développeurs, dont Google AI Studio, Flow et Stitch. Elle arrive à un moment où la famille Nano Banana est devenue un pilier central de la stratégie d'IA grand public de Google. En septembre 2025, la capacité du modèle original à transformer des selfies en figurines de collection a propulsé Gemini en tête des deux principales boutiques d'applications, mettant fin à près de trois ans de domination de ChatGPT, au moment où la capitalisation boursière d'Alphabet dépassait 3 000 milliards de dollars. La version 2 avait suivi en février, construite sur Gemini 3.1 Flash Image, et avait introduit l'ancrage dans Google Search afin que les images d'événements ou de personnes réelles soient plus précises.

Google a annoncé la sortie sur X :

Meet Nano Banana 2.1, our latest image generation and editing model This upgraded version outperforms our previous models across the board, with notable leaps in visual design, mask-based editing, and subject consistency to help you create more natural-looking images. pic.twitter.com/d858DrzrF3

— Google (@Google) October 6, 2026

Édition plus précise et benchmarks renforcés

Google a mis en avant trois améliorations phares dans cette nouvelle version : un design visuel amélioré, une édition par masque plus précise qui ne modifie que la zone marquée d'une image, et une meilleure cohérence des sujets afin qu'une personne ou un objet reste reconnaissable sur plusieurs éditions. Cette cohérence sous-tend les flux de travail multi — storyboards, gammes de produits, œuvres en série — où l'alternative consiste à retoucher chaque image à la main. Sur le papier, le modèle gère jusqu'à 14 images de référence simultanément, en maintenant la cohérence pour jusqu'à quatre personnages et la fidélité pour jusqu'à dix objets. Il produit en résolutions 1K, 2K et 4K, corrige les artefacts de tuilage sur les ratios panoramiques extrêmes comme 1:4, 1:8, 4:1 et 8:1, et restitue le texte et les mises en page d'infographies avec plus de précision.

Ces gains se reflètent également dans les benchmarks. En termes de préférence globale dans les tests texte-image, Banana 2.1 a obtenu 1 050 points ELO, contre 990 pour Nano Banana 2 et 935 pour Nano Banana Pro — un écart significatif dans un système de classement fondé sur des comparaisons de préférences humaines en face-à-face.

Les développeurs disposent d'un contrôle supplémentaire grâce à des niveaux de réflexion configurables, allant de minimal à élevé, et à l'ancrage sur Google Web et Image Search, permettant au modèle de rechercher des informations avant de générer une image.

Les gains d'efficacité s'étendent aux coûts. Via l'API pour développeurs de Google, une image standard 1K coûte désormais 0,0336 $ — soit environ la moitié des 0,067 $ facturés pour Nano Banana 2 — tandis qu'une image 4K revient à 0,0756 $ contre 0,151 $ auparavant. Le traitement par lot bénéficie en outre d'une remise supplémentaire de 50 %. Concrètement, générer un millier d'images en résolution standard coûte désormais environ 33,60 $, contre 67 $ auparavant, positionnant Nano Banana 2.1 à la fois comme leader en qualité et comme l'une des options les plus rentables du marché de l'image générative. Pour les produits générant des images en volume, le prix par image est une composante directe des coûts d'exploitation, ce qui explique pourquoi cette baisse compte au-delà des gains de qualité mis en avant. La manière dont les gains de benchmark se vérifient dans l'usage quotidien à mesure que la disponibilité s'élargira constituera le test immédiat des affirmations de Google.

Source : Metaverse Post