AktualnościAkcjeGoogle wydaje Nano Banana 2.1, przeciw pricedłając koszty API swojego najsilniejszego modelu obrazów o połowę

Google wydaje Nano Banana 2.1, przeciw pricedłając koszty API swojego najsilniejszego modelu obrazów o połowę

Autor: Metaverse Post·

Najważniejsze informacje

  • •Google uruchomiło Nano Banana 2.1, ulepszony model generowania i edycji obrazów z poprawionym projektem wizualnym, precyzyjną edycją opartą na maskach i silniejszą spójnością obiektów, dostępny w aplikacji Gemini, trybie AI, Google Ads oraz narzędziach deweloperskich, takich jak AI Studio, Flow i Stitch.
  • •Nowy model uzyskał 1 050 punktów ELO w benchmarkach preferencji tekst-na-obraz, wyprzedzając Nano Banana 2 z wynikiem 990 i Nano Banana Pro z wynikiem 935.
  • •Cena API za standardowy obraz 1K spadła do 0,0336 USD z 0,067 USD, obniżając koszt wygenerowania 1 000 obrazów w standardowej rozdzielczości do około 33,60 USD z 67 USD, a przetwarzanie wsadowe otrzymuje dodatkowe 50% zniżki.
  • •Nano Banana 2.1 może przetwarzać jednocześnie do 14 obrazów referencyjnych, zachowywać spójność dla maksymalnie czterech postaci i wierność dla maksymalnie dziesięciu obiektów oraz generować wyniki w rozdzielczościach 1K, 2K i 4K z poprawionymi artefaktami kafelkowania przy ekstremalnych panoramicznych proporcjach.
  • •Pierwotny model Nano Banana wyniósł Gemini na szczyt obu głównych sklepów z aplikacjami we wrzeniu 2025 roku, kończąc niemal trzyletnie prowadzenie ChatGPT i zbiegając się z przekroczeniem przez Alphabet wartości rynkowej 3 bilionów USD.
Google wydaje Nano Banana 2.1, przeciw pricedłając koszty API swojego najsilniejszego modelu obrazów o połowę

We wtorek Google wydało Nano Banana 2.1, najnowszą wersję swojego modelu generowania i edycji obrazów, wprowadzającą szerokie ulepszenia w zakresie jakości wizualnej, zgodności z promptami, renderowania tekstu oraz spójności postaci w wielu turach, przy zachowaniu szybkości i efektywności kosztowej na poziomie Flash charakterystycznej dla tej linii produktów. Model stanowi bardziej wydajny odpowiednik Gemini 3 Pro Image, znanego również jako Nano Banana Pro.

Aktualizacja jest wdrażana w aplikacji Gemini, trybie AI Wyszukiwania Google, Google Ads oraz narzędziach deweloperskich, w tym Google AI Studio, Flow i Stitch. Przybywa w momencie, gdy rodzina Nano Banana stała się centralnym filarem konsumenckiej strategii AI Google. We wrześniu 2025 roku zdolność pierwotnego modelu do zamiany selfie w kolekcjonerskie figurki wyniosła Gemini na szczyt obu głównych sklepów z aplikacjami, kończąc niemal trzyletnią dominację ChatGPT i zbiegając się z przekroczeniem przez Alphabet wartości rynkowej 3 bilionów USD. Wersja 2 pojawiła się w lutym, została zbudowana na Gemini 3.1 Flash Image i wprowadziła ugruntowanie w Wyszukiwaniu Google, dzięki czemu obrazy rzeczywistych wydarzeń lub osób stały się dokładniejsze.

Google ogłosiło premierę na X:

Meet Nano Banana 2.1, our latest image generation and editing model This upgraded version outperforms our previous models across the board, with notable leaps in visual design, mask-based editing, and subject consistency to help you create more natural-looking images. pic.twitter.com/d858DrzrF3

— Google (@Google) October 6, 2026

Bardziej precyzyjna edycja i mocniejsze wyniki w benchmarkach

Google wskazało trzy główne ulepszenia w nowej wersji: poprawiony projekt wizualny, bardziej precyzyjną edycję opartą na maskach, która zmienia tylko oznaczony obszar obrazu, oraz silniejszą spójność obiektów, dzięki której osoba lub przedmiot pozostaje rozpoznawalny po edycjach. Ta spójność stanowi podstawę przepływów pracy z wieloma obrazami — storyboardów, zestawów produktowych, seryjnej grafiki — gdzie alternatywą jest ręczna retusz każdej klatki. Na papierze model obsługuje jednocześnie do 14 obrazów referencyjnych, zachowując spójność dla maksymalnie czterech postaci i wierność dla maksymalnie dziesięciu obiektów. Generuje wyniki w rozdzielczościach 1K, 2K i 4K, eliminuje artefakty kafelkowania przy ekstremalnych panoramicznych proporcjach, takich jak 1:4, 1:8, 4:1 i 8:1, oraz renderuje tekst i układy infografik dokładniej.

Zyski widać również w benchmarkach. W ogólnej preferencji w testach tekst-na-obraz Nano Banana 2.1 uzyskała 1 050 punktów ELO, w porównaniu z 990 dla Nano Banana 2 i 935 dla Nano Banana Pro — istotna różnica w systemie rankingowym opartym na bezpośrednich porównaniach preferencji ludzkich.

Deweloperzy zyskują dodatkową kontrolę dzięki konfigurowalnym poziomom myślenia, od minimalnego do wysokiego, oraz dzięki ugruntowaniu w Google Web i Image Search, co w efekcie pozwala modelowi wyszukać informacje przed wygenerowaniem obrazu.

Zyski w zakresie wydajności obejmują również koszty. Poprzez deweloperskie API Google standardowy obraz 1K kosztuje teraz 0,0336 USD — mniej więcej połowę kwoty 0,067 USD pobieranej za Nano Banana 2 — podczas gdy obraz 4K kosztuje 0,0756 USD wobec wcześniejszych 0,151 USD. Przetwarzanie wsadowe otrzymuje dodatkowe 50% zniżki. W praktyce wygenerowanie tysiąca obrazów w standardowej rozdzielczości kosztuje teraz około 33,60 USD, w dół z 67 USD, co pozycjonuje Nano Banana 2.1 zarówno jako lidera jakości, jak i jedną z najbardziej opłacalnych opcji na rynku generatywnych obrazów. Dla produktów generujących obrazy masowo cena za obraz jest bezpośrednim składnikiem kosztów operacyjnych, dlatego cięcie ma znaczenie wykraczające poza headline'owe zyski jakościowe. Jak zyski z benchmarków sprawdzą się w codziennym użytkowaniu wraz z poszerzaniem dostępności, to najbliższy test dla twierdzeń Google.

Źródło: Metaverse Post