AktualnościAkcjeGoogle DeepMind wprowadza Gemini 3.7 Flash — swój najbardziej inteligentny model roboczy do kodowania i agentów

Google DeepMind wprowadza Gemini 3.7 Flash — swój najbardziej inteligentny model roboczy do kodowania i agentów

Autor: Google DeepMind Blog·

Najważniejsze informacje

  • Gemini 3.7 Flash został wydany 13 sierpnia 2026 roku, zaledwie trzy tygodnie po swoim poprzedniku, Gemini 3.6 Flash, co odzwierciedla przyspieszone tempo wydań.
  • Model uzyskał wynik 65,3% w benchmarku DeepSWE v1.1 w zakresie rozwiązywania rzeczywistych zgłoszeń z GitHub, w porównaniu do 49,0% dla 3.6 Flash, oraz poprawił wynik z 34,4% do 43,6% w benchmarku kodowania FrontierCode 1.1 Main.
  • Cena introductoryjna została ustalona na 0,75 USD za milion tokenów wejściowych i 3,75 USD za milion tokenów wyjściowych do 31 grudnia 2026 roku, po czym stawki ulegną podwojeniu.
  • Gemini Spark, osobisty agent AI dostępny dla subskrybentów Google AI Pro i Ultra w ponad 160 krajach, rozpoczął korzystanie z Gemini 3.7 Flash w dniu premiery w celu usprawnienia przepływów pracy w Google Workspace.
  • Model jest dostarczany ze zaktualizowanymi zabezpieczeniami Frontier Safety ukierunkowanymi na nadużycia w obszarach chemicznym, biologicznym, radiologicznym, nuklearnym oraz cyberataków.
Google DeepMind wprowadza Gemini 3.7 Flash — swój najbardziej inteligentny model roboczy do kodowania i agentów

Google DeepMind wprowadza Gemini 3.7 Flash — swój najbardziej inteligentny model roboczy do kodowania i agentów

Google DeepMind ogłosił wydanie Gemini 3.7 Flash, określanego przez firmę jako jej najbardziej inteligentny model roboczy do chwili obecnej, przeznaczony do kodowania i przepływów pracy opartych na agentach. Ogłoszenie zostało dokonane 13 sierpnia 2026 roku przez Tulsee Doshi, Senior Director of Product Management, w imieniu zespołu Gemini.

Wprowadzenie nastąpiło zaledwie trzy tygodnie po wydaniu Gemini 3.6 Flash, kontynuując rytm aktualizacji w warstwie Flash w przybliżeniu co miesiąc ze strony DeepMind. Skrócony odstęp między wydaniami odzwierciedla branżowy trend, w którym dostawcy modeli granicznych wprowadzają przyrostowe, ale mierzalne usprawnienia w krótszych cyklach, często motywowane opiniami deweloperów, a nie kamieniami milowymi badawczymi obejmującymi wiele miesięcy. Według Google DeepMind, 3.7 Flash jest bezpośrednim rezultatem opinii deweloperów i innowacji algorytmicznych, które firma planuje przenieść na przyszłe modele. Nowe wydanie przynosi znaczące ulepszenia w obszarze inżynierii oprogramowania, pracy z wiedzą oraz tworzenia stron internetowych, przy czym cena introductoryjna została ustalona na połowę pierwotnego kosztu 3.6 Flash za milion tokenów.

Znacząca poprawa wydajności w kodowaniu, tworzeniu stron internetowych i pracy z wiedzą

Gemini 3.7 Flash wykazuje silną poprawę względem poprzednika w zadaniach kodowania, takich jak debugowanie i rozwiązywanie problemów. Model osiąga wyższą dokładność kodu przy pierwszej próbie oraz lepszą wydajność w generowaniu kodu gotowego do produkcji, co pokazuje benchmark FrontierCode 1.1 Main, gdzie uzyskał wynik 43,6% w porównaniu do 34,4% modelu 3.6 Flash. Na DeepSWE v1.1 — ewaluacji testującej zdolność modelu do kompleksowego rozwiązywania rzeczywistych zgłoszeń z GitHub — 3.7 Flash uzyskał wynik 65,3% w porównaniu do 49,0% modelu 3.6 Flash.

W tworzeniu stron internetowych 3.7 Flash generuje bardziej funkcjonalne układy i kompletne aplikacje w mniejszej liczbie zapytań. W przypadku generowania interfejsu użytkownika model wykazuje wysoką zgodność z projektem oraz wierność względem materiałów referencyjnych, w tym zrzutów ekranu, obrazów i pełnych systemów projektowych. Na platformie WebDev Arena Arena.ai model 3.7 Flash osiągnął wynik Elo 1588 w porównaniu do 1538 dla 3.6 Flash.

W dziedzinach wymagających dużej ilości wiedzy, takich jak finanse, prawo i biologia, 3.7 Flash zapewnia ulepszone wnioskowanie i dokładność. Znacznie przewyższa 3.6 Flash w benchmarku GDP.pdf — ewaluacji zaprojektowanej w celu testowania zdolności modelu do przetwarzania złożonych dokumentów — osiągając wynik 34,0% w porównaniu do 22,0%. Model przewyższa również 3.6 Flash na platformie AutomationBench, która mierzy zdolność do realizacji rzeczywistych przepływów pracy biznesowej, osiągając wynik 30,4% w porównaniu do 17,0%.

Google DeepMind podkreślił kilka przypadków użycia umożliwionych przez 3.7 Flash, w tym generowanie w pełni grywalnych gier 3D na podstawie podpowiedzi tekstowych w połączeniu z Nano Banana, tworzenie interaktywnych stron lądowania za jednym razem poprzez orkiestrację pod-agentów przy użyciu Gemini Omni, trenowanie modeli robotyki z wykorzystaniem rozumienia multimodalnego w trójagentowej pętli grafowej oraz przekształcanie statycznych plików PDF, takich jak raporty roczne, w interaktywne doświadczenia internetowe z dynamicznymi wykresami i zagregowanymi wnioskami.

Doświadczenie deweloperskie i ceny

Gemini 3.7 Flash oferuje zauważalnie ulepszone doświadczenie deweloperskie w porównaniu do 3.6 Flash, jak podaje firma. Model lepiej radzi sobie z przeszkodami, doprecyzowuje intencje w razie potrzeby i podąża za instrukcjami z większą wiernością. Wykazuje również bardziej sumienne wieloetapowe planowanie i wykonywanie wywołań narzędzi, co skutkuje mniejszą potrzebą nadzoru ręcznego i mniejszą liczbą ponownych prób w przepływach pracy inżynieryjnej.

3.7 Flash jest dostępny do końca 2026 roku w cenie introductoryjnej 0,75 USD za 1 milion tokenów wejściowych i 3,75 USD za 1 milion tokenów wyjściowych. Google DeepMind oświadczył, że ta cena w połączeniu z lepszą wydajnością modelu umożliwia deweloperom i klientom skalowanie agentów gotowych do produkcji w sposób opłacalny. Wczesne opinie klientów rzekomo podkreślają wydajność i precyzję modelu 3.7 Flash, osiągając wyniki znacznie lepsze niż 3.6 Flash przy niskim koszcie.

Cena introductoryjna wygasa 31 grudnia 2026 roku. Od 1 stycznia 2027 roku stawka wyniesie 1,50 USD za 1 milion tokenów wejściowych i 7,50 USD za 1 milion tokenów wyjściowych.

Integracja z Gemini Spark

Gemini Spark, dostępny dla subskrybentów Google AI Pro i Ultra w ponad 160 krajach, rozpoczął korzystanie z Gemini 3.7 Flash 13 sierpnia 2026 roku. Spark, pierwotnie wprowadzony na konferencji Google I/O, jest opisywany jako osobisty agent AI działający całodobowo (24/7), podejmujący działania w imieniu użytkownika pod jego kierownictwem. Aktualizacja modelu ma na celu uczynienie Sparka bardziej wydajnym w pracy z wiedzą, z ulepszonym wykorzystaniem narzędzi dla aplikacji Google Workspace, zapewniając lepszą dokładność i jakość wyników w złożonych, wieloumiejętnościowych przepływach pracy. Dzięki 3.7 Flash Spark może wydajniej konsolidować pliki, tworzyć szkice wiadomości e-mail i aktualizować dokumenty statusu.

Środki bezpieczeństwa

Google DeepMind oświadczył, że nieustannie pracuje nad poprawą pokrycia i niezawodności swoich zabezpieczeń Frontier Safety. Gemini 3.7 Flash jest dostarczany ze zaktualizowanymi zabezpieczeniami przed nadużyciami w obszarach zagrożeń chemicznych, biologicznych, radiologicznych i nuklearnych (CBRN) oraz cyberataków, jednocześnie umożliwiając korzystne przypadki użycia, zgodnie z podejściem firmy do bioodporności oraz jej programem cybernetycznym. Dodatkowe szczegóły są dostępne w karcie modelu 3.7 Flash.

Dostępność

  • Deweloperzy: Poznaj przepływy pracy zorientowane na agentów w Google Antigravity lub rozpocznij budowę za pomocą Gemini API poprzez Google AI Studio i Android Studio. Dostępny jest przewodnik dla deweloperów.
  • Przedsiębiorstwa: Uzyskaj dostęp do 3.7 Flash poprzez Gemini Enterprise Agent Platform oraz aplikację Gemini Enterprise.
  • Osoby indywidualne: Dostępne przez Sparka w aplikacji Gemini dla subskrybentów Google AI Pro i Ultra w obsługiwanych krajach.

Źródło: Google DeepMind Blog