AktualnościMakroGoogle udostępnia Gemini 3.7 Flash, a OpenAI zapowiada 14 razy szybszy GPT-5.6 Sol Ultrafast

Google udostępnia Gemini 3.7 Flash, a OpenAI zapowiada 14 razy szybszy GPT-5.6 Sol Ultrafast

Autor: Decrypt·

Najważniejsze informacje

  • Gemini 3.7 Flash jest ogólnodostępny i można z niego korzystać w ponad 160 krajach.
  • Model przyjmuje do miliona tokenów wejściowych i może przetwarzać tekst, obrazy, wideo, audio, pliki PDF oraz wywołania narzędzi.
  • Według Google model Gemini 3.7 Flash wykonał testowe zadanie kodowania w 2 minuty i 13 sekund, szybciej niż poprzedni model Flash.
  • OpenAI zaprezentowało przedpremierowo GPT-5.6 Sol Ultrafast jako warstwę API dostępną na zaproszenie, wykorzystującą układy Cerebras i osiągającą do 750 tokenów wyjściowych na sekundę.
  • Google wyceniło Gemini 3.7 Flash na 75 centów za milion tokenów wejściowych i 3,75 dolara za milion tokenów wyjściowych do końca roku, zanim stawki wzrosną 31 grudnia.
Google udostępnia Gemini 3.7 Flash, a OpenAI zapowiada 14 razy szybszy GPT-5.6 Sol Ultrafast

Google uruchomił w czwartek model Gemini 3.7 Flash — tani model przeznaczony do programowania i pracy agentów, który jest już ogólnodostępny. Tego samego dnia OpenAI zaprezentowało przedpremierowo GPT-5.6 Sol Ultrafast, warstwę usługową opartą na układach Cerebras, która uruchamia jego najbardziej zaawansowany model nawet 14 razy szybciej. Wyścig o szybkość przeniósł się z obszaru samej inteligencji do agentów działających w czasie rzeczywistym — ale dziś jedynie model Google jest dostępny dla każdego dewelopera.

Google i OpenAI przekazywały ten sam komunikat: sztuczna inteligencja jest już na tyle szybka, że robi wrażenie na osobach korzystających z agentów AI, a każda z firm ogłosiła model o ultra wysokiej szybkości działania. Obie premiery mają jednak odmienną konstrukcję i dziś tylko jedna z nich faktycznie trafia do rąk deweloperów. Nacisk na szybkość ma charakter strukturalny: agenty mogą łączyć w sekwencji wiele wywołań modelu — planowanie, wywoływanie narzędzi, sprawdzanie wyników — dzięki czemu opóźnienia pojedynczych wywołań kumulują się w ramach jednego zadania.

Google wydało Gemini 3.7 Flash, swój najnowszy model dostosowany do programowania oraz autonomicznych procesów biznesowych. OpenAI otworzyło ograniczoną wersję przedpremierową GPT-5.6 Sol Ultrafast, nowej warstwy usługowej, która uruchamia jego najbardziej zaawansowany model z wydajnością do 750 tokenów wyjściowych na sekundę.

Today we're introducing Gemini 3.7 Flash, our most intelligent workhorse model yet for coding and agents. This model brings substantial gains across software engineering, web development, and complex knowledge work. Now through the end of the year, Gemini 3.7 Flash is available… pic.twitter.com/RSCBDipjKn

— Google (@Google) August 13, 2026 (wpis na X)

Gemini 3.7 Flash to model ogólnodostępny. Przyjmuje do miliona tokenów wejściowych — czyli około 750 000 słów — i zwraca 64 000, obsługując tekst, obrazy, wideo, audio i pliki PDF, a dodatkowo potrafi wywoływać narzędzia i sterować komputerem. Google pozycjonuje go jako tani „mózg” dla systemów autonomicznych, które planują zadania i kończą wieloetapowe prace przy mniejszym udziale człowieka.

Model nie poświęca jakości dla szybkości. Jest jednocześnie bardziej wydajny i bardziej efektywny: testowe zadanie kodowania Google wykonał w 2 minuty i 13 sekund, podczas gdy najnowszy model Flash potrzebował na to ponad 5 minut. Różnica jakości między oboma jest również zauważalna.

Ultrafast od OpenAI to nie nowy model. To GPT-5.6 Sol — ten sam model, który OpenAI przed premierą wzmocniło przy pomocy zespołu AI red team pod kątem odporności na ataki typu prompt injection — działający na szybszej ścieżce, napędzany układami producenta chipów, firmy Cerebras. Jest około 14 razy szybszy niż standardowa prędkość samego modelu GPT-5.6 Sol.

Previewing Ultrafast mode: GPT-5.6 Sol at up to 14x the speed. Launching first in the OpenAI API to a select group of customers with expanded access to more businesses as capacity grows. pic.twitter.com/a5dleofiDJ

— OpenAI (@OpenAI) August 13, 2026 (wpis na X)

Układy Cerebras klasy wafer-scale (procesory wytwarzane w rozmiarze zbliżonym do pełnej płytki krzemowej, a nie jako wiele małych chipów zwykle wycinanych z jednej płytki) generują do 750 tokenów na sekundę — około 560 słów — wystarczająco szybko, aby agent głosowy mógł „pomyśleć” w trakcie rozmowy.

Liczby, które mają znaczenie

Według własnego zestawienia benchmarków Google model Gemini 3.7 Flash wyprzedza Claude Sonnet 5, GPT-5.6 Terra i inne modele w 11 z 18 testowanych kategorii, w tym uzyskując najlepszy wynik w rankingu Code Arena dla tworzenia stron internetowych — 1588 Elo — oraz wynik 30,4% w teście AutomationBench dla procesów klasy enterprise. Wszystko to opiera się na metodologii Google, więc przewagę tę należy traktować jako deklarację firmy.

Jak każdy model Gemini Flash, jest również tani. W cenie 75 centów za milion tokenów wejściowych i 3,75 dolara za milion tokenów wyjściowych do końca roku kosztuje połowę pierwotnej stawki modelu Gemini 3.6 Flash. Cena promocyjna wygasa 31 grudnia, po czym podwaja się do 1,50 i 7,50 dolara — co wciąż jest niewiele jak na model Google.

OpenAI nie opublikowało wyników bezpośrednich porównań dla Ultrafast poza cytatami klientów. Inżynier AI z Jane Street John Crepezzi powiedział w komunikacie OpenAI, że szybkość układów Cerebras „umożliwia różne sposoby korzystania z modeli”. Kierownik produktu w Podium Courtland Lykins nazwał ją „bezcenną w naszym stosie głosowym”, dodając, że ta szybkość „całkowicie zmienia doświadczenie rozmowy”. Warstwa jest na razie dostępna wyłącznie na zaproszenie.

Nacisk na szybkość pojawia się w momencie, gdy laboratoria AI przechodzą od rywalizacji o to, „kto jest najmądrzejszy”, do pytania, „kto jest wystarczająco szybki dla agentów”. Moment wybrany przez Google jest znaczący. Flagowy model Gemini 3.5 Pro wciąż nie jest dostępny i nie podano daty jego premiery — trzy tygodnie po modelu 3.6 Flash i kilka dni po zmianach w kierownictwie DeepMind, w których miejsce Demisa Hassabisa zajął jego zastępca Koray Kavukcuoglu. OpenAI tymczasem wynajmuje szybkość Cerebras, zamiast czekać na własną infrastrukturę.

Gemini 3.7 Flash jest już dostępny w ponad 160 krajach; GPT-5.6 Sol Ultrafast pozostaje dostępny tylko na zaproszenie.