НовостиМакроGoogle выпустила Gemini 3.7 Flash, а OpenAI представила превью GPT-5.6 Sol Ultrafast, работающей в 14 раз быстрее

Google выпустила Gemini 3.7 Flash, а OpenAI представила превью GPT-5.6 Sol Ultrafast, работающей в 14 раз быстрее

Автор: Decrypt·

Ключевые выводы

  • Gemini 3.7 Flash общедоступна и может использоваться более чем в 160 странах.
  • Модель принимает до одного миллиона входных токенов и может обрабатывать текст, изображения, видео, аудио, PDF и вызовы инструментов.
  • По данным Google, Gemini 3.7 Flash выполнила тестовую задачу по программированию за 2 минуты 13 секунд — быстрее предыдущей модели Flash.
  • OpenAI представила превью GPT-5.6 Sol Ultrafast — уровень API с доступом по приглашениям, использующий чипы Cerebras и достигающий 750 выходных токенов в секунду.
  • Google установила цену Gemini 3.7 Flash на уровне 75 центов за миллион входных токенов и 3,75 доллара за миллион выходных токенов до конца года, после чего 31 декабря тарифы вырастут.
Google выпустила Gemini 3.7 Flash, а OpenAI представила превью GPT-5.6 Sol Ultrafast, работающей в 14 раз быстрее

В четверг Google запустила Gemini 3.7 Flash — недорогую модель для программирования и агентов, которая уже общедоступна. В тот же день OpenAI представила превью GPT-5.6 Sol Ultrafast — уровень обслуживания на чипах Cerebras, ускоряющий её самую мощную модель до 14 раз. Гонка скорости сместилась от «сырого интеллекта» к агентам реального времени — но сегодня лишь модель Google доступна каждому разработчику.

Google и OpenAI продвигали одно и то же послание: ИИ теперь достаточно быстр, чтобы впечатлять тех, кто использует ИИ-агентов, — каждая из компаний анонсировала ультрабыстрые модели. Эти два запуска устроены по-разному, и лишь один из них сегодня действительно находится в руках разработчиков. Ориентация на скорость имеет структурную причину: агенты могут выстраивать в цепочку множество последовательных вызовов модели — планирование, вызов инструментов, проверка результатов, — поэтому задержка каждого вызова накапливается в рамках одной задачи.

Google выпустила Gemini 3.7 Flash — свою новейшую модель, настроенную для программирования и автономных бизнес-процессов. OpenAI открыла ограниченное превью GPT-5.6 Sol Ultrafast — нового уровня обслуживания, который работает с её самой мощной моделью со скоростью до 750 выходных токенов в секунду.

Today we're introducing Gemini 3.7 Flash, our most intelligent workhorse model yet for coding and agents. This model brings substantial gains across software engineering, web development, and complex knowledge work. Now through the end of the year, Gemini 3.7 Flash is available… pic.twitter.com/RSCBDipjKn

— Google (@Google) August 13, 2026 (X post)

Gemini 3.7 Flash — общедоступная модель. Она принимает до одного миллиона входных токенов — примерно 750 000 слов — и возвращает 64 000, работая с текстом, изображениями, видео, аудио и PDF, а также может вызывать инструменты и управлять компьютером. Google позиционирует её как недорогой «мозг» для автономных систем, которые планируют задачи и выполняют многоэтапную работу с меньшим участием человека.

Модель не жертвует качеством ради скорости. Она одновременно более способная и более эффективная: тестовую задачу по программированию Google она выполняет за 2 минуты 13 секунд, тогда как последней модели Flash потребовалось более 5 минут. Разрыв в качестве между ними также заметен.

Ultrafast от OpenAI — это не новая модель. Это GPT-5.6 Sol — та же модель, которую OpenAI перед запуском усиливала с помощью ИИ-«красной команды» для защиты от атак через инъекции в промптах, — но на более быстром пути благодаря чипам производителя Cerebras. Она примерно в 14 раз быстрее стандартной скорости самой GPT-5.6 Sol.

Previewing Ultrafast mode: GPT-5.6 Sol at up to 14x the speed. Launching first in the OpenAI API to a select group of customers with expanded access to more businesses as capacity grows. pic.twitter.com/a5dleofiDJ

— OpenAI (@OpenAI) August 13, 2026 (X post)

Ваферномасштабные чипы Cerebras (процессоры, изготавливаемые размером почти с целую кремниевую пластину, а не как множество маленьких чипов, которые обычно из неё вырезают) генерируют до 750 токенов в секунду — около 560 слов — достаточно быстро, чтобы голосовой агент мог «думать» прямо во время разговора.

Цифры, которые имеют значение

Согласно собственным бенчмаркам Google, Gemini 3.7 Flash опережает Claude Sonnet 5, GPT-5.6 Terra и другие модели в 11 из 18 протестированных категорий, включая высший результат Code Arena в веб-разработке — 1 588 Elo — и 30,4% на AutomationBench для корпоративных рабочих процессов. Всё это основано на методологии Google, поэтому лидерство следует воспринимать как заявление самой компании.

Как и любая модель линейки Gemini Flash, она также недорога. По цене 75 центов за миллион входных токенов и 3,75 доллара за миллион выходных токенов до конца года она стоит вдвое меньше первоначальной ставки Gemini 3.6 Flash. Эта вводная цена действует до 31 декабря, затем удваивается до 1,50 и 7,50 доллара — что всё ещё недорого для модели Google.

OpenAI пока не публиковала прямых сравнительных результатов для Ultrafast, помимо отзывов клиентов. Инженер по ИИ из Jane Street Джон Крепецци (John Crepezzi) заявил в анонсе OpenAI, что скорость Cerebras «открывает новые способы использования моделей». Руководитель продукта Podium Кортленд Лайкинс (Courtland Lykins) назвал её «незаменимой в нашем голосовом стеке», отметив, что скорость «полностью меняет впечатления от звонков». Пока этот уровень доступен только по приглашениям.

Этот рывок в скорости происходит на фоне того, как лаборатории смещают фокус с вопроса «кто умнее» на вопрос «кто достаточно быстр для агентов». Тайминг Google показателен. Её флагманская Gemini 3.5 Pro всё ещё не представлена, дата выпуска не названа — спустя три недели после 3.6 Flash и через несколько дней после перестановок в руководстве DeepMind, в результате которых Демис Хассабис (Demis Hassabis) уступил место своему заместителю Кораю Кавукчуоглу (Koray Kavukcuoglu). OpenAI, со своей стороны, арендует скорость Cerebras, а не ждёт собственного стека.

Gemini 3.7 Flash уже доступна более чем в 160 странах; GPT-5.6 Sol Ultrafast по-прежнему доступна только по приглашениям.