xAI выпускает Grok 4.7 после многократных задержек: модель уступает флагманам по бенчмаркам
Ключевые выводы
- •Grok 4.7 использует 2,1 трлн параметров — на 40% больше, чем 1,5 трлн в Grok 4.6, — и стоит $2 за миллион входных токенов и $6 за миллион выходных токенов.
- •xAI дополнила обучение модели данными SpaceX, включая телеметрию спутников Starlink, производственные записи и журналы инженерных сбоев, чтобы улучшить рассуждения о железе и физических системах.
- •По ранним бенчмаркам Grok 4.7 занимает второе место после Claude Fable 5.1 на GDPval (1695 против 1735) и AA-Briefcase (1657 против 1678) и второе после GPT-6 Astra на электротехническом тесте EEBench.
- •Запуск последовал как минимум за пять перенесенными сроками с конца июля, при этом модель сразу стала доступна без листа ожидания в приложении Grok, Cursor, Grok Build и API xAI.
- •Маск заявил, что Grok 4.7 должна оказаться примерно на уровне Claude Opus 5.0 от Anthropic, и описал будущие модели — Grok 4.8, Grok 4.9 и возможного фронт-лидера Grok 5 — без указания дат релиза.

xAI Илона Маска в понедельник днем выпустила Grok 4.7 — самую мощную модель компании на сегодняшний день, которую она назвала «заметным улучшением по сравнению с Grok 4.6 при той же цене и скорости».
По ранним результатам бенчмарков модель заняла второе место после Claude Fable 5.1 на GDPval и AA-Briefcase, а также второе место после GPT-6 Astra на EEBench — бенчмарке по электротехнике.
Запуск состоялся после череды перенесенных сроков. С конца июля Маск как минимум пять раз сдвигал график релиза: сначала «через четыре недели», затем «через несколько недель», затем «через 3–4 недели», затем «10 дней» 1 сентября и, наконец, «нужно еще несколько дней, чтобы доделать» 11 сентября.
На этот раз листа ожидания нет. Grok 4.7 сразу доступна в приложении Grok, Cursor, Grok Build и API xAI.
Маск добавил в X, что Grok 4.7 — «сильное сочетание интеллекта, скорости и низкой стоимости».
Grok 4.7 is here. It's a notable improvement over Grok 4.6 at the same price and speed. pic.twitter.com/H3OTBbXyvO
Согласно официальному анонсу xAI, модель дольше работает над сложными задачами и чаще перепроверяет собственные ответы, чем Grok 4.6, а также оснащена, по словам компании, самыми надежными на сегодняшний день механизмами безопасности.
Масштаб, цены и данные SpaceX
Grok 4.7 насчитывает 2,1 трлн параметров — на 40% больше, чем 1,5 трлн в Grok 4.6, который сам был доработкой Grok 4.5. Стоимость $2 за миллион входных токенов и $6 за миллион выходных токенов. Параметры — это внутренние «ручки», которые модель настраивает во время обучения: чем их больше, тем выше, как правило, способность усваивать закономерности, а токены — это базовые единицы информации, которые модель ИИ может считывать или генерировать.
Кроме того, xAI добавила в обучение дополнительные данные из SpaceX, ракетной компании Маска: телеметрию спутников Starlink, производственные записи и журналы инженерных сбоев. Идея — модель, которая лучше рассуждает о железе и физических системах, чем что-либо, обученное исключительно на интернет-текстах.
Бенчмарки рассказывают знакомую историю
GDPval оценивает, как модель справляется с реальной, экономически значимой интеллектуальной работой — юридическими меморандумами, таблицами, презентациями, — используя задачи, проверенные практикующими специалистами в каждой области, и выставляет рейтинг Эло, ту же систему попарного ранжирования, что используется в шахматах. Grok 4.7 набрала 1695 на GDPval, тогда как Claude Fable 5.1 возглавила таблицу с 1735 — отставание в 40 пунктов по шкале Эло.
AA-Briefcase, разработанный Artificial Analysis, проверяет многочасовую офисную работу, объединяющую исследование, анализ и создание документов в одну длинную задачу, и также оценивается по шкале Эло. Grok 4.7 набрала 1657 против 1678 у Fable 5.1 — меньший разрыв в 21 пункт, и тот же результат на другом тесте.
CursorBench 4.0, бенчмарк Cursor для реальных задач программирования в его редакторе, сопоставляет точность с затратами и количеством токенов на каждую задачу. Grok 4.7 оказывается посередине: дороже за задачу, чем GPT-6 Astra, преемник GPT-5.6 Sol, и Claude Sonnet 5, но все же уступает Fable 5.1, которая выигрывает в каждой ценовой точке на графике.
Повторяющийся сценарий для xAI
Компания не раз выпускала флагманские модели, которые отставали от конкурентов в независимых оценках. Grok 4.5 дебютировала в июле с крупнейшим в отрасли обучающим кластером и третьими результатами после моделей Claude и OpenAI. До нее Grok 4.20 пожертвовала надежностью ради скорости и «характера», а Grok 4.6 также отставала от флагманов по автономности в программировании.
Ничто из этого не делает Grok 4.7 плохим продуктом для миллионов людей, которые общаются с ней через X, отдельное приложение или панель управления своего Tesla. Это лишь означает, что модель, которая с наибольшей вероятностью ответит на вопросы пользователей — или будет управлять голосовым ассистентом их автомобиля, — работает на системе, которую, по бенчмаркам самого разработчика, отделяет одна ступень от вершины.
Именно этот разрыв объясняет, почему для большинства важнее цена, а не позиция в рейтинге. xAI стабильно предлагает более низкую стоимость за токен, чем Anthropic и OpenAI, даже уступая им в чистых возможностях, делая ставку на то, что «достаточно хорошо, дешево и» побеждает «лучше всех, но дороже» в большинстве повседневных сценариев.
Ожидания Маска и перспективы
Еще за несколько дней до запуска Маск написал в X, что Grok 4.7 должна оказаться «примерно на уровне» Claude Opus 5.0 от Anthropic — не более новой Opus 5.1, — а мультимодальные возможности все еще требуют доработки.
В том же посте он описал три следующие модели: Grok 4.8 как существенный шаг вперед, Grok 4.9 класса «Astra/Fable» и Grok 5 как возможного лидера фронтира. У этих обновлений пока нет дат релиза — деталь, приобретающая особый вес с учетом того, что график самого Grok 4.7 как минимум пять раз сдвигался до запуска. «Посмотрим», — написал он.