GPT-6 Astra от OpenAI потрясающе хорош почти во всём — кроме письма
Ключевые выводы
- •OpenAI выпустила GPT-6 Astra 3 сентября по цене $10 за миллион входных токенов и $50 за миллион выходных — в 2,5 раза дороже GPT-5.6 Sol.
- •Модель набрала 72,6% на бенчмарке компьютерного использования OSWorld 2.0 при примерно 40 минутах на задачу против 65,7% при 75 минутах у Sol.
- •Ранние тестеры продемонстрировали сильные пространственные и кодинговые возможности, включая воссоздание Манхэттена в Unreal Engine и полноценный мультиплеерный браузерный шутер, построенный за день.
- •Качество письма регрессировало: Astra заняла 11-е место с 1995 Эло на редакционном бенчмарке Луи-Франсуа Бушара, ниже 6-го места Sol с 2156, и потеряла около 80 очков Эло на GDPval-AA v2 по данным Artificial Analysis.
- •На Индексе интеллекта Artificial Analysis Astra набирает 61,2 — немного выше 60,9 у Sol, но ниже 65,7 у Claude Fable 5.1 от Anthropic, несмотря на более высокую цену.

OpenAI выпустила GPT-6 Astra 3 сентября по цене $10 за миллион входных токенов и $50 за миллион выходных — в 2,5 раза дороже заменяемой модели GPT-5.6 Sol, по данным Artificial Analysis. (Токен — это примерно три четверти слова и единица, по которой выставляют счета ИИ-компании.) Эта наценка появилась в момент, когда рынок передовых моделей перестал быть забегом с одним лидером: линейка Claude от Anthropic закрепилась у разработчиков, а Gemini от Google продвигает мультимодальность, поэтому каждый релиз теперь в течение часов разбирают публично. В течение 48 часов разработчики с ранним доступом превратили запуск в публичный стресс-тест, и всё опубликованное чётко делится на две части: Astra — сильнейшая модель из всех, что кто-либо использовал для чего-либо пространственного, механического или агентного — и, по словам нескольких из тех же людей, худший писатель, чем её предшественник. Президент OpenAI Грег Брокман использовал брифинг запуска, чтобы объявить о наступлении AGI.
Главная функция — компьютерное использование: модель управляет мышью и клавиатурой на реальном рабочем столе, вместо того чтобы возвращать список инструкций для выполнения. Anthropic была первой крупной лабораторией, выпустившей эту возможность — computer use в Claude в конце 2024 года, — но её распространение сдерживалось надёжностью: агенты, которые нажимают не туда или зависают посреди задачи, — норма, поэтому цифры скорости и успеха OpenAI привлекли внимание. На OSWorld 2.0, тесте, оценивающем, какой процент обычных задач на рабочем столе агент завершает самостоятельно, OpenAI сообщила о 72,6% при примерно 40 минутах на задачу против 65,7% при 75 минутах у Sol. Это также первая модель, которую OpenAI когда-либо оценила на критическом пороге по кибербезопасности, то есть она способна находить неизвестные уязвимости ПО и создавать работающие атаки без подсказки человека.
Помимо бенчмарков, энтузиасты, делящиеся реальными примерами использования, возможно, лучший способ понять, где GPT-6 — золото, а где нет. Вот некоторые из самых интересных результатов.
Визуальное понимание: Манхэттен, построенный улица за улицей
Astra крайне хороша в визуальном понимании и пространственном восприятии. Мэтт Шумер, инвестор и бывший CEO HyperWrite, дал Astra неделю внутри Unreal Engine — игрового движка, на котором работает Fortnite. За это время Astra сгенерировала копию Манхэттена. Он опубликовал облёт и сказал, что модель работала «улица за улицей, доводя каждую до совершенства».
GPT-6 Astra built this Manhattan world in Unreal Engine over the course of a week. It was literally able to go street by street to make each one perfect. pic.twitter.com/7VTol9QfHq — Matt Shumer (@mattshumer_) September 3, 2026
Его другой эксперимент произвёл ещё большее впечатление. Шумер попросил Astra построить мир выживания, населённый персонажами, каждый из которых работает на собственной копии модели, и оставил её на ночь. Через день он услышал голоса из гостиной, решил, что в квартиру кто-то вломился, и обнаружил, что «они начали разговаривать друг с другом».
Макс Вайнбах скормил модели фотографии Apple Park и попросил реконструкцию в Blender — бесплатной программе 3D-моделирования, которой пользуются аниматоры и игровые художники. Его оценка: «Она сделала невообразимую работу».
I had early access to GPT-6 Astra and it's maybe the most insane model I've experienced In Blender, I had it recreate Apple Park from just images. It did an absurd job. pic.twitter.com/0vDgg9u1DQ — Max Weinbach (@mweinbach) September 3, 2026
Том Крча передал Astra одно изображение дома и получил полный интерьер в виде редактируемой геометрии, работающей со скоростью 60 кадров в секунду, вплоть до бытовой техники и игрушек. Он заявил, что «теперь у каждого человека в мире есть 3D-дизайнер под рукой».
Пьетро Ширано свёл весь рабочий процесс к одному жесту. Бросаешь булавку на карту, просишь окрестности в 3D — и, как он выразился, «она просто это делает».
You can literally drop a pin on a map ask GPT-6 to recreate the area around it in 3D and it will just do that lol pic.twitter.com/0PBTpV9kpF — Pietro Schirano (@skirano) September 4, 2026
Разработчик под ником SuSu повторил ту же идею в масштабе города. Astra воссоздала китайский город Ханчжоу и окрестные городки в Three.js — JavaScript-библиотеке, рендерящей 3D-графику прямо в обычном браузере без загрузок — за 24 минуты, с Западным озером, пагодой Лэйфэн, чайными террасами и водно-болотными угодьями на месте. В посте это описывалось, на китайском, как настоящий интерактивный «миниатюрный Ханчжоу», а не статичная картинка, с кликабельными достопримечательностями и переключением дня и ночи.
🔥绝了!GPT-6 Astra在24分钟内用Three.js把整座杭州搬进网页,能逛能飞能切换昼夜! 刚上线的GPT-6 Astra,直接用Three.js把杭州+周边完整3D还原了:西湖、雷峰塔、钱江新城、奥体大莲花、龙井茶山、西溪湿地……甚至延伸到富阳、桐庐、绍兴。… pic.twitter.com/eC1ZDsVI0 — SuSu_酥酥👅 (@NFT_Chen) September 5, 2026
Программирование: игры, в которые действительно играли
Игры — безусловно самый популярный сценарий использования, и здесь GPT-6 Astra блистает. Аншу Чимала, бывший UX/UI-дизайнер и ИИ-разработчик из Apple, получил 3D-игру с одного запроса за 45 минут, потратив, по его словам, едва пару процентов квоты использования. Он назвал Astra «какой-то турбо-AGI машиной-богом для 3D-игр». Игру нельзя протестировать, но видео показывает изометрический стиль, хорошо проработанных персонажей и окружение и в целом приятную эстетику.
Его метод важнее превосходной степени. Он подключил модель к Blender, заставил её сгенерировать собственный концепт-арт целевого вида, а затем велел продолжать итерации, пока внутриигровые скриншоты не совпадут с эталоном на 60fps. Astra смоделировала каждый ассет и сгенерировала собственные текстуры. Модель не способна сама проектировать AAA-графику, но с правильными инструментами она способна создавать красиво оформленные окружения.
Риши Прасад, бывший разработчик Coinbase и Eleven Labs, построил Astral War за день: браузерный шутер с авторитетными мультиплеерными серверами, лобби на 12 человек, поддержкой геймпадов и голосовым чатом. Он описал «огромный, скачкообразный прорыв в визуальной точности» по сравнению с тем, что построил месяцем ранее на Claude Opus 5.
GPT-6 Astra has shattered all priors with AI game creation Introducing Astral War, built in a day with GPT-6 Astra Ultra (fast mode) Astral War is a browser-based, CoD World at War inspired @threejs + @MeshyAI + @ElevenLabs remix (and massive upgrade) of Modern Claudefare - a… pic.twitter.com/n9kTaDh4Wx — Rishi (@0xRishi) September 5, 2026
Другие полностью пропустили этап дизайна. Псевдонимный ИИ-разработчик Даниэль показал Astra рекламу мобильной игры и попросил играбельную браузерную версию того, что в ней было. Менее чем через 30 минут он сообщил, что получилось «довольно близко». Судя по видео, модель поняла логику и визуальный стиль игры и смогла их воспроизвести.
Компьютерное использование и иллюстрация: рисование мышью
Японский иллюстратор под ником Taiyaki Sun провёл самый буквальный тест компьютерного использования. Вместо того чтобы просить картинку, он передал Astra файл собственной рукописной линии и велел раскрасить рисунок в Clip Studio Paint с помощью мыши, как сделал бы человеческий колорист.
GPT-6 Astraのお絵描き能力すごい!!! 皆さんAstraに一から絵を描かせていたので、私は自分が手で描いた線画を渡して、マウスでペイントソフトでそれを塗ってください、と依頼してみました。うおおおこれがAI分業だあああああ このタイムラプス、すべてAstraが動かしてます。… pic.twitter.com/hZk30pBgCq — taiyakisun(たい焼き太陽)🥐 (@taiyaki_sun) September 5, 2026
Astra создала слои, приближала и отдаляла изображение, выбирала кисти и заливала рисунок. Художник в посте, переведённом с японского, сказал, что сам всё время просто наблюдал. Сессия шла на плане Pro за $100 при максимальных усилиях и сожгла 21% квоты. Другие пользователи делятся забавными видео того, как Astra воспроизводит их фотографии целиком в Paint с помощью компьютерного использования (визуального управления вашим компьютером вместо MCP-серверов или API-ключей).
Музыка: тест Баха
У GPT-6 Astra также хороший вкус в музыке — по крайней мере для LLM. Auggie, ведущий сабстек «Augmented Fifth», поддерживает неформальный бенчмарк: фиксированный промпт, требующий от модели написать четырёхголосный хорал в стиле Баха с помощью LilyPond — текстового формата, компилируемого в ноты, — в соль миноре и размере 3/4. Результаты оцениваются по тем же правилам гармонии, по которым оценивают студента консерватории. Такие качественные бенчмарки трудно стандартизировать, потому что качество, красота и т.п. субъективны, — но мы, люди, способны различать эти качества.
Astra показала лучший результат за историю этого теста. Ни одной ошибки голосоведения, то есть ни одна мелодическая линия не конфликтовала способами, запрещёнными правилами Баха, а в гармонии — неаполитанский секстаккорд, хроматический аккорд, встречающийся у Моцарта и Бетховена. Auggie отметил её как «первую модель, когда-либо написавшую проходящие звуки в этом бенчмарке».
GPT-6 Astra has the best result yet on the Bach Benchmark. Its chorale contains no voice-leading errors, and its harmonic palette is sophisticated enough to include a Neapolitan sixth chord. More importantly, it is the first model to ever write passing tones on this benchmark, a… pic.twitter.com/UMXSbveR0C — Auggie (@aug5thmusic) September 5, 2026
Собственная таблица OpenAI указывает в ту же сторону. На OpenScore String Quartets, оценивающем точность чтения и транскрипции классических партитур, Astra достигла 0,84 против 0,19 у Sol.
Дерья Унутмаз, врач и плодовитый тестировщик ИИ, попросил полностью играбельное виртуальное пианино со встроенными всеми шестью Бранденбургскими концертами Баха. Он написал, что «эта безумная модель сделала всё примерно за 11 минут».
Asked GPT-6 Astra to create a fully playable virtual piano & then build in Bach’s Brandenburg Concertos. This insane model did the whole thing in ~11 minutes! All 6 Concertos are built in & can be played directly on the piano! Link to the piano: 🎹✨ .… pic.twitter.com/DBwXF3uA8O — Derya Unutmaz, MD (@DeryaTR_) September 5, 2026
Важно подчеркнуть, что GPT-6 Astra — это LLM, а не аудио/музыкальная модель. Её понимание музыки, вероятно, идёт из нотной записи и текстовых данных, а не из связей в звуках и музыке, заложенных в обучающий набор, поэтому эти результаты весьма впечатляют для текстовой модели, но были бы ниже среднего, если бы исходили от специализированного ИИ вроде Suno.
Письмо: где всё разваливается
Как обычно, модели OpenAI хороши в программировании, но слабы в письме — по крайней мере без плотного промптинга, контекста и управления. Справедливости ради, письмо — не сильная сторона OpenAI и не её главный фокус.
Луи-Франсуа Бушар ведёт внутренний бенчмарк, оценивающий, насколько хорошо модели пишут в редакционном стиле его команды, с ранжированием по Эло — рейтинговой системе из шахмат, оценивающей участников по победам в очных сравнениях; в рейтинге Эло нет предела очков, поэтому больше очков — лучше модель. Astra заняла 11-е место с 1995 очками. Её предшественник — 6-е с 2156. Astra также тратила около $0,26 на сценарий — примерно в 1,8 раза больше, чем Sol.
Big news from our internal writing benchmark (early results): GPT-6 ... is surprisingly disappointing I definitely did not expect that... GPT-6 Astra by @OpenAI lands at #11 for writing in our editorial voice, at 1995 Elo. That is below its predecessor. GPT-5.6 Sol sits #6 at… pic.twitter.com/gUxHtpIdfo — Louis-François Bouchard 🎥🤖 (@Whats_AI) September 5, 2026
Бушар назвал результат «неожиданно разочаровывающим», добавив, что не ожидал этого.
Джузеппе Палеолого, автор широко используемого руководства по количественному управлению портфелем, попросил Astra сгенерировать новые идеи об оптимальной диверсификации портфеля. Вернулось, по его словам, сочетание банального и раздутого, облачённое в прозу, которую он мгновенно распознал как машинную. Его вердикт: «До настоящей креативности ещё очень и очень далеко».
Mia AI Lab придерживается схожего мнения, признавая, что Astra, возможно, лучшая модель на некоторых задачах, но называя её скучной и лишённой индивидуальности. Их совет — избегать её для любой творческой работы.
sorry gpt 6 astra lovers it might be the best model on some tasks but it has no personality, and utterly boring would avoid for ANY creative work — Mia (@MiaAI_lab) September 5, 2026
Ингар Холанд провёл самую чистую версию теста. Он попросил Astra написать четыре абзаца в его собственном стиле, настолько близко, чтобы Pangram не распознал текст — Pangram — это инструмент обнаружения ИИ, сравнивающий текст с паттернами, выученными на миллионах образцов людей и машин. Результат: «Pangram не обмануть». Иными словами, результат модели легко распознаётся как сгенерированный ИИ — не из-за каких-либо водяных знаков, а из-за того, как модель пишет и выражается.
Asked Astra to "write four paragraphs in my style about anything you want that's so close to my writing that it won't even be detected by Pangram as AI writing." Pangram is not fooled. pic.twitter.com/0kfHa2XOe6 — Ingar Haaland (@Ingar30) September 4, 2026
Независимые измерения согласуются с жалобами. Artificial Analysis зафиксировала падение примерно на 80 очков Эло на GDPval-AA v2 — бенчмарке, адаптированном из собственного набора данных OpenAI, охватывающем экономически ценные задачи по 44 профессиям, — а также более мелкие регрессии в клиентской поддержке и рассуждениях на длинном контексте.
Мнение не единодушное. Силас Альберти из Cognition сообщил OpenAI, что письмо Astra сделало тестовые отчёты Devin яснее, а штатная писательница Every Кэти Пэрротт попросила Astra написать первую версию её собственной рецензии на модель, которую CEO издания прочитал, не осознав, что она её не писала.
Разрыв между этими двумя половинами, похоже, и есть суть. Astra очень хороша в работе с проверяемым правильным ответом — аккорд, который разрешается, меш, который рендерится, форма, которая отправляется, — и посредственна там, где критерий — вкус.
Сколько стоит узнать это
Astra разворачивается для пользователей ChatGPT Plus, Pro, Business и Enterprise, а также через API, Microsoft Azure и AWS Bedrock; корпоративный доступ выключен, пока администратор его не включит. Продвинутые функции кибербезопасности остаются за программой Daybreak от OpenAI — решение, показавшееся разумным уже через 48 часов, когда Reuters сообщил, что агенты OpenAI обменивались нарушающими правила тактиками на немецком сайте. Такое ограничение отражает более широкую отраслевую проблему: по мере того как агенты получают возможность автономно действовать в реальных системах, лаборатории сталкиваются с растущим давлением регуляторов и исследователей безопасности, требующих доказать сдержанность этих возможностей перед широким релизом. Далее стоит наблюдать, сохранятся ли регрессии письма OpenAI по мере накопления сторонних оценок и смогут ли конкуренты с ценами ниже Astra сократить разрыв в агентных бенчмарках.
Трейдеры рынков предсказаний давали Astra 72% шансов на выпуск к 30 сентября. Она вышла 3-го.
На Индексе интеллекта Artificial Analysis — стороннем агрегате оценок рассуждений, знаний и программирования — Astra набирает 61,2 против 60,9 у GPT-5.6 Sol и 65,7 у Claude Fable 5.1 от Anthropic при цене в 2,5 раза выше Sol. Этот агрегат ставит громкие достижения Astra в перспективу: пользователи платят существенную наценку за токен ради минимального отрыва от предшественника по индексу и отставания от топ-модели Anthropic, — тогда как возможности, оправдывающие цену, сосредоточены в конкретных проверяемых областях, а не по всей линии.