Пользователи GPT-6 Astra заявляют, что новая модель OpenAI стала слабее
Ключевые выводы
- •Некоторые пользователи сообщают, что GPT-6 Astra теперь выдаёт более быстрые ответы с более низким качеством, а разработчик Панкадж Кумар подозревает, что OpenAI сократила вычислительные усилия модели — изменение, которое компания не подтвердила.
- •Salio и исследователь Md Ismail Sojal заявили, что запускали идентичные промпты в день запуска и на текущей версии с теми же настройками, и оба сообщили о худших результатах у текущей модели.
- •Команда Opencode Дакса Раада вернулась к GPT-5.6 Sol после удвоения расходов, заключив, что недостатки Astra не оправдывают её премиальной цены.
- •Критики, включая Antikythera и основателя T3Chat Тео, утверждают, что модель не изменилась, а угасание хайпа недели запуска обнажает давние несоответствия.
- •Astra остаётся первой моделью OpenAI, пересёкшей критический порог риска в области кибербезопасности, и стоит $10 за миллион входных токенов и $50 за миллион выходных токенов — в 2,5 раза больше, чем Sol на запуске.

Пользователи заваливают X жалобами на то, что GPT-6 Astra от OpenAI стала менее способной всего через неделю после запуска. Одни сообщают о более быстрых ответах и худших результатах, другие утверждают, что модель всегда была непоследовательной, а первоначальный восторг просто скрывал её слабости.
Неделю назад GPT-6 Astra восстанавливала Манхэттен улица за улицей внутри игрового движка, впечатляя пользователей своими возможностями. На этой неделе некоторые из тех же пользователей публикуют скриншоты и спрашивают OpenAI, что случилось с моделью.
«Astra feels significantly dumber for me today» («Сегодня Astra ощущается для меня значительно глупее»), — написал анонимный разработчик synthwavedd в X. «Was only a matter of time before The Post-Launch Lobotomy. Shame» («Это было лишь вопросом времени до посмертной лоботомии после запуска. Стыдно»).
Этот паттерн знаком пользователям ИИ-чатботов и агентов, которые иногда чувствуют, что любимая модель после релиза была «nerfed» («ослаблена») — термин из игровой индустрии, описывающий ослабление разработчиками слишком сильного элемента. У мнимого снижения производительности могут быть разумные объяснения, но количество схожих жалоб на GPT-6 Astra побудило пользователей сравнивать результаты и проверять, изменилась ли модель. Этот вопрос имеет практическое значение для разработчиков, чьи продукты работают на моделях, которые они арендуют, а не запускают сами, и поскольку проприетарные системы не открывают внутреннее устройство для изучения, сравнение результатов бок о бок остаётся одним из немногих инструментов проверки, доступных внешним наблюдателям.
Разработчик Пранжал Паливал, ранее хваливший Astra, сказал, что позже изучил код, написанный моделью, и изменил свою оценку.
«We don’t have AGI» («У нас нет AGI»), — написал Паливал. «We have a regression» («У нас регрессия»).
AGI, или общий искусственный интеллект, — это отраслевой термин для машины, способной выполнять практически любую когнитивную задачу, которую может выполнить человек. Президент OpenAI использовал этот термин на запуске Astra. Неделю спустяаливал употребил его, чтобы описать разрыв между кажущимися возможностями модели и её ошибками.
Другие жалобы следуют схожему шаблону. Разработчик Панкадж Кумар перечислил среди симптомов более быстрые ответы и более низкое качество, а также подозрение, что OpenAI «reduced the juice value» («снизила значение juice»). Основательница Saba также спросила OpenAI, почему ей теперь приходится «dumb it down» («упрощать задачи»), чтобы их выполнить.
«Juice value» — не официальный технический термин. В этом контексте пользователи используют его как сокращение для объёма вычислительных усилий, которые модель прикладывает перед ответом, и для подозрения, что OpenAI могла сократить эти усилия после демонстраций запуска. OpenAI не подтвердила, что вносила такие изменения в Astra.
Некоторые пользователи предприняли прямые сравнения. Salio и исследователь Md Ismail Sojal заявили, что запускали идентичные промпты на Astra в день запуска и снова на текущей версии, с теми же настройками. Оба сообщили о худших результатах у текущей модели.
«Today’s GPT-6 Astra output looks worse. GPT-6 Astra at launch vs GPT-6 Astra today» («Сегодняшний результат GPT-6 Astra выглядит хуже. GPT-6 Astra на запуске против GPT-6 Astra сегодня»), — написал Sojal. В посте говорилось, что сравнение проводилось с тем же промптом и настройками и что «[t]he difference is bigger than I expected» («разница больше, чем я ожидал»).
Другие пользователи говорят, что вернулись к предшественнику Astra. Дакс Раад, создающий инструмент для программирования Opencode, сказал, что его команда вернулась к GPT-5.6 Sol, потому что их расходы удвоились, а недостатки использования Astra не оправдывали затрат. Пользователь ChatGPT Mustafa Sahinli сравнил Astra с Claude Opus 4.6 «after 1 week of release» («через 1 неделю после релиза»), отсылая к критике, с которой также столкнулась модель Anthropic после запуска.
Не все считают, что OpenAI намеренно ослабила Astra. Анонимный пользователь Antikythera представил детальный опровержение, утверждая, что хронология может быть обратной.
«It is as dumb as it was on launch» («Она такая же глупая, как и на запуске»), — написал Antikythera. «The model is good, but the model has a lot of problems. It’s lazy. Writes like a bullet-point-addict... people were overhyped on launch week, now they had time to test it and see its mistakes» («Модель хорошая, но у неё много проблем. Она ленивая. Пишет как зависимая от маркированных списков... люди были переоценены в неделю запуска, теперь у них было время протестировать её и увидеть её ошибки»).
Согласно этому объяснению, Astra не стала менее способной; пользователи просто перестали быть ослеплёнными её ранними демонстрациями и начали замечать её повторяющиеся проблемы.
Тео, основатель T3Chat, высказал схожее мнение. Он сказал, что Astra более непоследовательна, чем Claude Fable, и может выдавать как выдающийся, так и крайне плохой код.
«GPT-6 Astra has done incredible things I never thought a model could do. It has also done some of the stupidest things I’ve ever seen a model do. Generally speaking, Fable 5.1 just does what I ask» («GPT-6 Astra делала невертные вещи, которые я никогда не думал, что модель сможет делать. Она также делала некоторые из самых глупых вещей, которые я когда-либо видел у модели. В целом Fable 5.1 просто делает то, о чём я прошу»), — написал Тео в X 8 сентября 2026 года. Рост числа негативных примеров, по его словам, может отражать окончание начального «медового месяца» модели, а не подтверждённое изменение её поведения.
Дискуссия перекликается с событиями вокруг предыдущей флагманской модели OpenAI, GPT-5.6 Sol. В июле пользователи заявили, что высший режим рассуждений Sol внезапно стал менее глубоким. Руководитель OpenAI Тибо Соттио отрицал намеренное ослабление модели, но подтвердил, что компания экспериментировала с «reasoning effort» — настройкой, контролирующей, сколько шагов модель «продумывает» перед ответом.
Один ответ резюмировал повторяющуюся шутку о закрытых ИИ-лабораториях: компания выпускает модель, а несколько дней спустя она «подхватывает какую-то болезнь и внезапно становится глупее». Другой пользователь предложил более циничное объяснение: «Они, вероятно, квантуются, чтобы не сжигать деньги компаний так сильно».
Квантизация снижает точность внутренних вычислений модели для сокращения затрат, часто с потенциальным ущербом для точности. OpenAI никогда не подтверждала намеренную квантизацию выпущенной модели.
OpenAI не выпустила заявления в стиле Sol по поводу Astra. В июле аналогичная волна жалоб на Sol получила публичный ответ от руководителя компании; ответит ли OpenAI на жалобы по Astra так же, остаётся открытым вопросом. Модель остаётся первой в компании, пересёкшей так называемый критический порог риска в области кибербезопасности. Эта обозначение означает, что Astra может находить и объединять в цепочки ранее неизвестные уязвимости программного обеспечения без участия человека — возможность, ограниченная проверенными защитниками через программу OpenAI Daybreak.
Независимо от того, стала ли Astra менее способной, её заявленная цена остаётся $10 за миллион входных токенов и $50 за миллион выходных токенов — в 2,5 раза больше, чем Sol взимала на запуске, — премиум, который, как уже заключила как минимум одна команда, не стоит платить.