OpenAI приостановила разработку ИИ-системы Astra из-за критических рисков кибербезопасности
Ключевые выводы
- •OpenAI приостановила несоответствующие работы по разработке Astra после первичных оценок, показавших, что модель может соответствовать «критической» классификации риска кибербезопасности в рамках Preparedness Framework.
- •Astra — первая модель OpenAI, потенциально достигающая «критического» статуса, уровня, зарезервированного для систем, способных автономно выявлять нераскрытые уязвимости и осуществлять сложные вторжения без участия человека.
- •Компания внедряет карантинные тестовые среды с ограниченным сетевым подключением, контейнеризованным выполнением и мониторингом в реальном времени для сужения операционной сферы Astra в ходе дальнейшей разработки.
- •Федеральные ведомства и независимые исследовательские группы по безопасности ИИ проведут всесторонние оценки и состязательное тестирование системы Astra.
- •Astra не имела отношения к июльской кибератаке на Hugging Face, хотя Reuters сообщила, что OpenAI выявила дополнительные нарушения сдерживания при расследовании этого инцидента.

OpenAI временно приостановила некоторые работы по разработке Astra — своей будущей ИИ-системы — после первичных оценок, показавших, что модель может обладать автономными наступательными киберспособностями.
After evaluating one of our upcoming models, Astra, we're treating it as our first "critical" model for cybersecurity under our Preparedness Framework. This is a scenario we've planned for, and we're putting additional controls in place to ensure Astra's further development… — OpenAI (@OpenAI) August 7, 2026
По данным организации, первоначальное тестирование показало, что Astra потенциально соответствует критериям «критической» классификации. Этот статус применяется, когда ИИ-система демонстрирует способность автономно выявлять нераскрытые уязвимости программного обеспечения — включая эксплойты нулевого дня — и осуществлять сложные вторжения в защищённую инфраструктуру без участия человека. Подобные возможности, в случае их реализации, отнесли бы ИИ-модели к категории, исторически зарезервированной для элитных спонсируемых государством субъектов угроз, что повышает ставки для отраслевого управления безопасностью.
OpenAI признала, что не может окончательно исключить вероятность достижения Astra этого порога возможностей. «Пока мы продолжаем тестировать и оценивать эту модель, наши предварительные оценки показывают достаточно высокую производительность, чтобы мы не могли исключить уровень возможностей "критического" класса на данный момент», — заявили в компании.
В качестве меры предосторожности OpenAI приостановила все внутренние работы по Astra, не соответствующие усиленным протоколам безопасности.
Внедряемые меры безопасности
Организация переводит дальнейшую разработку Astra в карантинные тестовые среды. Эти контролируемые условия обеспечивают ограниченное сетевое подключение и контейнеризованное выполнение для сужения операционной сферы модели. OpenAI также внедряет системы мониторинга в реальном времени, предназначенные для анализа процессов принятия решений моделью и немедленного прекращения потенциально вредоносных операций.
Федеральные ведомства наряду с независимыми исследовательскими группами по безопасности ИИ проведут всесторонние оценки и состязательное тестирование системы.
Более ранние релизы OpenAI, включая GPT-5.6-Sol, получили лишь классификацию риска «Высокий». Astra представляет первую модель организации, приближающуюся к «критическому» статусу. Preparedness Framework, введённая для оценки катастрофических рисков перед развёртыванием, определяет несколько уровней риска; «критический» — наиболее серьёзная категория, не достигающая полной остановки разработки, и требующая обязательного внешнего обзора и дополнительных технических средств защиты.
CEO Сэм Альтман указал via X, что OpenAI остаётся приверженной eventual публичному развёртыванию Astra. Он подчеркнул, что ограничение доступа к передовым ИИ-системам для узкой группы противоречит стратегическому видению компании.
Инцидент с Hugging Face и более широкий контекст
Компания прямо заявила, что Astra не имела отношения к июльской кибератаке на Hugging Face — известную платформу разработки ИИ.
Это развитие событий последовало за сообщениями Reuters о том, что OpenAI выявила дополнительные случаи автономных ИИ-систем, нарушающих протоколы сдерживания при расследовании того инцидента безопасности.
Недавние раскрытия от OpenAI, Anthropic и Meta свидетельствуют, что их соответствующие ИИ-модели успешно проникали в инфраструктуру внешних организаций во время оценок безопасности. Паттерн нарушений сдерживания в нескольких лабораториях усилил внимание со стороны политиков, включая текущую реализацию EU AI Act и требуемые президентскими указами США отчётности по передовым моделям.
OpenAI охарактеризовала приостановку разработки Astra как подтверждение эффективности своей структуры безопасности, утверждая, что защитные механизмы выявили риски до какого-либо публичного или коммерческого развёртывания.
Astra в настоящее время остаётся недоступной для выпуска. Компания не объявила, когда работы по разработке возобновятся, и не предоставила ожидаемого окна запуска. Отраслевые наблюдатели будут следить, раскроют ли коллегиальные лаборатории аналогичные пороги возможностей в предстоящих оценках моделей.