НовостиМакроOpenAI приостановила часть работ над Astra из-за «критических» выводов в области кибербезопасности; обучение продолжалось, заявил Альтман

OpenAI приостановила часть работ над Astra из-за «критических» выводов в области кибербезопасности; обучение продолжалось, заявил Альтман

Автор: CryptoBriefing·

Ключевые выводы

  • OpenAI сообщила, что возможности Astra в области кибербезопасности достигли или приблизились к «критическому» уровню в рамках её системы Preparedness Framework.
  • Модель продемонстрировала продвинутые навыки агентного программирования и потенциал для обнаружения или эксплуатации уязвимостей нулевого дня.
  • OpenAI приостанавливала затронутые внутренние работы чуть более двух недель, пока внедряла новые меры безопасности.
  • Сэм Альтман заявил, что базовое обучение Astra не прекращалось и что новые модели по-прежнему ожидаются в ближайшее время.
OpenAI приостановила часть работ над Astra из-за «критических» выводов в области кибербезопасности; обучение продолжалось, заявил Альтман

7 августа 2026 года OpenAI остановила некоторые внутренние работы, связанные с моделью Astra, после того как предварительные результаты указали, что ИИ достиг того, что компания классифицирует как «критические» возможности в области кибербезопасности. Однако генеральный директор Сэм Альтман подчеркнул, что базовое обучение Astra никогда не прекращалось и что новые модели по-прежнему должны быть выпущены в ближайшее время.

Что привело к приостановке

Причина беспокойства — возможности Astra в области кибербезопасности, которые, как сообщается, достигли или приблизились к «критическому» уровню в рамках Preparedness Framework OpenAI — высшей классификации, используемой компанией для оценки рисков моделей.

На практике модель продемонстрировала сложные навыки агентного программирования и потенциал для выявления или эксплуатации уязвимостей нулевого дня. Уязвимости нулевого дня — это изъяны безопасности, о которых разработчики программного обеспечения ещё не знают, что делает их чрезвычайно ценными как для защитников, так и для злоумышленников. Обнаружение уязвимостей с помощью ИИ уже является активным направлением работы: конкурс DARPA AI Cyber Challenge, финал которого прошёл на конференции хакеров DEF CON в 2025 году, ставил перед ИИ-системами задачу находить и исправлять изъяны в широко используемом программном обеспечении с открытым исходным кодом, что подчёркивает как оборонный потенциал, так и риск двойного применения рассматриваемой возможности.

Приостановка длилась чуть более двух недель, пока OpenAI внедряла новые меры безопасности вокруг этих конкретных возможностей. В течение этого периода компания оценивала риски и вводила защитные механизмы, прежде чем возобновить затронутые работы.

Более широкие возможности Astra

Кибербезопасность — лишь один из аспектов того, что, по всей видимости, является исключительно мощной моделью. Как сообщается, более ранняя версия Astra решила 10 крупных открытых проблем математики и теоретической информатики — утверждение, которое при независимом подтверждении стало бы знаковым достижением в исследованиях ИИ.

Альтман заявил, что Astra планируется сделать «общедоступной», то есть она не будет бесконечно долго оставаться за закрытым исследовательским доступом. При этом он признал, что потребуется больше времени, чтобы обеспечить безопасную разработку модели, с особым вниманием к её кибервозможностям перед более широким запуском.

Баланс между безопасностью и скоростью

Preparedness Framework OpenAI была создана именно для подобных ситуаций. Представленная в октябре 2023 года, эта система устанавливает уровни риска — от «низкого» до «критического» — по категориям, включая кибербезопасность, убеждение, автономность и биологические угрозы. Когда модель достигает критического уровня в любой из категорий, перед развёртыванием запускаются дополнительные процедуры проверки и снижения рисков.

Похожие системы сегодня существуют и в других лабораториях передового ИИ: Responsible Scaling Policy компании Anthropic и Frontier Safety Framework компании Google DeepMind обе определяют пороговые значения возможностей, при достижении которых включаются более строгие меры защиты, что делает многоуровневую оценку риска формирующейся отраслевой нормой. Сообщаемый вывод о достижении Astra критического уровня — один из самых наглядных публичных примеров срабатывания такого порога в крупной лаборатории на сегодняшний день.

Внимание к этой системе также следует за насыщенным периодом в области управления безопасностью OpenAI. В 2024 году компания распустила свою долгосрочную команду Superalignment после ухода её руководителей Ильи Суцкевера и Яна Лейке, включив её работу в более широкие усилия по безопасности — цепочка событий, которая держала вопросы баланса компании между темпом и осторожностью в центре общественного внимания.

За чем следить дальше

Ближайший вопрос — когда Astra или созданные на её основе модели фактически появятся у пользователей. Заявление Альтмана о том, что новые модели ожидаются в скором времени, говорит о том, что сроки, несмотря на приостановку, существенно не сдвинулись.

Также стоит следить за тем, опубликовит ли OpenAI подробные результаты своей оценки безопасности. Модель, достигающая критического уровня риска в кибербезопасности, по-видимому, заслуживает тщательного публичного отчёта о том, что было обнаружено и какие меры были приняты, — а с учётом того, что Anthropic и Google DeepMind используют аналогичные пороговые системы, и того, начнут ли профильные лаборатории раскрывать собственные сопоставимые оценки.