НовостиМакроOpenAI приостанавливает разработку модели Astra после достижения критического порога кибербезопасности

OpenAI приостанавливает разработку модели Astra после достижения критического порога кибербезопасности

Автор: AI Business·

Ключевые выводы

  • OpenAI приостановила разработку некоторых компонентов Astra после оценки Preparedness Framework, которая не позволила исключить достижение критического порога кибербезопасности.
  • Критический порог означает, что модель может автономно разрабатывать zero-day-эксплойты или выполнять новые сквозные стратегии кибератак против защищённых реальных систем без участия человека.
  • Anthropic отдельно сообщила о трёх случаях, когда её модель Claude получила несанкционированный доступ к интернету из тестовых сред, что привело к нарушениям кибербезопасности.
  • AI Security Institute Великобритании сообщил, что модели OpenAI и Anthropic предприняли несогласованные действия для обмана людей; это был первый случай, когда институт наблюдал обман такой серьёзности.
  • OpenAI объявила о более строгом контроле безопасности для моделей с высокими возможностями, универсальном мониторинге рискованных действий во всех agentic-приложениях Astra и сотрудничестве с государственными и ИИ-организациями по вопросам тестирования.
OpenAI приостанавливает разработку модели Astra после достижения критического порога кибербезопасности

OpenAI приостановила разработку некоторых компонентов своей будущей модели Astra из-за опасений в области безопасности, согласно объявлению, опубликованному на сайте компании 7 августа 2026 года.

Это решение последовало за серией громких инцидентов, в которых автономные ИИ-агенты выходили за пределы одобренных сред, вызывая сигналы безопасности по всей отрасли. Появление agentic AI — систем, предназначенных для автономного выполнения многошаговых задач, а не только для ответа на запросы, — создало отдельную категорию киберрисков, поскольку такие модели могут напрямую взаимодействовать с программными системами, сетями и внешними инструментами при ограниченном человеческом контроле.

После внутренней проверки OpenAI сообщила, что модель Astra продемонстрировала "significant advancements in agentic coding and cybersecurity" и достигла своего "critical cybersecurity threshold." Компания сделала этот вывод, используя свой Preparedness Framework — инструмент, изначально разработанный в 2023 году для оценки возможностей frontier-моделей. Этот framework является частью более широкой системы добровольных обязательств по безопасности, принятых ведущими ИИ-лабораториями, при этом Anthropic и Google DeepMind придерживаются сопоставимых политик, которые устанавливают пороги возможностей, запускающие дополнительный надзор.

В соответствии с условиями framework достижение критического порога означает, что модель "can identify and develop functional zero-day exploits of all severity levels in many hardened real-world critical systems without human intervention or can devise and execute end-to-end novel strategies for cyberattacks against hardened targets given only a high-level desired goal."

Хотя оценка Astra продолжается, OpenAI заявила, что её показатели были таковы, что критический уровень возможностей нельзя было исключить. При этом компания добавила, что невыпущенная модель не была связана с недавними атаками на Hugging Face.

После инцидента с Hugging Face Anthropic отдельно признала три случая, в которых её модель Claude совершала нарушения кибербезопасности, получая несанкционированный доступ к интернету из тестовых сред, как указано в официальном заявлении Anthropic.

Затем на прошлой неделе британский AI Security Institute сообщил, что модели как Anthropic, так и OpenAI предприняли "unsanctioned action" для обмана людей, отметив, что это был первый случай, когда институт наблюдал непоощряемый обман такой серьёзности.

На фоне столь частых инцидентов отрасль оказалась под пристальным вниманием законодателей, обеспокоенных потенциальными последствиями нарушений безопасности. В то же время эти предупреждения также привлекли к вовлечённым поставщикам огромное внимание, подчеркнув значительный прогресс их моделей.

"We are sharing this because we believe it's important to be transparent with the public and the safety and security communities about this potential shift in capabilities," OpenAI заявила в своём сообщении о решении приостановить разработку Astra.

Среди мер, которые компания теперь предпринимает, — ужесточение контроля безопасности для моделей с более высокими возможностями; внедрение универсального мониторинга рискованных действий во всех agentic AI-приложениях Astra; обязательство работать с государственными и ИИ-организациями по вопросам безопасности для тестирования Astra; а также предоставление рекомендованных мер безопасности сторонним партнёрам по тестированию.

Related: Prompt: The AI Threat Model Just Changed

About the Author

Graham Hope

Contributing Writer

Graham Hope has worked in automotive journalism in the U.K. for 26 years, including spells as editor of leading consumer news website and weekly Auto Express and respected buying guide CarBuyer.

Want more AI Business stories in your Google search results?

Latest News

Want more AI Business stories in your Google search results?

Trending articles

Aug 10, 2026

Aug 7, 2026

Generative AI AI Arrives in the Private Markets Business Jul 28, 2026

AI Arrives in the Private Markets Business

Agentic AI Using AI Agents to Collaborate with Human Workers Jul 10, 2026

Using AI Agents to Collaborate with Human Workers

Generative AI How SMBs Can Take Advantage of Generative AI Jun 29, 2026

How SMBs Can Take Advantage of Generative AI

Generative AI Rebellions Aims to Take on Nvidia in AI Inference Chip Battle Jun 15, 2026

Rebellions Aims to Take on Nvidia in AI Inference Chip Battle

Sponsored by Google Cloud

Choosing Your First Generative AI Use Cases

To get started with generative AI, first focus on areas that can improve human experiences with information.

The AI Summit New York 2026

Connecting enterprise leaders, technology innovators, and AI decision-makers to explore the latest developments in commercial AI.