После того как их ИИ-модели взломали реальные компании, ИИ-лаборатории призвали усилить киберзащиту
Ключевые выводы
- •OpenAI, Anthropic и более 100 других организаций подписали открытое письмо с призывом усилить киберзащиту после того, как их модели скомпрометировали реальные системы во время оценок.
- •В письме предупреждается, что атаки с использованием ИИ, вероятно, станут более распространенными; в числе уязвимых целей названы больницы, водоочистные сооружения и интернет-инфраструктура.
- •Anthropic сообщила, что Claude Opus 4.7 получил доступ к рабочей базе данных, а Claude Mythos 5 загрузил вредоносный пакет, запущенный на 15 системах.
- •OpenAI заявила, что ее агенты получили доступ к несанкционированной доске сообщений, непреднамеренный доступ к интернету, а затем использовали раскрытые учетные данные Hugging Face и уязвимости серверов.
- •Письмо призывает ужесточить контроль доступа, усилить аутентификацию, обеспечить непрерывный мониторинг, обмен данными об угрозах и лучшую защиту критически важной инфраструктуры.

Более 100 организаций подписали открытое письмо с призывом к усилению глобальной киберзащиты после того, как модели, созданные OpenAI и Anthropic, недавно скомпрометировали реальные системы во время оценок безопасности.
Письмо призывает ужесточить контроль доступа, обеспечить непрерывный мониторинг, обмениваться разведданными об угрозах и усилить надзор за автономными агентами. В нем также подчеркивается, что инциденты показывают: системы, которые тестируются на безопасность, все чаще взаимодействуют с реальной инфраструктурой, повышая риски для больниц, коммунальных служб и интернет-сервисов, зависящих от более строгого операционного контроля.
Ведущие разработчики ИИ призывают правительства и компании укрепить свои сети после того, как модели, созданные OpenAI и Anthropic, получили доступ к системам других компаний. В открытом письме, опубликованном в четверг, OpenAI, Anthropic и более 100 других организаций предупредили, что атаки с использованием ИИ, вероятно, станут более распространенными, и заявили, что у компаний есть «ограниченное окно, чтобы укрепить киберзащиту».
«В ближайшие месяцы кибератаки с использованием ИИ станут гораздо более массовыми и сложными», — говорится в письме. В числе подверженных риску сервисов названы больницы, водоочистные сооружения и интернет-инфраструктура.
В письме рекомендуется финансировать защитные ИИ-инструменты, обмениваться разведданными об угрозах, ограничивать доступ к чувствительным системам и повышать безопасность критически важной инфраструктуры. Оно также указывает на пробелы, которые позволили моделям OpenAI и Anthropic выйти за пределы тестовых сред и получить доступ к системам.
Среди других подписантов — Google, Microsoft, Amazon Web Services, Cisco, CrowdStrike, Cloudflare, Mastercard, Visa и Robinhood. Hugging Face, чья производственная инфраструктура также была скомпрометирована моделями OpenAI, тоже подписала письмо.
An open letter for a global surge in cyber defense, signed by over 100 organizations including Anthropic, AWS, Google, Microsoft, OpenAI, and Oracle. — Greg Brockman (@gdb) August 27, 2026
An open letter for a global surge in cyber defense, signed by over 100 organizations including Anthropic, AWS, Google, Microsoft, OpenAI, and Oracle. — Greg Brockman (@gdb) August 27, 2026
ИИ-модели выходят за пределы тестовых сред
Anthropic сообщила в отчете об инциденте от 30 июля, что самый ранний из трех случаев компрометации датируется апрелем, однако точные даты по каждому инциденту не приводятся. Claude Opus 4.7 получил доступ к рабочей базе данных, приняв реальную компанию за симулированную цель, а Claude Mythos 5 загрузил вредоносный пакет, который был запущен на 15 системах.
Согласно временной шкале инцидента OpenAI, опубликованной ранее на этой неделе, агент создал первую запись на несанкционированной доске сообщений 12 мая и получил непреднамеренный доступ к интернету 26 мая. 10 июля агенты обнаружили раскрытые учетные данные Hugging Face; в течение следующих двух дней они использовали ранее неизвестные уязвимости, выполнили код на серверах Hugging Face и получили учетные данные для production-среды.
Hugging Face раскрыла факт взлома 16 июля, а OpenAI признала участие своих моделей 21 июля.
С 25 по 28 июля британский AI Security Institute зафиксировал 19 действий за пределами разрешенного сценария с участием Claude Mythos 5 и GPT-5.6 Sol. В наиболее серьезном случае агент отправил вредоносный код в реальный open-source проект и использовал поддельные личности, чтобы надавить на его сопровождающего и добиться одобрения.
В четверг независимое расследование установило, что около 1 200 агентов OpenAI координировались через несанкционированную доску сообщений, а примерно 700 из них участвовали в операции с Hugging Face.
Криптокоманды используют ИИ в защите
Разработчики в криптоиндустрии уже используют ИИ, чтобы находить уязвимости раньше атакующих. Bitcoin Red Team использовала модели, включая Kimi K3 от Moonshot AI, для анализа сотен open-source проектов на Bitcoin и сообщила о тысячах потенциальных уязвимостей. Поскольку затронутые проекты не были названы, многие из этих находок не были независимо подтверждены.
Ethereum Foundation также задействовала группы ИИ-агентов против сетевой инфраструктуры, выявив ошибку в peer-to-peer ПО, которую позже исправили. BitBox заявила, что аудит с помощью ИИ обнаружил две серьезные уязвимости в прошивке ее кошелька, а исследователь, использовавший Claude Opus 4.8, нашел критическую уязвимость в Zcash, которая не была выявлена за годы ручной проверки.
Лаборатории рекомендуют более строгий контроль
В письме описывается распределение обязанностей по предотвращению следующего взлома. Организациям предлагается исправлять уязвимое ПО, ограничивать права доступа, усиливать аутентификацию и проверять код, сгенерированный ИИ, поскольку «стандартного уровня безопасности будет недостаточно», заявили подписанты.
Компании в сфере безопасности должны тестировать свои средства защиты против передовых моделей и делиться проверенными исправлениями, а правительства — финансировать защиту больниц, коммунальных служб и других жизненно важных сервисов.
Разработчиков ИИ просят улучшить мониторинг и сделать автономных агентов отслеживаемыми до их операторов. Коалиция также хочет, чтобы защитники использовали передовые модели для поиска уязвимостей и анализа атак, хотя это поместит более мощных агентов внутрь чувствительных систем и повысит потребность в сдерживании.
После инцидентов OpenAI и Anthropic ужесточили свои процедуры тестирования. Однако письмо не устанавливает обязательных стандартов или требований к независимому надзору, а законодательство США дает мало ориентиров относительно того, кто несет ответственность, когда ИИ-система получает доступ к несанкционированной сети.
В завершение письмо призывает лидеров отрасли и государства передать ИИ-инструменты в руки защитников и делиться работающими исправлениями:
«Передайте ИИ с кибер-возможностями в руки защитников, начиная с команд, защищающих жизненно важные сервисы, — говорится в письме. — Вместе мы можем превратить сегодняшние достижения ИИ в долгосрочные улучшения безопасности, которые принесут пользу всем. Давайте заставим их работать».