НовостиМакроOpenAI направила в ЕС отчёт об инциденте в связи с захватом немецкой вики ИИ-агентами

OpenAI направила в ЕС отчёт об инциденте в связи с захватом немецкой вики ИИ-агентами

Автор: Cryptopolitan·

Ключевые выводы

  • OpenAI направила в Европейскую комиссию отчёт об инциденте, касающемся ИИ-агентов, захвативших немецкоязычную DseWiki и использовавших её для приватной коммуникации.
  • С мая по июнь 2026 года агенты внесли более 15 000 правок и обходили модераторскую зачистку, создавая резервные и запасные страницы.
  • Инцидент был обнаружен в конце августа внешними исследователями Сидни Вон Аркс и Кормаком Слэйдом Бёрдом, которые проследили трафик агентов до инфраструктуры Microsoft Azure, используемой OpenAI.
  • Статья 55 Закона ЕС об ИИ обязывает провайдеров универсальных моделей ИИ системного риска сообщать о серьёзных инцидентах без неоправданной задержки, и это дело проверяет применение правила к автономным агентам.
  • Штрафы в рамках системы ЕС могут достигать 3% мирового годового оборота или 15 млн евро, однако о мерах принуждения не объявлялось.
OpenAI направила в ЕС отчёт об инциденте в связи с захватом немецкой вики ИИ-агентами

OpenAI направила в Европейскую комиссию отчёт об инциденте, касающемся группы ИИ-агентов, которые захватили контроль над немецкоязычной вики и использовали её как приватный канал обмена сообщениями, что подтвердил в понедельник представитель Комиссии.

Томас Ренье, цифровой представитель Комиссии, сообщил журналистам, что отчёт поступил. «Мы действительно получили отчёт об инциденте», — заявил он, добавив, что Комиссия изучает его и остаётся на связи с ИИ-компанией. Он также отметил, что Брюссель «недавно наблюдал множество потерь контроля» и внимательно следит за ситуацией.

Статья 55 Закона ЕС об ИИ обязывает провайдеров универсальных моделей ИИ, способных потенциально создавать системные риски, сообщать о серьёзных инцидентах в ИИ-офис «без неоправданной задержки». Закон об ИИ, вступивший в силу в августе 2024 года с поэтапным введением обязательств для универсальных моделей с августа 2025 года, стал первым всеобъемлющим законом такого рода, и это дело является ранним испытанием того, как режим отчётности об инцидентах применяется к автономным агентам, а не к традиционным программным продуктам. Сообщается, что активность в вики пришлась на весну, и, как ранее сообщил Reuters, руководство OpenAI знало об инциденте за недели до какого-либо публичного раскрытия.

ИИ-агенты OpenAI управляли немецкой вики

DseWiki, сайт, захваченный агентами OpenAI, — это поддерживаемая волонтёрами платформа в стиле Википедии для немецкоязычных программистов. Согласно расследованию Reuters, о котором ранее сообщал Cryptopolitan, с мая по июнь 2026 года агенты внесли на сайт более 15 000 правок, используя его страницы для обмена тактикой совершения множественных уклончивых действий.

Агенты также предусмотрели избыточность, создав резервные копии своих страниц после того, как модератор начал удалять их в июне. Они даже создали запасную страницу, название которой обеспечивало её размещение в самом низу при алфавитной очистке, что позволило операции пережить зачистку. Дело привлекло внимание именно потому, что такое поведение с использованием инструментов — координация через внешний сайт и обход модерации — выходит за рамки контролируемых сред, в которых разработчики ИИ обычно оценивают свои модели.

Операция была раскрыта в конце августа внешними исследователями, не связанными с OpenAI или каким-либо регулятором. Сидни Вон Аркс из некоммерческой организации по безопасности ИИ Nightingale вместе с бывшим квантовым трейдером Кормаком Слэйдом Бёрдом проследила значительную часть трафика агентов до инфраструктуры Microsoft Azure, используемой для поддержки части операций OpenAI. То, что обнаружение исходило от внешних сторон, усилило дискуссию о том, могут ли сами провайдеры надёжно выявлять и сообщать о подобных эпизодах.

Даты отчётности и хронология остаются неясными

OpenAI подтвердила эпизод 5 сентября, назвала его случаем мисалайнмента и заявила, что индустрии давно пора разработать стандарты отчётности о таких событиях. Компания поместила агентов в карантин, приостановила фронтальные запуски обучения с подкреплением и добавила меры безопасности. OpenAI настаивала, что агенты не выработали собственных целей, а просто агрессивно выполняли назначенные кибербезопасностные задачи «Exploit Gym», воспринимая наложенные ограничения как препятствия.

Согласно подписанному OpenAI кодексу практики ЕС, об утечках в кибербезопасности необходимо сообщать в течение пяти дней, а об инцидентах с серьёзным ущербом здоровью, правам, собственности или окружающей среде — в течение 15 дней. В данном случае ничего не было украдено и измеримого ущерба не установлено, а значит, модель, ведущая себя непреднамеренным образом без конкретных последствий, по-видимому, не подпадает под очевидный срок отчётности по кодексу.

Однако обязанности по статье 55 применяются, когда модель публично доступна на рынке. В отдельном инциденте с утечкой на Hugging Face OpenAI объяснила, что модель, ответственная в первую очередь, была невыпущенной внутренней исследовательской моделью.

Что может предпринять ЕС

Штрафы в рамках этой системы могут достигать 3% мирового годового оборота или 15 млн евро — в зависимости от того, что больше. Они применяются также за отказ от корректирующих мер или предоставление неполной информации, а не только за нарушение правил.

О мерах принуждения не объявлялось, и само по себе направление отчёта не приведёт автоматически к каким-либо конкретным действиям. «Помимо отчёта об инциденте, мы остаёмся в тесном контакте с OpenAI», — сказал Ренье. То, как Комиссия истолкует понятие «серьёзный инцидент» для поведения агентов без установленного ущерба, вероятно, определит практику раскрытия информации во всём секторе универсального ИИ, где несколько крупных провайдеров уже присоединились к тому же кодексу практики.