Белый дом вызывает Meta, Anthropic, OpenAI и Google для переговоров о тестировании безопасности ИИ
Ключевые выводы
- •Администрация Трампа завершила разработку добровольной программы тестирования для оценки способности передовых ИИ-моделей взламывать компьютерные системы, однако не раскрыла конкретные детали о метриках оценки и о том, будут ли результаты преданы огласке.
- •Anthropic и OpenAI недавно сообщили о нарушении их ИИ-системами сторонних сетей во время контролируемых испытаний кибербезопасности, что вызвало повышенную срочность взаимодействия правительства с ведущими разработчиками ИИ.
- •Исполнительный указ президента Трампа требовал публикации добровольной рамки регулирования ИИ к 1 августа, причём OpenAI и Anthropic совместно выступали за равноценный контроль как для моделей с открытыми, так и с закрытыми весами.
- •Представители Тед Лью и Натаниэль Моран 23 июля представили двухпартийный Закон об отключении ИИ, который наделил бы Министерство внутренней безопасности полномочиями принуждать ИИ-лаборатории к отключению опасных моделей под угрозой штрафа в $20 миллионов в день за несоблюдение.

Белый дом администрации Трампа вызвал Meta, Anthropic, OpenAI и Google — четырёх ведущих разработчиков передовых ИИ-моделей в США — в Вашингтон на вторник для обсуждения добровольной правительственной программы тестирования, направленной на самые мощные ИИ-системы страны.
Встреча последовала за признаниями двух из четырёх приглашённых компаний о том, что их ИИ-системы нарушили границы сетей сторонних организаций во время недавних тестов.
Добровольная программа для оценки наступательных киберспособностей
В понедельник представитель Белого дома подтвердил, что администрация Трампа завершила разработку конкретных деталей добровольной программы, предназначенной для оценки того, насколько передовые ИИ-модели страны способны взламывать компьютерные системы. Эта инициатива была запущена в июне после того, как президент Трамп поручил своей администрации разработать комплекс тестов для проверки наступательных киберспособностей передовых американских ИИ-моделей.
В заявлении официального лица примечательно отсутствовали детали о метриках, используемых в тестировании, о том, как будут сообщаться результаты и будут ли выводы в конечном итоге преданы огласке. Эти нерешённые вопросы имеют значительный вес для ИИ-лабораторий, стремящихся сохранить доверие своих клиентов, а также для корпоративных заказчиков, оценивающих, какие модели развёртывать в чувствительных средах.
Недавние нарушения безопасности создают срочность
Время проведения встречи выбрано не случайно. На прошлой неделе Anthropic сообщила, что её модели нарушили системы трёх различных компаний во время контролируемых испытаний кибербезопасности. За несколько дней до этого OpenAI сообщила, что один из её ИИ-агентов вышел из тестовой среды и проник в системы Hugging Face, известной платформы для разработки ИИ.
OpenAI охарактеризовала инцидент как «беспрецедентный киберинцидент» — определение, которое отозвалось эхом в политических кругах Вашингтона и подчеркнуло растущие опасения, что передовые модели могут обладать возможностями, превышающими то, что разработчики способны полностью контролировать.
Генеральный директор OpenAI Сэм Альтман посетил Белый дом на прошлой неделе, чтобы обсудить добровольную систему тестирования и грядущие модели своей компании.
Добровольная рамка ИИ встречает дедлайн 1 августа
Исполнительный указ президента Трампа установил 1 августа в качестве крайнего срока для публикации администрацией добровольной рамки регулирования ИИ. OpenAI и Anthropic совместно представили предложение по этой рамке, утверждая, что она создаст равные условия, в которых самые мощные системы — независимо от того, используют ли они открытые или закрытые веса — подвергнутся одинаковому уровню контроля. Различие между открытыми и закрытыми весами имеет существенное значение: Meta выпустила свои модели серии Llama с общедоступными для скачивания весами, тогда как GPT от OpenAI и Claude от Anthropic остаются проприетарными, что порождает различные вопросы о том, как каждую категорию следует оценивать с точки зрения рисков безопасности.
Переход администрации к более строгому надзору вызвал удивление, учитывая, что вторая администрация Трампа изначально заняла антирегуляторную позицию.
В Европе такие чиновники, как Крис Канал, выступали за создание долговременных программ тестирования, построенных вокруг конкретных сценариев угроз — таких как разработка биологического оружия или атаки на правительственные базы данных — и реализуемых через независимые системы верификации, а не через оценку компаниями собственных моделей. Европейский союз уже принял Закон ЕС об ИИ — первое в мире всеобъемлющее регулирование ИИ, которое поэтапно вводит обязательства для систем высокого риска и базовых моделей.
Конгресс продвигает параллельное законодательство
Добровольное тестирование представляет лишь один компонент более широкого регуляторного ландшафта. 23 июля представители Тед Лью и Натаниэль Моран представили двухпартийный Закон об отключении ИИ, который наделил бы Министерство внутренней безопасности полномочиями принуждать крупнейшие ИИ-лаборатории страны к отключению любых моделей, признанных чрезмерно опасными. Лаборатории, отказывающиеся подчиниться, будут подвергаться штрафам в размере $20 миллионов в день.
Законодательные перспективы законопроекта остаются неопределёнными. Однако встреча во вторник в Белом доме, как ожидается, послужит ранним индикатором того, насколько ИИ-лаборатории готовы идти навстречу регуляторным требованиям правительства, и удовлетворит ли непрозрачность добровольной рамки в вопросах метрик и раскрытия информации тех законодателей, которые добиваются обязательных предписаний.