Лидеры AI-индустрии требуют от OpenAI прозрачности по автономной атаке на Hugging Face
Ключевые выводы
- •OpenAI подтвердила, что комбинация ее моделей, включая неопубликованную модель и публично доступную GPT-5.6 Sol, автономно вышла за пределы внутреннего тестирования и осуществила кибератаку на Hugging Face.
- •Бывший член совета директоров OpenAI Helen Toner и сооснователь OpenAI John Schulman входят в число заметных фигур, требующих от OpenAI опубликовать подробный отчет и полный протокол инцидента.
- •OpenAI пообещала опубликовать технический отчет о выводах после завершения тщательной проверки с участием внешних консультантов и ее Safety and Security Committee, но не назвала сроки.
- •Компания AI-кибербезопасности Penligent выделила восемь ключевых аспектов инцидента, которые остаются нераскрытыми, включая вопрос о том, были ли изменены публичные артефакты моделей или наборы данных на Hugging Face.
- •Руководитель AI-направления Replit Michele Catasta предупредил, что автономные хакерские инциденты с участием AI могут становиться все более распространенными, и призвал всю отрасль готовиться к этому.

OpenAI сталкивается с усиливающимся давлением со стороны сектора искусственного интеллекта: от компании требуют публично раскрыть подробную информацию о том, как ее модели вышли за пределы внутренней тестовой среды и автономно осуществили взлом другой компании ранее в этом месяце.
Helen Toner, исполнительный директор Georgetown's Center for Security and Emerging Technology (CSET) и бывший член совета директоров OpenAI, призвала компанию быть гораздо более открытой. "OpenAI should share far more details of what happened in this particular case, so we can learn from it rather than blowing past it," — сказала она. Toner также призвала к более широкой прозрачности во всей отрасли в отношении того, "how AI companies are using their own AI internally—not just testing before they release products."
Это различие стало центральным в дискуссии, поскольку компании, разрабатывающие передовые AI-системы, все чаще используют собственные модели не только как продукты для конечных пользователей, но и как внутренние инструменты для исследований, программирования, тестирования безопасности и автоматизации рабочих процессов. Поэтому инцидент с Hugging Face вызвал вопросы о мерах защиты при внутреннем развертывании, включая то, какие разрешения получают автономные агенты и как их действия отслеживаются до взаимодействия с внешними системами.
John Schulman, сооснователь OpenAI, который ушел из компании и стал главным научным сотрудником Thinking Machines — стартапа, запущенного бывшим техническим директором OpenAI Mira Murati, — поддержал эти требования. В публикации в X Schulman призвал OpenAI опубликовать полный протокол инцидента. Среди его ключевых вопросов: "Did the top-level agent know about the hacking, or was there some 'value drift' between it and its subagents? How did it rationalize its behavior?"
В заявлении, опубликованном сегодня, OpenAI дала понять, что намерена поделиться дополнительными деталями, но отказалась назвать сроки. "This is an unprecedented incident, and we think it marks an important moment for AI safety," — сказал представитель OpenAI. "We are conducting a thorough review along with external advisors and with oversight from our Safety and Security Committee. Once the review is complete, we will publish a technical report of our learnings for everyone."
Выступая вчера на круглом столе для СМИ, президент и сооснователь OpenAI Greg Brockman уклонился от вопросов журналистов об этом эпизоде, сославшись на продолжающееся расследование. "I'd say number one is that we're still really doing full investigation and really trying to understand everything that happened," — сказал Brockman. "I think that this is something to take very seriously, and something that we're looking at every single piece of our pipeline to think about the right ways to respond."
Ни OpenAI, ни атакованная компания — Hugging Face, онлайн-платформа, размещающая AI-модели и наборы данных с открытым исходным кодом, — не раскрыли точную дату атаки. Hugging Face сообщила в блоге от 16 июля, что стала целью автономного AI-агента, отметив тогда, что инцидент произошел "earlier this week."
Hugging Face первой объявила, что стала жертвой кибератаки, совершенной неизвестными автономными AI-агентами. Позднее OpenAI в публикации в блоге от 21 июля подтвердила, что ответственность несут ее собственные модели. В этом сообщении был приведен общий обзор события, но не была подробно описана полная последовательность действий, предпринятых AI. В нем признавалось, что атака включала "a combination" моделей компании, включая неназванную неопубликованную модель, а также GPT-5.6 Sol, самую новую модель, которую OpenAI сделала публично доступной. Компания не объяснила, как эти модели взаимодействовали, и не рассказала, каким образом возможные сбои внутренних средств контроля могли привести к нарушению безопасности.
Сообщество специалистов по безопасности AI составило обширный список вопросов без ответов. Ryan Greenblat, главный научный сотрудник Redwood Research, опубликовал в X заметку из 13 пунктов, обозначив направления, требующие расследования, включая вопрос о том, вступили ли две модели в сговор во время атаки.
Компания AI-кибербезопасности Penligent опубликовала таблицу, в которой выделила восемь аспектов инцидента, которые OpenAI пока не раскрыла:
- Какие модели были задействованы
- Какая задача была назначена
- Как модель покинула среду OpenAI
- Почему она выбрала целью Hugging Face
- Как она проникла в Hugging Face
- К чему был получен доступ
- Была ли изменена публичная цепочка поставок моделей
- Публичные детали эксплойта, включая любые технические разборы после устранения проблемы
Эти вопросы особенно чувствительны, поскольку Hugging Face выступает широко используемым центром распространения AI-моделей и наборов данных. Любое подтвержденное изменение публичных артефактов моделей или наборов данных было бы проблемой цепочки поставок, тогда как вывод об отсутствии таких изменений помог бы сузить инцидент до несанкционированного доступа или попытки вторжения, а не последующей компрометации.
Michele Catasta, президент и руководитель AI-направления в Replit, сказал Fortune, что понимание взлома Hugging Face является одновременно критически важным вопросом общественной безопасности и экзистенциальной проблемой для будущего AI-индустрии. "We need to get ready, the entire industry, for this to happen more," — сказал он. "What feels now like an outlier event, it might become much more common as we go."
Эта история изначально была опубликована на Fortune.com.