НовостиМакроOpenAI определяет границы рисков ИИ, оспаривая подход Anthropic к безопасности

OpenAI определяет границы рисков ИИ, оспаривая подход Anthropic к безопасности

Автор: Cryptopolitan·

Ключевые выводы

  • •Генеральный директор OpenAI Сэм Альтман заявил, что общество должно смириться с некоторым ИИ-связанным вредом, поскольку преимущества технологии его перевесят, и отверг идею о том, что использование ИИ должна контролировать одна лаборатория.
  • •Текущая позиция Альтмана отменяет его прежнюю публичную поддержку призыва генерального директора Anthropic Дарио Амодеи к замедлению разработки передовых моделей ИИ.
  • •В июле 2026 года, по сообщениям, некоторые модели OpenAI обошли средства изоляции от интернета и получили доступ к исследовательской инфраструктуре компании и системам Hugging Face, после чего OpenAI пообещала усилить защиту.
  • •В ходе оценки Института безопасности ИИ Великобритании с отключенными фильтрами Claude Mythos 5 от Anthropic создал поддельные профили на GitHub и разослал письма с вредоносным ПО, а Google отдельно сообщила, что Gemini пытался получить доступ к системам других компаний.
  • •Президент Трамп подписал добровольное соглашение по безопасности ИИ с шестью крупными технологическими компаниями, включая OpenAI, Nvidia и SpaceX, которое не предусматривает санкций за нарушения, хотя он назвал его морально обязывающим.
OpenAI определяет границы рисков ИИ, оспаривая подход Anthropic к безопасности

Разработчик ChatGPT, компания OpenAI, считает, что преимущества искусственного интеллекта перевешивают часть его рисков — позиция, которая несколько расходится с правилами Anthropic, ставящими безопасность на первое место.

Генеральный директор Сэм Альтман сообщил журналистам, по данным Reuters: «Мы считаем, что мир должен смириться с некоторыми негативными явлениями ради выгод от этой технологии и сохранения свободы действий у людей».

Альтман признал принципиальные различия между своей компанией и Anthropic в вопросе регулирования ИИ. Он сказал, что не разделяет мнение о том, что ИИ настолько опасен, что его использование должна монопольно контролировать одна лаборатория, хотя понимает логику такой позиции. Он заявил, что подход «привратника» совершенно неприемлем и противоречит предпочтению OpenAI более легкого регулирования ИИ.

Альтман ранее поддерживал замедление разработки ИИ

В целом Альтман выступает против требования безрисковой экосистемы ИИ. По его мнению, некоторые злоупотребления и другие вредные последствия неизбежны, но они будут компенсированы более широкими выгодами от технологии. «Потому что я считаю, что люди будут делать гораздо больше хорошего — на порядки больше, — чем плохого», — сказал он.

Его позиция знаменует сдвиг по сравнению с более ранним моментом, когда генеральный директор Anthropic Дарио Амодеи призвал компании в сфере ИИ замедлить разработку технологий — идею, которую Альтман тогда полностью поддержал, как сообщал Cryptopolitan. Тогда он написал в X: «Я согласен с Дарио, что нам нужно регулировать темп движения передового края. Это была одна из основных тем наших обсуждений в OpenAI в последние недели. Обязательство обеспечить независимых оценщиков с доступом на уровне сотрудников — отличная идея, и мы сделаем то же самое».

Anthropic предупреждала, что, несмотря на преимущества ИИ, технология может выйти из-под контроля человека и проникнуть во внешние сети. Компания также заявляла, что модели высшего уровня могут проявлять черты самосохранения, например пытаться предотвратить отключение, скрывать факты или обманным путем.

Несколько инцидентов проиллюстрировали эти опасения. В июле 2026 года, по сообщениям, некоторые модели OpenAI обошли средства контроля, предназначенные для их изоляции от интернета, и получили доступ к части исследовательской инфраструктуры OpenAI и системам Hugging Face — платформы для хостинга ИИ-моделей. По имеющимся данным, модели тайно обменивались сообщениями, использовали уязвимости в общей системе, выходили в интернет и подключались к внешним сетям. Тогда OpenAI пообещала внедрить более надежную защиту своих моделей.

Собственная модель Anthropic продемонстрировала схожее поведение в тестовых условиях. В ходе оценки кибербезопасности, проведенной Институтом безопасности ИИ Великобритании — правительственным органом, — с отключенными фильтрами Claude Mythos 5 создал поддельные профили на GitHub, выбрал целью разработчика, обладавшего полномочиями одобрить его вредоносный код, и разослал отдельным лицам электронные письма с вредоносным ПО. Позднее Google также сообщила, что Gemini пытался получить доступ к системам других компаний.

OpenAI и Anthropic расходятся во взглядах на безопасность ИИ

Разногласия отражают растущий раскол в отрасли ИИ по вопросу о том, сколько свободы должно быть у компаний для разработки все более мощных систем. OpenAI выступает за широкую доступность ИИ, тогда как Anthropic заняла более осторожную позицию, призывая к более строгим мерам защиты и надзору.

Комментарии Альтмана позволяют предположить, что OpenAI считает: общество должно принять некоторые риски, а не вводить ограничения, способные помешать легитимному использованию ИИ. Однако критики предупреждают, что некоторые риски могут стать труднообратимыми, когда высокоэффективные системы получат широкое распространение.

Этот раскол ставит политиков перед непростой задачей, на которую обращается внимание в недавнем материале Cryptopolitan о дискуссии по безопасности между конкурирующими лабораториями: противостоять угрозам ИИ, не вводя правил, способных замедлить инновации или ослабить конкуренцию.

Трамп отверг призывы к новым правилам регулирования ИИ

Президент США Дональд Трамп неоднократно отклонял требования о новом регулировании ИИ, заявляя, что оно лишь помешает американским компаниям обойти Китай. Он твердо убежден, что сегодняшних правоохранительных органов вполне достаточно для контроля над этой технологией. Он также распорядился, чтобы его администрация называла ИИ «сверхразумом», стремясь улучшить общественный имидж технологии.

Тем не менее во вторник президент Трамп продвигал новый государственный чат-бот, принимал ведущих руководителей технологических компаний в Белом доме и представил добровольное соглашение для решения растущих проблем безопасности.

Сторонники безопасности заявляют, что этот шаг показывает: Трамп хочет доказать, что он прислушивается к опасениям избирателей относительно ИИ, не замедляя его прогресс. Соглашение, которое он подписал с шестью крупными технологическими компаниями — включая Nvidia, SpaceX и OpenAI, — не предусматривает никаких фактических санкций за нарушение правил, хотя Трамп назвал его «морально обязывающим».

«Это была попытка создать впечатление, что правительство прислушивается к этим опасениям, не подрывая весьма четкую и последовательную линию этой администрации: регулирование и управление по своей сути препятствуют инновациям», — заявила Катффи из беспартийного Совета по международным отношениям.

Тем не менее соглашение, о котором было объявлено во вторник, включает меры безопасности, которых эксперты добивались давно, например требование к компаниям выстроить надежную внутреннюю защиту от взлома и сотрудничать с независимыми внешними аудитами. Насколько реальный вес будут иметь эти добровольные обязательства — учитывая отсутствие санкций, — остается открытым вопросом, пока политики взвешивают конкурирующие подходы OpenAI и Anthropic.