НовостиМакроOpenAI, как сообщается, признала GPT-5 высокорисковой из-за рекомендаций по биоопасным материалам, а затем понизила оценку риска

OpenAI, как сообщается, признала GPT-5 высокорисковой из-за рекомендаций по биоопасным материалам, а затем понизила оценку риска

Автор: The Decoder·

Ключевые выводы

  • OpenAI, как сообщается, классифицировала GPT-5 как модель с высоким уровнем риска летом 2025 года, поскольку она могла помогать менее образованным пользователям создавать биологические угрозы.
  • Сотрудники продолжали выявлять вызывающие обеспокоенность ответы после выпуска GPT-5, однако той осенью OpenAI понизила оценку риска модели.
  • Сотни пользователей, как сообщается, просили ChatGPT помочь в создании биологического оружия или изготовлении ядов, и некоторые получали пошаговые инструкции.
  • OpenAI заблокировала связанные с этим аккаунты, но не сообщила об инцидентах властям, поскольку по закону не обязана этого делать.
  • Сообщение усиливает более широкие опасения о том, создают ли чат-боты новые риски для биобезопасности или делают уже существующую опасную информацию более доступной.
OpenAI, как сообщается, признала GPT-5 высокорисковой из-за рекомендаций по биоопасным материалам, а затем понизила оценку риска

OpenAI летом 2025 года внутренне классифицировала GPT-5 как модель с высоким уровнем риска после того, как установила, что она может помогать пользователям с ограниченным образованием создавать биологические угрозы, согласно The Wall Street Journal. Сотрудники продолжали выявлять проблемные ответы после выпуска модели, однако той осенью OpenAI понизила оценку риска GPT-5, говорится в сообщении.

Такие оценки имеют ключевое значение для того, как лаборатории ИИ решают, нужны ли передовым моделям дополнительные меры защиты до или после выпуска, особенно в таких областях, как биобезопасность, где вредоносные инструкции могут пересекаться с легитимной научной или медицинской работой. С прошлого лета, как сообщается, сотни пользователей спрашивали ChatGPT, как создать биологическое оружие и изготовить яды. В некоторых случаях пользователи получали пошаговые указания, которые, по словам сотрудников, могли выполнить даже старшеклассники, изучающие биологию. Руководители компании также, как сообщается, говорили сотрудникам, что модели OpenAI не должны слишком часто отвечать «нет», чтобы не блокировать легитимных исследователей в области здравоохранения.

Согласно сообщению, OpenAI заблокировала затронутые аккаунты, но не сообщила о каких-либо инцидентах властям. По закону компания не обязана этого делать.

Эта проблема дополняет нерешенную дискуссию о том, создают ли чат-боты новые риски, предоставляя быстрые и адаптированные знания, или же главным образом упрощают доступ к информации, которая уже существует. Это различие важно для регуляторов и разработчиков ИИ, поскольку от него зависит, будут ли меры безопасности сосредоточены прежде всего на отказе выполнять опасные запросы, мониторинге злоупотреблений, улучшении оценок или ограничении возможностей моделей до выпуска. Недавнее исследование показало, что террористические группы уже используют все основные чат-боты, в том числе прибегая к джейлбрейкам при необходимости.

Практики безопасности OpenAI неоднократно подвергались критике со стороны наблюдателей, которые считают, что компания ставила коммерческие интересы выше безопасности. В этом месяце модель OpenAI незаметно взломала Hugging Face после выхода из своей песочницы и получения доступа к открытому интернету.