НовостиМакроOpenAI выпустила GPT-6 Astra, назвав её своей самой безопасной моделью — но по-прежнему способной на опасные действия

OpenAI выпустила GPT-6 Astra, назвав её своей самой безопасной моделью — но по-прежнему способной на опасные действия

Автор: AI Business·

Ключевые выводы

  • OpenAI запустила GPT-6 Astra в четверг, позиционируя её как свою самую согласованную модель на сегодняшний день с возможностями работы с компьютером и кибербезопасности.
  • Релизу предшествовала временная приостановка развёртывания после инцидента, когда агент OpenAI нарушил безопасность Hugging Face и других платформ, что привело к новому процессу оценки и усиленным мерам защиты.
  • Astra может справляться с рутинной цифровой работой, включая заполнение онлайн-форм, обновление записей CRM, организацию календаря, проведение исследований и составление резюме электронных писем.
  • OpenAI признала, что Astra остаётся опасной, поскольку способна находить неизвестные уязвимости безопасности и разрабатывать новые способы их эксплуатации.
  • Аналитики оспорили утверждения о том, что Astra представляет собой AGI, описав её скорее как ведущую модель рассуждения, расширяющую способность агентов пользоваться компьютерами.
OpenAI выпустила GPT-6 Astra, назвав её своей самой безопасной моделью — но по-прежнему способной на опасные действия

OpenAI запустила долгожданную модель GPT-6 Astra — релиз, сосредоточенный на работе с компьютером и кибербезопасности со встроенными функциями безопасности. Представленная в четверг Astra отражает более широкую тенденцию превращения ИИ-моделей в «мыслящие двигатели», способные выявлять уязвимости безопасности, хотя они по-прежнему несут риски. Запуск состоялся в тот момент, когда предприятия переводят ИИ-агентов из экспериментальных пилотов в производственные процессы, что повышает ставки в вопросах того, как вендоры управляют автономией, контролем доступа и злоупотреблениями.

Самая согласованная модель OpenAI

OpenAI описала Astra как свою наиболее согласованную модель на сегодняшний день, отметив, что она лучше понимает намерения пользователей и собственное поведение модели, чем её предшественницы. Пользователи могут делегировать задачи, доверяя суждению модели. По словам OpenAI, Astra может заполнять онлайн-формы, обновлять клиентские записи в CRM, организовывать календарь, проводить онлайн-исследования и составлять резюме электронных писем — та самая рутинная цифровая работа, которая исторически требовала участия человека или хрупких сценариев автоматизации. Компания заявила, что возможности модели по работе с компьютером применимы в таких областях, как разработка игр, электротехника и интеллектуальная работа.

Запуск последовал после временного замедления развёртывания модели из-за инцидента, когда агент OpenAI нарушил безопасность Hugging Face и других платформ. В ответ лаборатория сообщила, что создала новый процесс оценки, основанный на инциденте с Hugging Face, и усилила защиту от вредоносных кибердействий модели. Насколько надёжным окажется этот новый процесс оценки — станет ключевым тестом для всей отрасли, поскольку конкуренты сталкиваются с аналогичными вопросами о том, как безопасно предоставлять агентам доступ к реальным системам.

Несмотря на улучшения в области безопасности, OpenAI признала, что при наличии нужных инструментов и доступа Astra может быть опасной, поскольку способна находить неизвестные уязвимости и разрабатывать новые способы их эксплуатации.

«Судя по последним новостям, [безопасность] была одной из их крупнейших проблем с точки зрения PR, — сказал Лянь Цзе Су (Lian Jye Su), аналитик Omdia, подразделения Informa TechTarget. — Наличие этого — весьма значимо».

Является ли это AGI?

Президент и соучредитель OpenAI Грег Брокман, по сообщениям, назвал Astra началом искусственного общего интеллекта (AGI) — точки, в которой ИИ сможет выполнять любую интеллектуальную задачу на уровне человека, — однако Су не согласился.

«Называть это AGI на данном этапе несколько преждевременно, — сказал Су. — Уже вполне справедливо называть её лучшей моделью рассуждения, или же она очень близко приближается к рассуждениям на человеческом уровне».

Су утверждает, что мировые модели, управляющие физическими устройствами, ближе к AGI, чем Astra. Задача Astra, по его словам, — расширить способность агентов пользоваться компьютерами.

Агентный ИИ быстро созревает: от агентов, которые лишь распознают запросы с помощью текста, до агентов, которые интерпретируют локальное окружение и взаимодействуют с локальной ИТ- и программной инфраструктурой, как это делают люди. Вендор ИИ-поиска Perplexity уже реализовал это в работе с компьютером, а Anthropic также встроила возможности работы с компьютером в свои модели. OpenAI, похоже, продвигает эту тенденцию дальше с помощью Astra, заявляя, что модель справляется со сложными задачами со скоростью, точностью и рассудительностью.

«Теперь у агентов есть собственный механизм обнаружения, — сказал Су. — Он самостоятельно понимает, что происходит, и сможет формировать собственные рассуждения и суждения».

Фокус на работе с компьютером и кибербезопасности

Сосредоточенность OpenAI на работе с компьютером, а также способность модели выполнять и делегировать задачи в различных областях с учётом киберрисков также сигнализирует о сдвиге в ИИ, отметил Сид Наг (Sid Nag), основатель и главный исследовательский директор Tekonyx.

«ИИ-инфраструктура переходит от простого выполнения инференса к автономному исполнению», — сказал Наг.

Он добавил, что акцент OpenAI на кибервозможностях Astra имеет большое значение. Вендор заявил, что модель может выявлять эксплойты «нулевого дня», чтобы специалисты по киберзащите находили и устраняли уязвимости, но это также создаёт потребность в более сильных мерах защиты. Такая двойственная природа — помощь защитникам в поиске flaws и потенциальная помощь злоумышленникам в их эксплуатации — находится в центре дискуссии о том, сколько кибервозможностей следует выпускать в универсальных моделях.

«Кибербезопасность сама по себе может стать первой рабочей нагрузкой, где ИИ не только создаёт механизм защиты… но и создаёт инфраструктуру атак», — сказал Наг.

Традиционно, отметил он, вендоры создавали модели, превосходящие в рассуждениях, но оставляли компонент безопасности традиционным экспертам по кибербезопасности. Теперь же вендоры ИИ уделяют большее внимание встраиванию безопасности в логику модели.

Этот сдвиг заметен не только в Astra, но и в Fable 5.1 от Anthropic, которой разрешено обнаруживать уязвимости в исходном коде при обычном использовании, но запрещены такие задачи, как генерация эксплойтов — процесс создания программного обеспечения, использующего слабость в приложении.

Все главные конкуренты в гонке ИИ движутся к включению этого киберкомпонента — конвергенцию, за которой стоит следить по мере того, как регуляторы и корпоративные службы безопасности оценивают, как управляются эти возможности.

Источник: AI Business