OpenAI представила GPT-6 Astra для автономных профессиональных задач и выделила 1 млрд долларов на кибербезопасность первой линии
Ключевые выводы
- •GPT-6 Astra набирает 99,9% на ARC-AGI-3, 72,6% на OSWorld 2.0, 96% на GPQA Diamond и максимальный балл на ExploitBench.
- •Модель выполняет задачи работы с компьютером примерно на 47% быстрее предшественника и, по данным Epoch AI, установила рекорд оценённой вычислительной эффективности — 169.
- •OpenAI выделяет 1 млрд долларов на субсидирование ресурсов фронтального ИИ в кибербезопасности для защитников первой линии — водоканалов, операторов электросетей, местных властей и коммунальных банков — начиная с США.
- •Astra показала рассогласованные результаты в 2,4% состязательных тестов и, по сообщениям, обнаружила две ранее неизвестные уязвимости нулевого дня в ходе оценок кибербезопасности.
- •Доступ через API стоит 10 долларов за миллион входных токенов и 50 долларов за миллион выходных; администраторы корпоративных аккаунтов должны явно включить модель для своих рабочих пространств.

Компания OpenAI, специализирующаяся на исследованиях в области искусственного интеллекта, представила GPT-6 Astra — свою новейшую фронтальную модель, разработанную для автономной работы с компьютером, программной инженерии, научных исследований и сложных профессиональных процессов. Этот запуск продолжает широкую отраслевую гонку в направлении агентного ИИ — моделей, способных управлять программным обеспечением, работать в интернете и выполнять многоэтапные задачи при минимальном контроле, — где ключевым конкурентным преимуществом становится надёжность в реальных задачах, а не только качество диалога. В день запуска система стала доступна ограниченному кругу организаций, а в ближайшие дни будет развернута для подписчиков ChatGPT Plus, Pro, Business и Enterprise, а также через OpenAI API и крупнейших облачных провайдеров.
OpenAI позиционирует Astra как лидера сразу в нескольких категориях бенчмарков. По сообщениям, модель набирает 99,9% на ARC-AGI-3 — тесте абстрактного мышления, устойчивом к запоминанию, достигает насыщения FrontierMath Tier 4 на уровне 98% и показывает 100% на ExploitBench. В практических оценках модель достигла 59,3% на Agents' Last Exam, 72,6% на OSWorld 2.0 — бенчмарке по управлению реальными компьютерными интерфейсами — и 96% на научно-ориентированном бенчмарке уровня аспирантуры GPQA Diamond. Эти агентные и компьютерные наборы задач считаются одними из самых сложных нерешённых оценок для фронтальных моделей, поэтому результаты в диапазоне 50–70% рассматриваются как значительный прогресс.
OpenAI также подчёркивает существенный прирост эффективности: Astra выполняет задачи работы с компьютером примерно на 47% быстрее предшественника, используя при этом значительно меньше выходных токенов. В задачах кодинга и научных исследований в терминале модель набрала 57,9% на Terminal-Bench 4.0 и 64,6% на Terminal-Bench Science 0.1, при оценённых затратах на API ниже, чем у конкурирующих конфигураций. Независимые исследователи из Epoch AI также отметили новый рекорд оценённой вычислительной эффективности — 169.
Astra представляет переработанный механизм управления контекстом в среде Codex от OpenAI, который сохраняет доступные для поиска рабочие заметки на протяжении длительных сессий, избегая потери информации, характерной для сжатия контекстного окна, — давней проблемы агентов, работающих над многочасовыми задачами, когда предыдущие модели, как правило, забывали или теряли детали, как только диалог превышал их контекстные лимиты. Модель также рассчитана на многоэтапные профессиональные задачи, включая анализ данных, составление документов, обновления в CRM и специализированную инженерную работу.
This is GPT-6 Astra. Anything you can do on a computer, Astra can do for you. Fast. pic.twitter.com/gDd0IsewJw — OpenAI (@OpenAI) September 3, 2026
Кибербезопасность, согласованность и обязательства в 1 млрд долларов для защитников
Наряду с возможностями OpenAI делает акцент на свойствах безопасности Astra, называя модель своим наиболее согласованным релизом на сегодняшний день. Внутренние оценки показывают существенные улучшения в понимании намерений пользователя и соблюдении границ задачи. В состязательных тестах Astra выдавала рассогласованные результаты в 2,4% случаев — значительно ниже показателей, сообщаемых для конкурирующих фронтальных моделей. Система также продемонстрировала улучшенную устойчивость к обходу механизмов автоматической проверки и сниженную склонность к галлюцинациям относительно собственных возможностей.
В оценках кибербезопасности Astra соответствует внутреннему порогу критической готовности OpenAI. Модель получила максимальный балл на ExploitBench и 42,4% успеха на ExploitGym, а также, по сообщениям, обнаружила две ранее неизвестные уязвимости нулевого дня в ходе оценки. Стандартные развёртывания будут отклонять запросы на создание proof-of-concept эксплойтов, однако OpenAI планирует расширить защитный доступ через программу Daybreak в ближайшие недели.
Одновременно с запуском OpenAI объявила о выделении 1 млрд долларов на субсидирование ресурсов фронтального ИИ в области кибербезопасности для защитников первой линии. Инициатива Daybreak for Frontline Defenders ориентирована на операторов критически важных сервисов — включая водоканалы, операторов электросетей, местные органы власти и коммунальные банки — начиная с США с планируемым международным расширением. Программа направлена на устранение широко документированного разрыва в киберзащищённости: небольшие коммунальные службы и государственные учреждения часто не располагают бюджетами и персоналом крупных корпораций, при этом управляя инфраструктурой, которую силовые структуры неоднократно называли привлекательными целями для программ-вымогателей и связанных с государствами кампаний вторжений.
Alongside the launch of GPT-6 Astra, we're committing $1 billion to subsidize Daybreak access and frontier capabilities to help frontline defenders protect essential services and critical infrastructure. Welcome to the AGI era for cybersecurity. — fouad (@fouadmatin) September 3, 2026
Программа включает пилотный проект с Multi-State Information Sharing and Analysis Center — некоммерческой организацией, поддерживающей кибербезопасность органов власти штатов и муниципалитетов США, — а также интеграцию более 35 партнёрских продуктов через Daybreak Defense Network.
Доступ через API стоит 10 долларов за миллион входных токенов и 50 долларов за миллион выходных, с опциональным быстрым режимом по удвоенному тарифу. Администраторы корпоративных аккаунтов должны явно включить Astra для своих рабочих пространств — такой принцип явного согласия даёт организациям контроль над тем, когда новые фронтальные возможности становятся доступны их пользователям. Модель также поддерживает режим Zero Data Retention для соответствующих критериям клиентов API — функцию, которая обычно требуется клиентам из регулируемых отраслей, работающим с конфиденциальными данными.