НовостиАкцииGoogle запускает Gemini 4 Argon для продвинутого программирования, но ограничивает доступ из-за рисков кибербезопасности

Google запускает Gemini 4 Argon для продвинутого программирования, но ограничивает доступ из-за рисков кибербезопасности

Автор: TechNext24·

Ключевые выводы

  • •Gemini 4 Argon была анонсирована 30 сентября в рамках программы Google Fairwind, при этом начальный доступ ограничен отдельными правительствами, доверенными партнёрами и собственными командами Google, а даты более широкого развёртывания пока не названы.
  • •По данным Google, Argon достигла 77,9% в бенчмарке программной инженерии DeepSWE v1.1, опередив Claude Opus 5.5 с 74,2% и GPT-6 Astra с 74,1%, хотя эти цифры получены из собственных оценок Google.
  • •Модель может создавать до 1 миллиона токенов в одном ответе — существенное увеличение по сравнению с лимитом вывода в 64 000 токенов у предыдущих моделей.
  • •Внутри Google тысячи сотрудников используют Argon для таких задач, как миграция кодовых баз с C и C++ на Rust, включая кодовые базы объёмом более 800 000 строк в ядре Zircon операционной системы Fuchsia.
  • •Argon запускается по стартовой цене 2 доллара за миллион входных токенов и 10 долларов за миллион выходных токенов, с повышением до 4 и 20 долларов соответственно после стартового периода; кэшированные входные токены получают скидку 95%.
Google запускает Gemini 4 Argon для продвинутого программирования, но ограничивает доступ из-за рисков кибербезопасности

Google запустила Gemini 4 Argon, первую модель поколения Gemini 4, представив её с доступом, изначально ограниченным доверенными специалистами по кибербезопасности и внутренними командами Google.

Компания анонсировала Argon 30 сентября в рамках программы Fairwind — инициативы, предоставляющей отдельным правительствам и доверенным партнёрам доступ к продвинутым моделям кибербезопасности Google. Согласно официальному анонсу, Argon способна автономно находить, проверять и устранять критические уязвимости программного обеспечения. Пока Google продолжает тестировать модель и совершенствовать механизмы защиты, более широкий доступ временно приостановлен.

Платные клиенты программного интерфейса приложений (API) и подписчики Google AI Ultra получат доступ позже, хотя Google не объявила конкретную дату более широкого развёртывания.

Сравнение, по данным Google

По данным Google, Argon набрала 77,9% в DeepSWE v1.1 — бенчмарке задач программной инженерии. В том же тесте компания сообщает о 74,2% у Claude Opus 5.5 от Anthropic и 74,1% у GPT-6 Astra от OpenAI.

В CWE-bench v1, оценивающем способность ИИ-моделей выявлять и устранять уязвимости ПО, Google сообщает, что Argon набрала 68%, разделив первое место с GPT-6 Astra. Результаты бенчмарков получены из собственных оценок Google, поэтому они не независимо не подтверждают эффективность Argon в реальных рабочих сценариях.

Argon также может генерировать до 1 миллиона токенов в одном ответе по сравнению с лимитом вывода в 64 000 токенов у предыдущих моделей. Токены — это базовые единицы текста, обрабатываемые и генерируемые ИИ-моделями. Увеличенный лимит вывода позволяет Argon выполнять более длинные задачи программной инженерии и другие сложные задачи без многократных запросов на продолжение.

Внутреннее внедрение

По словам Google, Argon уже используется внутри компании тысячами сотрудников для программирования, исследований и других специализированных задач. Одно из заявленных применений — миграция кодовых баз с C и C++ на Rust, системный язык программирования, разработанный для предотвращения ошибок безопасности памяти, которые являются хорошо задокументированным источником уязвимостей ПО. По данным Google, агенты Argon работают с кодовыми базами от десятков тысяч строк до более чем 800 000 строк в ядре Zircon операционной системы Fuchsia.

Компания сообщает, что крупные миграции кода проходят автоматические и ручные аудиты, тестирование эмуляцией и проверку перед развёртыванием в производственной среде. Код ядра находится в основе операционной системы, где ошибки могут затронуть каждый работающий поверх компонентn
Google также использовала агентов Argon для анализа данных о производительности центров обработки данных и выявления оптимизаций памяти. Компания сообщает, что после полного развёртывания эти изменения, как ожидается, освободят более 300 тебибайт памяти, а общая экономия оценивается в диапазоне от 500 тебибайт до 1 пебибайта. Пебибайт эквивалентен 1024 тебибайтам.

Исследователи Google в области квантовых вычислений также используют Argon для оптимизации алгоритмов. В одном примере компания сообщила, что Argon за считанные минуты превзошла опубликованный базовый показатель в задаче квантовых вычислений на 40%.

Возможности Argon в области кибербезопасности — одна из главных причин поэтапного развёртывания. Google сообщает, что модель может выявлять и устранять уязвимости с минимальным участием человека, что создаёт как защитную ценность, так и потенциальные риски безопасности по мере более широкого распространения подобных возможностей. Поэтому компания сначала предоставляет модель доверенным специалистам по киберзащите через Fairwind, собирая отзывы и продолжая разрабатывать механизмы защиты.

Google сообщила, что Argon в конечном итоге станет доступна разработчикам, предприятиям и потребителям по мере расширения доступа.

Цены

Google запустит Argon по стартовой цене 2 доллара за миллион входных токенов и 10 долларов за миллион выходных токенов. После стартового периода цена возрастёт до 4 долларов за миллион входных токенов и 20 долларов за миллион выходных токенов. Кэшированные входные токены, позволяющие повторно использовать один и тот же контекст в запросах, получат скидку 95% на цену входных токенов.

Запуск состоялся на фоне конкуренции Google с OpenAI и Anthropic в разработке всё более способных ИИ-моделей для программирования, кибербезопасности, исследований и корпоративной работы. Однако пока собственные бенчмарки Google остаются основным публично доступным измерением производительности Argon; более широкий доступ позволит независимым пользователям и исследователям протестировать модель в большем количестве рабочих сценариев.