НовостиАкцииMicrosoft представила MAI-Cyber-1-Flash и Project Perception для агентной кибербезопасности

Microsoft представила MAI-Cyber-1-Flash и Project Perception для агентной кибербезопасности

Автор: VentureBeat AI·

Ключевые выводы

  • MAI-Cyber-1-Flash встроена в MDASH, многоагентную систему Microsoft для выявления и исправления уязвимостей в программном обеспечении.
  • Microsoft заявляет, что новая конфигурация может обрабатывать до 90% задач безопасности с помощью меньшей модели и передавать более сложные случаи в OpenAI’s GPT-5.4.
  • Компания сообщает об экономии затрат примерно на 50% по сравнению с существующей производственной конфигурацией MDASH.
  • Project Perception будет координировать агентов red team, blue team и green team и должна выйти в публичное предварительное тестирование 3 августа.
  • Microsoft заявляет, что доступ к MAI-Cyber-1-Flash будет ограничиваться и контролироваться из-за потенциального злоупотребления со стороны злоумышленников.
Microsoft представила MAI-Cyber-1-Flash и Project Perception для агентной кибербезопасности

Microsoft в понедельник представила свою первую специально разработанную модель для кибербезопасности и более широкую агентную защитную платформу, позиционируя запуск как часть корпоративной стратегии ИИ, ориентированной на использование меньших и более дешевых моделей для большинства задач с передачей более сложных заданий более мощным системам.

Компания анонсировала MAI-Cyber-1-Flash, компактную модель безопасности, разработанную внутри ее подразделения Microsoft AI (MAI). Модель встроена в MDASH, многоагентную систему Microsoft для обнаружения и исправления уязвимостей в программном обеспечении. По словам Microsoft, объединенная система набирает 96% в CyberGym — бенчмарке, который измеряет, насколько хорошо ИИ-системы рассуждают по большим кодовым базам для выявления реальных уязвимостей. Компания заявила, что результат превосходит frontier-модели, включая Mythos, Gemini и GPT, при этом снижая затраты примерно наполовину по сравнению с текущей производственной конфигурацией Microsoft.

Microsoft также представила Project Perception — агентную систему безопасности, созданную для координации нескольких типов защитных агентов: агентов “red team”, которые ищут возможные пути компрометации, агентов “blue team”, которые расследуют и приоритизируют риски, и агентов “green team”, которые устраняют проблемы и усиливают защиту. Project Perception должна выйти в публичное предварительное тестирование 3 августа, что сделает этот preview ранней проверкой того, сможет ли Microsoft перенести свой подход «модель плюс orchestration harness» в рабочие процессы, которые команды безопасности смогут оценивать за пределами компании.

В эксклюзивном интервью VentureBeat генеральный директор Microsoft AI Mustafa Suleyman сказал, что объявление означает начало более долгосрочных усилий.

“We really do have a pretty significant data and harness and expertise moat, and that is enabling us to train models which are faster, better, cheaper, and I think this is genuinely the tip of the iceberg,” сказал Suleyman. “We haven't been working on this for long. The next model is going to be pretty phenomenal.”

Архитектура Microsoft 90/10 по-прежнему использует OpenAI’s GPT-5.4

Одна из самых заметных технических деталей заключается не столько в самой MAI-Cyber-1-Flash, сколько в том, как Microsoft ее развертывает. Компания спроектировала MAI-Cyber-1-Flash так, чтобы эффективно обрабатывать до 90% задач безопасности. Затем MDASH передает оставшиеся 10% особенно сложных проблем более крупной frontier-модели — OpenAI’s GPT-5.4. Это означает, что флагманская ИИ-система Microsoft для безопасности продолжает полагаться на своего давнего партнера и все более заметного конкурента в наиболее сложной работе.

Suleyman сказал, что ключевой компонент — это harness, слой оркестрации, который направляет каждую поступающую проблему к модели, лучше всего подходящей для ее решения. “The harness is like a router,” сказал он VentureBeat. “It's kind of like guardrails and a rule set of an organizing logic, which matches queries to... incoming problems to a model that suits the problem.”

Он описал систему как состоящую из трех частей: harness, меньшей и более быстрой модели MAI-Cyber-1-Flash, которая обрабатывает большинство запросов, и GPT-5.4, работающей рядом с ней как “just a generalist coding model.”

На вопрос о том, как система, зависящая от модели OpenAI, может превосходить frontier-конкурентов, Suleyman ответил, что производительность обеспечивает вся система, а не какая-либо отдельная модель. “These are very complicated, long, agentic loops which require storing state, drawing on another database, consulting best practice... handing back to a small model, writing a bunch of code, validating that that was correct,” сказал он. “There's like hundreds of steps to solve that, and that's why it's really the system together that delivers the better performance.”

Suleyman сказал, что выбор GPT-5.4 для уровня эскалации также был обусловлен стоимостью. “GPT-5.6 is expensive. GPT-5.4 is incredibly good relative to its cost,” сказал он. “The whole game here is to reduce the costs. Mythos and so on are extremely expensive models... we want to be able to deliver better performance for cheaper. That's what customers want.”

Эта структура отражает меняющиеся отношения Microsoft с OpenAI. Microsoft остается клиентом и партнером в рамках соглашения, которое привлекло внимание регуляторов в Брюсселе и Вашингтоне в 2024 году, но при этом стремится контролировать больше уровней ИИ-стека там, где, по ее мнению, у нее есть устойчивые преимущества. Она также показывает, как Microsoft разделяет владение моделью и владение системой: даже когда компания использует модель партнера, она делает акцент на маршрутизации, ограничителях и специфичном для безопасности рабочем процессе вокруг этой модели.

Стоимость токенов стала серьезным ограничением для корпоративного ИИ

Microsoft заявляет, что новая конфигурация обеспечивает экономию затрат примерно на 50% по сравнению с существующей установкой MDASH, которая использует смесь GPT-5.4, 5.4 mini и 5.3 codex. В кибербезопасности, где системы работают непрерывно и обрабатывают очень большие объемы сигналов, стоимость токенов быстро накапливается. Microsoft утверждает, что эти расходы стали центральным ограничением для защитников.

Suleyman связал проблему стоимости с физическими ограничениями вычислительной инфраструктуры. “The key barrier to adoption is access to chips, and cost is a function of chips,” сказал он. “No matter how much money you've got, there's actually a limited supply of chips. Then trying to squeeze more model output on fewer chips is clearly super valuable.”

Он также сказал, что предприятия начинают сопротивляться ценам frontier-моделей. По его словам, компании сначала использовали самые мощные доступные модели, но “then they realize they're sort of paying... a phenomenal amount of money, and people are absolutely token maxing everywhere across their business. So there's a massive pushback to reduce cost everywhere.”

Microsoft позиционирует свой подход в рамках более широкой тенденции к экономичным ИИ-моделям, близким к frontier-уровню. За последний год такие системы появились, в том числе, в недавней модели Grok от xAI и в волне китайских моделей, построенных вокруг схожих предпосылок соотношения стоимости и производительности. Suleyman сказал, что положение Microsoft как платформенной компании согласуется с давлением на корпоративные расходы. “The top model providers want you to use the most expensive model continuously, whereas because we are a platform, we're on the side of the enterprise,” сказал он. “There's no point asking... Mythos what the capital of France is.”

Microsoft указывает на преимущество в данных безопасности объемом 100 триллионов сигналов

Аргументация Microsoft в кибербезопасности также опирается на масштаб ее телеметрии безопасности. Компания заявляет, что ежедневно обрабатывает более 100 триллионов сигналов безопасности — показатель, соответствующий ее 2025 Digital Defense Report. В этом отчете также упоминались 4.5 миллиона новых заблокированных файлов вредоносного ПО и 5 миллиардов проверяемых писем в день. Microsoft говорит, что получает операционные инсайты от 1.6 миллиона клиентов.

“We have trillions and trillions of data points going back decades,” сказал Suleyman. “It is, I think, the largest longitudinal cybersecurity dataset around,” отчасти потому, что Microsoft обслуживает правительства, “who have been consistently attacked for years, and we have been consistently attacked.”

На вопрос о том, создает ли это преимущество, с которым конкуренты не могут сравниться, Suleyman сказал: “That is definitely a moat for us. Both the data and the expertise, and just the experience in the institution of going through that process.”

Стратегический тезис Microsoft заключается в том, что кибербезопасность может функционировать как живой цикл обучения с подкреплением. Защитники предпринимают действия, результаты наблюдаются, а модели могут улучшаться. Компания утверждает, что связь действий с результатами — включая то, что было эксплуатировано, локализовано или заблокировано, — дает обучающие сигналы, которые лаборатории, занимающиеся только моделями, не могут просто купить или произвести.

У заявлений о бенчмарках также есть оговорки. Результаты CyberGym основаны на собственной оценке Microsoft, а детальная цифра за заголовочным результатом 96% составляет 95.95%. Бенчмарки, проводимые поставщиками, которые сравнивают настроенную агентную систему с базовыми моделями конкурентов, не являются контролируемыми тестами «модель против модели». Microsoft измерила полную конфигурацию «harness плюс модели» в сравнении с тем, что клиенты могли бы собрать иначе; это может быть коммерчески релевантно, но не является прямым сравнением автономных моделей.

Microsoft заявляет, что доступ будет ограничен из-за рисков двойного назначения

Модель, предназначенная для поиска сложных уязвимостей в комплексных кодовых базах, также может быть полезна злоумышленникам, ищущим уязвимости. Собственная команда Microsoft по анализу угроз в совместном исследовании с OpenAI, опубликованном в феврале 2024 года, задокументировала, как государственные акторы из России, Северной Кореи, Ирана и Китая изучали большие языковые модели для разведки, написания скриптов и исследования уязвимостей. Microsoft’s 2025 Digital Defense Report также предупредил, что ИИ-агенты в конечном счете могут автоматизировать полный жизненный цикл атаки.

Suleyman сказал, что Microsoft будет соответственно ограничивать доступ. “We're very strict about who gets access to the model, and we're very careful about that,” сказал он. “We constantly monitor the API and usage.” Одобренный пользователь, добавил он, “has to be seen to be having good intent, but also have technical competence.”

Он сказал, что развертывание будет проходить поэтапно: “It's not going to be thousands next week. There will be tens, and then hundreds, and then thousands.”

Microsoft заявляет, что MAI-Cyber-1-Flash была оценена ее AI Red Team, протестирована с помощью автоматизированных и проводимых экспертами состязательных упражнений и независимо оценена третьей стороной. Компания сообщила, что защитные меры при развертывании включают изоляцию tenant-сред, аудит и sandboxed-среды выполнения без доступа к интернету.

Suleyman также признал позицию Microsoft относительно новейших frontier-систем, представив свой подход через призму осторожности и надежности. “Even though we might be a few months behind the absolute cutting edge at any given moment... it matters that we're doing it very carefully and thoughtfully, and we have a track record of doing that,” сказал он.

Этот акцент последовал за сложным для Microsoft 2024 годом в сфере безопасности, включая решение отложить функцию Recall из-за опасений по поводу конфиденциальности и участие компании в созыве отраслевого саммита после сбоя CrowdStrike, который вывел из строя около 8.5 миллиона устройств Windows.

Suleyman описал более широкую дорожную карту Microsoft AI

Suleyman сказал, что дорожная карта MAI ускоряется примерно через девять месяцев после того, как Microsoft создала свою команду superintelligence. “We have the compute that we need. We certainly have the data we need. We have the talent,” сказал он. “Our momentum is accelerating rapidly.”

Он сказал, что один из ведущих запросов со стороны предприятий — это “agents that can produce arbitrary code to solve whatever problem they direct them at,” поскольку внутренние инструменты, созданные в стиле vibe-coding, переходят от экспериментов к эксплуатации в production. Следующий этап, по его словам, объединит модели для голоса, транскрибации, изображений и программирования “all integrated into the same harness.”

Suleyman также поставил под сомнение отраслевое предположение о том, что ИИ сойдется к одной большой унифицированной модели. “It remains to be seen whether one giant model that is fully multimodal is actually able to deliver additional transfer learning benefit because of the integration,” сказал он, “or whether it's just a big lumbering expensive giant.”

Эта точка зрения лежит в основе объявления Microsoft. Компания утверждает, что конкуренция в корпоративном ИИ смещается от отдельных моделей к полноценным системам: маршрутизаторам, специализированным малым моделям, вариантам fallback на frontier-модели и собственным циклам данных. В кибербезопасности, по словам Microsoft, контроль как над телеметрией безопасности, так и над защитными продуктами усиливает этот подход. Остается открытым вопросом, применима ли та же стратегия в областях, где преимущество Microsoft в данных меньше, для дорожной карты MAI.

Пока Microsoft представляет MAI-Cyber-1-Flash, MDASH и Project Perception как preview того, как она намерена конкурировать на следующем этапе развития ИИ: не полагаясь только на крупнейшую модель, а создавая вокруг моделей систему, которая может эффективно маршрутизировать задачи. Как сказал Suleyman, компания рассматривает это как “the tip of the iceberg.”