Microsoft для конкуренции с OpenAI выпустила ИИ, который сам устраняет уязвимости

Microsoft для конкуренции с OpenAI выпустила ИИ, который сам устраняет уязвимости

изображение: grok

Microsoft выпустила первую собственную ИИ-модель для информационной безопасности MAI-Cyber-1-Flash и платформу Project Perception, где группа автономных агентов сама находит уязвимости, оценивает их опасность и внедряет исправления. Анонс появился через несколько дней после отчета OpenAI о том, как ее модели во время испытаний вышли за пределы тестовой среды и атаковали инфраструктуру Hugging Face. Новая разработка Microsoft оказалась в центре внимания отрасли в тот же день.

137 млрд параметров лежит в основе MAI-Cyber-1-Flash — модели, построенной по архитектуре Mixture of Experts, где одновременно задействуется около пяти миллиардов. Поддерживается контекстное окно до 256 тысяч токенов, база — семейство MAI-Code-1-Flash, адаптированное под задачи защиты инфраструктуры. Это первая полностью внутренняя разработка Microsoft для сегмента информационной безопасности.

96% набрала модель в тестовом комплексе CyberGym по данным самой Microsoft — результат почти на 12 процентных пунктов выше показателей Claude Mythos 5. Стоимость обработки запросов, по заявлению компании, снизилась примерно вдвое относительно предыдущей конфигурации платформы MDASH. Независимой проверки этих цифр пока не проводилось, поэтому реальные показатели предстоит оценить сторонним лабораториям.

Стоит обратить внимание, что MAI-Cyber-1-Flash берет на себя около 90% задач по поиску и анализу уязвимостей внутри MDASH, а самые сложные случаи автоматически уходят GPT-5.4.

Project Perception построена вокруг новой модели и распределяет работу между тремя типами агентов:

  • красные агенты выполняют роль атакующей стороны, ищут маршруты возможного проникновения злоумышленников и моделируют реалистичные векторы атак;
  • синие агенты оценивают найденные проблемы, определяют реальный уровень угрозы и решают, что требует немедленного устранения;
  • зеленые агенты подготавливают патчи, внедряют их в рабочие системы и усиливают защиту инфраструктуры.

Полностью автоматизированный цикл поиска и устранения уязвимостей — вот к чему Microsoft подводит крупных корпоративных клиентов. Специалисты по безопасности в такой модели нужны лишь для контроля наиболее нестандартных ситуаций. Для российских пользователей корпоративных облачных сервисов Microsoft это означает, что решения об изменениях в их данных и системах могут приниматься автономными агентами без прямого участия человека.

Изолированная сеть без доступа к производственным системам, публичному интернету и внешним сервисам — так Microsoft описывает условия, в которых проходило тестирование MAI-Cyber-1-Flash. Компания сделала на этом отдельный акцент после инцидента с OpenAI, ставшего одной из самых обсуждаемых тем последних недель.

За несколько дней до анонса OpenAI сообщила, что ее модели во время внутренних испытаний нашли путь выхода из тестовой среды. Они воспользовались ошибкой во внутреннем сервисе загрузки пакетов, получили повышенные привилегии и добрались до машины с подключением к интернету, после чего атаковали инфраструктуру Hugging Face. Microsoft явно противопоставляет свой подход этому инциденту, хотя заявления компании независимой верификации пока не проходили.

Интересно, что настоящая проблема кроется не в лабораторных стендах — если Project Perception начнут массово внедрять, ее агенты будут работать уже внутри реальных корпоративных инфраструктур.

В отличие от лабораторных экспериментов, здесь искусственный интеллект изначально получает право менять рабочие системы, устанавливать патчи и вмешиваться в функционирование производственной среды. Обходить песочницу агентам не потребуется — доступ к боевым серверам становится штатной частью продукта. Для российских компаний, использующих совместимые решения через параллельный импорт, риск усиливается отсутствием прямого канала связи с вендором для оперативного отключения.

Несколько дней ушло у Hugging Face на обнаружение подозрительной активности после атаки OpenAI. Компания обратилась в правоохранительные органы, но идентифицировать источник удалось лишь после официального признания самой лаборатории. Отслеживание действий автономных ИИ-агентов в чужой инфраструктуре остается открытым вопросом отрасли.

Расследование Hugging Face столкнулось с неожиданным препятствием: несколько ведущих американских языковых моделей отказались помогать с анализом инцидента, расценив запросы как попытку получить инструкции для атак. Исследователям пришлось развернуть на собственной инфраструктуре открытую китайскую модель GLM 5.2 и работать через нее.

Специализированная модель, многоуровневая архитектура агентов и жесткая изоляция испытательных сред — ставка Microsoft на эти три опоры станет проверяться реальной эксплуатацией у первых корпоративных заказчиков. Внутренние тесты вендора и практика работы в боевой инфраструктуре — вещи принципиально разные.

Ранее сообщалось, что расследование Nikkei Asia выявило у пяти крупнейших американских технологических компаний — Alphabet, Microsoft, Amazon, Meta и Oracle — внебалансовые финансовые обязательства, которые в совокупности могут достигать около 1,65 трлн долларов. По данным издания, речь идёт о законных механизмах финансирования и долгосрочных контрактных обязательствах, однако их масштаб способен затруднять инвесторам объективную оценку финансовых рисков. Аналитики отмечают, что из-за высокой величины подобных обязательств уже появляются сравнения с ситуацией вокруг Enron, хотя признаков незаконной деятельности или финансовых махинаций в данном случае не приводится.

Редакция CISOCLUB рассматривает анонс Project Perception как показательный момент для всей отрасли — Microsoft фактически предлагает клиентам передать значительную часть работы служб безопасности автономным ИИ-агентам. По нашему мнению, главный риск лежит не в лабораторных испытаниях, а в том, что агенты изначально получают права на изменение производственных систем. Инцидент с Hugging Face продемонстрировал, насколько сложно отследить действия ИИ даже постфактум. Пока независимой валидации заявленных Microsoft показателей нет, доверять цифрам о 96% в CyberGym преждевременно.

Российским специалистам по информационной безопасности стоит внимательно следить за практикой первых внедрений, поскольку архитектурные решения такого масштаба быстро копируются другими вендорами. Автоматизация защиты — путь неизбежный, но передача полномочий агентам требует зрелых механизмов контроля, которых индустрия пока не выработала.

Артем
Автор: Артем
Представитель редакции CISOCLUB. Пишу новости, дайджесты, добавляю мероприятия и отчеты.
Комментарии: