Microsoft выпустил ИИ, который сам взламывает свои системы — и сам их чинит
Microsoft запускает Project Perception — ИИ-агентов, которые сами ищут и чинят уязвимости. Публичный тест стартует 3 августа.
Microsoft выпустил ИИ, который сам взламывает свои системы — и сам их чинит
Microsoft анонсировала Project Perception — систему кибербезопасности, где всю работу делают ИИ-агенты, поделённые на три команды.
Красная команда ищет уязвимости раньше хакеров. Синяя разбирается, какие из находок реально опасны. Зелёная чинит защиту. Все три работают в непрерывном цикле, без пауз на человека.
Публичный тест открывается 3 августа.
Microsoft уже показала первые цифры. Модель MAI-Cyber-1-Flash встроена в систему управления уязвимостями MDASH и набрала 96% на бенчмарке CyberGym — тесте, который оценивает, насколько хорошо ИИ находит и разбирает уязвимости в коде. Это на 12 пунктов больше, чем у Mythos, модели компании Anthropic. При этом сама проверка обходится почти вдвое дешевле: сложные задачи решают дорогие «думающие» модели, а рутину — узкоспециализированные и быстрые.
Сравнение с Mythos выбрано не случайно. Ранее Белый дом временно заблокировал эту модель, после чего она стала считаться самой мощной в кибербезопасности. Теперь Microsoft заявляет, что обошла конкурента и по качеству, и по цене — опираясь на данные о десятилетиях защиты корпоративных систем, которых у Anthropic просто нет.
В июле Белый дом запустил инициативу Gold Eagle для координации ИИ-защиты от кибератак. Project Perception — заявка Microsoft на то, чтобы стать платформой, на которой эта защита будет работать.
96% на CyberGym — результат на синтетических задачах, а не на живых атаках, и разрыв между лабораторным тестом и настоящим инцидентом обычно ощутим. Пока агенты не закроют без участия человека хотя бы одну реальную брешь в проде, заявка Microsoft на роль главной защитной платформы остаётся маркетингом, подкреплённым бенчмарком, а не проверенной в бою системой.