Le changement fondamental ici est architectural : Microsoft fait passer les défenseurs d'une interface chatbot générale à un workflow d'équipe d'agents qui reflète le fonctionnement réel des organisations de sécurité. MAI-Cyber-1-Flash est spécialisé dans la détection de vulnérabilités complexes sur de larges bases de code. Perception orchestre les équipes rouges pour simuler des attaques plausibles, les équipes bleues pour détecter et trier les problèmes, et les équipes vertes pour produire des actions correctives — unifiant découverte, priorisation et remédiation en une seule boucle. Une préversion publique le 3 novembre permettrait d'intégrer la sécurité agentique directement dans les pilotes d'entreprise.
Concrètement, cela propose un nouveau référentiel pour la vitesse DevSecOps : un système agentique peut-il reproduire un bug, citer le chemin défaillant, suggérer des détections, patcher le code et valider la correction plus rapidement que les pipelines humains actuels ? Microsoft présente son harnais MDASH comme le liant pour l'identification et la correction des vulnérabilités, et revendique des performances compétitives sur des benchmarks internes. La question immédiate pour les entreprises n'est pas le battage médiatique ; c'est de savoir si Perception réduit les faux positifs et fournit des résultats priorisés et riches en contexte qui s'intègrent proprement aux workflows CI/CD et de ticketing existants.
Pour les responsables sécurité, le plan pilote doit se concentrer sur la reproductibilité, la gouvernance et l'intégration. Commencez par un corpus sélectionné d'incidents réels et de vulnérabilités connues, définissez les modèles d'attaquants et les limites des données, et exigez une télémétrie précise sur les preuves, les chemins d'exploitation et les différences de code. Mesurez le coût par découverte valide, le temps moyen pour vérifier une correction, et le taux de remédiations conformes à la politique. Intégrez avec SAST/DAST, revue de code et détection en temps réel. Impliquez une validation humaine pour les changements en production et établissez un accès sécurisé aux modèles pour les dépôts, secrets et systèmes de build.
Le risque demeure. Les revendications des benchmarks nécessitent une validation tierce et des suites de tests comparables. L'orchestration des agents peut amplifier les erreurs du modèle, donc des garde-fous et des tests adversariaux sont obligatoires. Les acheteurs doivent tester l'isolation, la journalisation et la restauration de Perception, confirmer la correspondance des politiques sur des environnements multi-cloud, et quantifier les risques de verrouillage liés aux harnais propriétaires et aux playbooks. Si la valeur se confirme — moins de transferts et des corrections plus rapides — les RSSI peuvent justifier un transfert de budget des assistants génériques vers des piles d'agents spécialisés pour la découverte et la remédiation des vulnérabilités.


