Illustration : Flock
Microsoft AI a présenté le 27 juillet 2026 son premier modèle dédié à la cybersécurité. Intégré dans son architecture, l’entreprise annonce battre tous les modèles actuels dans ce domaine, y compris Mythos d’Anthropic, mais attention à ce qui est réellement comparé.
Hier soir, Microsoft a annoncé officiellement MAI-Cyber-1-Flash. Il s’agit du tout premier LLM de l’éditeur consacré à la cybersécurité. Et pour un premier modèle, Microsoft a mis les petits plats dans les grands.
MAI-Cyber-1-Flash est un modèle compact, spécialisé dans le code et dérivé de la lignée MAI-Thinking-1, propre à Microsoft. Il est intégré à MDASH, le harnais multi-agents de détection et de remédiation de vulnérabilités déjà présenté par Microsoft en mai dernier. Plus récemment, l’entreprise est revenue sur le rôle prépondérant que joue désormais MDASH dans la sécurité de ses produits, expliquant l’envolée du nombre de failles corrigées dans les derniers bulletins mensuels : près de 200 en juin et plus de 570 en juillet.
Un modèle, un harnais…
Microsoft n’hésite pas à déclarer que son modèle, profondément intégré à MDASH, a été « perfectionné par les meilleurs experts en cybersécurité du secteur et renforcé dans le plus grand domaine de sécurité au monde ». Ce qui lui permet, toujours selon Microsoft, de battre tout le monde dans le domaine de la détection de failles, y compris Mythos, GPT 5.6 Sol, GPT 5.5 Cyber et Gemini 3.5 Flash Cyber. Avec 95,95 % au test CyberGym, Microsoft dépasse d’au moins 10 points la concurrence.
Mais attention, Microsoft ne compare pas directement son modèle MAI-Cyber-1-Flash aux autres : l’entreprise compare MDASH. Autrement dit, tout le harnais avec le nouveau modèle et GPT 5.4, utilisé en renfort.

Comme expliqué par l’éditeur en effet, MAI-Cyber-1-Flash est un modèle compact, conçu pour « gérer efficacement jusqu’à 90 % de toutes les tâches ». Dans cette configuration, MDASH ne basculerait vers les modèles plus gros et plus couteux (ici GPT 5.4) que dans 10 % des cas en moyenne, « pour les tâches exceptionnellement difficiles qui en ont réellement besoin ».
C’est bien cette architecture complète qui atteint près de 96 % sur CyberGym, battant Mythos de 12 points, insiste Microsoft. Rappelons que ces chiffres sont auto-rapportés et effectués dans un environnement contrôlé par Microsoft. Ils n’ont pas été vérifiés par un tiers indépendant.
Pour l’éditeur, c’est aussi une question d’économies substantielles. La meilleure offre MDASH combinait jusqu’à présent GPT 5.4 + 5.4 mini + codex 5.3. La nouvelle version intégrant MAI-Cyber-1-Flash coûterait moitié moins cher à faire tourner.
… et une plateforme
Mi-juillet, nous avions relayé un bruit de couloir : Microsoft préparait un projet nommé Perception pour venir concurrencer Anthropic et son projet Glasswing, seule manière de pouvoir utiliser Mythos.
Perception a bien été confirmé hier soir lui aussi. Il est présenté comme le système agentique qui vient chapeauter MAI-Cyber-1-Flash et MDASH. Le billet de blog dédié le présente comme une refonte de l’architecture de sécurité pour l’ère de l’IA : une nouvelle pile de sécurité doit percevoir en continu le risque sur l’ensemble du parc numérique, raisonner sur de vastes quantités de contexte et agir à vitesse machine, tout en apprenant et en s’adaptant à mesure que les environnements évoluent.
Le système coordonne trois familles d’agents spécialisés qui se transmettent le travail sans rupture de charge :
- Les agents rouges repèrent les chemins de compromission potentiels avant qu’un attaquant ne puisse les exploiter
- Les agents bleus enquêtent, évaluent le contexte et déterminent quels signaux représentent un risque réel
- Les agents verts appliquent les correctifs et durcissent l’environnement (renforcent sa sécurité)
Ces agents ne repartent pas de zéro à chaque tâche. Ils s’appuient sur un contexte de sécurité partagé : une représentation mise à jour en continu des actifs, identités, relations et risques de l’organisation. Tous les agents puisent dans ce contexte, réduisant les coûts en tokens et la latence tout en améliorant la cohérence du raisonnement, selon Microsoft.

Un programme complet, mais très jeune
Un serveur MCP est également fourni pour exécuter les actions en ligne de commande. Les agents verts peuvent aussi ouvrir directement des pull requests sur GitHub et construire des correctifs potentiels pour les vulnérabilités. Perception propose donc un système de sécurité en apprentissage continu combinant capteurs, contexte partagé, modèles multiples, agents spécialisés et mécanismes d’action capables de modifier les protections à travers l’environnement.
Le programme se présente ainsi comme une couche d’orchestration, au-dessus de MAI-Cyber-1-Flash et MDASH, avec un déploiement encore très récent et une autonomie d’action volontairement limitée à ce stade. Microsoft insiste sur le maintien d’un humain dans la boucle décisionnelle, ce qui suggère que l’entreprise elle-même reste prudente sur le niveau de confiance à accorder aux agents verts capables de modifier des systèmes de production.
Perception n’est d’ailleurs pas disponible. Le premier accès se fera sous forme de préversion le 3 août et uniquement pour des clients MDASH triés sur le volet. Même une fois lancé en version finale, il est très probable que Perception ne soit accessible qu’au travers d’un accès vérifié, à la manière de Glasswing chez Anthropic ou de Daybreak chez OpenAI.
