Microsoft lance MAI-Cyber-1-Flash, son premier modèle IA dédié à la cybersécurité

Microsoft lance MAI-Cyber-1-Flash, son premier modèle taillé pour détecter les vulnérabilités logicielles, et l’intègre dans Project Perception, sa nouvelle plateforme d’agents de sécurité.

mdash microsoft cybersecu
Avec MAI-Cyber-1-Flash, le harnais MDASH progresse de 88,45 % à 95,95 % sur CyberGym. © Microsoft

Microsoft a dévoilé, ce lundi 27 juillet, MAI-Cyber-1-Flash, son premier modèle d’intelligence artificielle dédié à la cybersécurité. Conçu pour repérer des vulnérabilités dans des bases de code complexes, il vient s’intégrer à MDASH, le harnais multi-agents de la firme dédié à la détection et à la correction de failles logicielles. Microsoft en profite pour annoncer Project Perception, une nouvelle plateforme d’agents IA destinée à automatiser une partie du travail des équipes de sécurité.

MAI-Cyber-1-Flash, un modèle taillé pour traquer les failles complexes

MAI-Cyber-1-Flash est un dérivé de MAI-Thinking-1, le modèle de raisonnement que Microsoft a développé en interne et présenté en juin, aux côtés de six autres modèles maison. Il s’agit d’une version compacte et peu coûteuse à faire tourner, entraînée sur les données d’exploitation et de remédiation accumulées par les équipes de sécurité de Microsoft au fil des années.

MAI-Cyber-1-Flash ne fonctionne pas seul. Il est intégré à MDASH, le harnais que Microsoft avait dévoilé dès le mois de mai. Celui-ci orchestre plus de 100 agents spécialisés à travers un pipeline en plusieurs étapes (préparation, scan, débat contradictoire entre agents, dédoublonnage, puis preuve d’exploitabilité), en utilisant plusieurs modèles à la fois. Dès mai, en s’appuyant sur des modèles tiers, il affichait déjà 88,45 % sur CyberGym, la meilleure marque du classement à l’époque.

Intégré à MDASH aux côtés de GPT-5.4 d’OpenAI, plus onéreux à l’usage, MAI-Cyber-1-Flash absorbe désormais jusqu’à 90 % des tâches de sécurité courantes. GPT-5.4 n’est sollicité que pour les 10 % de cas les plus complexes, une répartition qui permet à Microsoft de revendiquer une réduction de moitié des coûts par rapport à la configuration MDASH actuellement en production. Sur CyberGym, le benchmark de référence pour évaluer la détection de vulnérabilités réelles dans du code open source, la combinaison MAI-Cyber-1-Flash, GPT-5.4 et MDASH atteint 95,95 %, un score que Microsoft situe environ 12 points au-dessus de Claude Mythos 5 d’Anthropic.

Project Perception, une plateforme d’agents pour la défense en continu

MAI-Cyber-1-Flash est intégré, via MDASH, à une nouvelle plateforme d’agents, baptisée Project Perception. Celle-ci entrera en preview publique le 3 août, d’abord au sein de Microsoft Defender, avant une extension progressive à l’ensemble des produits de sécurité de la firme. La facturation s’effectuera à la consommation, en unités appelées Security Compute Units, dont le volume dépend de l’intensité des tâches exécutées par les agents.

Project Perception déploie une équipe d’agents répartis en trois rôles.

  • Agents rouges : ils simulent des attaques, à la manière d’un assaillant qui chercherait une faille à exploiter.
  • Agents bleus : ils détectent les menaces et les hiérarchisent selon leur gravité.
  • Agents verts : ils appliquent les correctifs et referment les brèches identifiées.

Les actions à fort impact restent soumises à une validation humaine. La firme défend ainsi une répartition claire des rôles, où les agents portent la charge de travail tandis que les équipes de sécurité gardent la main sur les décisions stratégiques.

La cybersécurité, nouveau terrain de rivalité entre les acteurs de l’IA

En 2026, la cybersécurité semble être devenue une nouvelle priorité pour les grands acteurs de l’IA. Anthropic a ouvert les hostilités en avril, avec Claude Mythos Preview, présenté comme un modèle si performant en détection de vulnérabilités qu’il a été jugé trop sensible pour un accès public. La firme l’a réservé à une cinquantaine d’organisations partenaires via Project Glasswing, avant d’en décliner une version grand public, baptisée Fable 5, encadrée par des garde-fous qui redirigent les requêtes sensibles vers Claude Opus 4.8. OpenAI avait répliqué dans la foulée avec GPT-5.4-Cyber, avant de fédérer ses outils au sein de Daybreak en mai.

Naturellement, pour démontrer la valeur de son innovation, Microsoft se devait d’afficher un modèle qui surpasse ses concurrents sur CyberGym. Mais rien n’est moins sûr: la firme ne précise pas toujours dans quelles conditions les modèles rivaux ont été évalués, ni s’ils s’appuyaient eux aussi sur un harnais agentique comparable au sien.

Sujets liés :
Publier un commentaire
Ajouter un commentaire

Votre adresse email ne sera pas publiée.

Visuel enquête Visuel enquête

Community managers : participez à notre enquête 2026

L'objectif est de comprendre comment évolue votre métier : missions, réseaux utilisés, outils...

Je participe

Les meilleurs agents IA