Le premier modèle d'IA en cybersécurité de Microsoft surpasse GPT et Gemini pour la moitié du coût.

Microsoft a dévoilé dimanche son premier modèle d'IA dédié à la cybersécurité, un modèle spécialisé compact nommé MAI-Cyber-1-Flash qui surpasse les modèles concurrents sur le benchmark de sécurité de référence du secteur tout en réduisant les coûts opérationnels de moitié environ. L'annonce, faite lors d'un événement à San Francisco dirigé par Mustafa Suleyman, CEO de Microsoft AI, a également introduit Project Perception – une plateforme de sécurité agentic qui déploie des équipes d'agents spécialisés pour simuler des attaques, détecter des vulnérabilités et écrire des correctifs de manière autonome.
MAI-Cyber-1-Flash est un dérivé du modèle interne MAI-Thinking-1 de Microsoft, affiné sur du code et entraîné spécifiquement sur les propres enregistrements d'exploitation et de correction de l'entreprise. Sur CyberGym – un benchmark couvrant 1 507 tâches de reproduction de vulnérabilités que Microsoft décrit comme la mesure standard pour les systèmes d'IA de sécurité – MDASH exécutant MAI-Cyber-1-Flash a obtenu 95,95 %, battant GPT-5.5 Cyber, GPT-5.6 Sol, Google Gemini et Anthropic Mythos 5. Le modèle obtient 12 points de plus que Mythos sur le même benchmark.
C'est dans l'architecture des coûts que le lancement devient plus intéressant. MAI-Cyber-1-Flash porte environ 90 % de la charge de travail à l'intérieur du framework MDASH d'identification des vulnérabilités de Microsoft, ne routant que les 10 % de tâches les plus difficiles vers OpenAI GPT-5.4. Cette répartition de routage réduit le coût d'exécution du système complet d'environ la moitié par rapport à la configuration de production précédente de Microsoft – un avantage significatif pour les équipes de sécurité d'entreprise opérant à grande échelle.
Project Perception : Trois équipes d'agents
Parallèlement au modèle, Microsoft a présenté Project Perception, une nouvelle plateforme de sécurité agentic construite sur MDASH. Perception répartit son travail entre trois équipes d'agents distinctes : les red agents simulent des attaques potentielles avec le contexte de l'attaquant, les blue agents détectent et catégorisent les bugs existants, et les green agents exécutent les correctifs. Selon l'ingénieur principal Dave Weston, la platforme réduit un travail qui nécessitait auparavant des heures d'effort de la part de plusieurs ingénieurs spécialisés en sécurité à quelques minutes – de la découverte initiale de vulnérabilité jusqu'à la priorisation et au déploiement des correctifs.
Le système inclut des contrôles de niveau entreprise : contrôle d'accès basé sur les rôles, isolation des locataires, chiffrement, journalisation des audits et environnements d'exécution en sandbox. Microsoft a confirmé que le modèle a passé sa revue AI Red Team, des tests adversarial et une évaluation indépendante par un tiers avant le lancement.
Disponibilité et contexte
MAI-Cyber-1-Flash sera disponible via Azure AI Foundry. Project Perception entre en public preview le 3 août 2026, avec des prévisions d'expansion de Microsoft par l'ajout d'agents de sécurité spécialisés supplémentaires au fil du temps. Ce lancement positionne Microsoft directement face aux offres de sécurité basées sur Anthropic Mythos et à la platforme OpenAI Daybreak sur le marché en pleine expansion de la sécurité IA d'entreprise.
Originally reported by TechCrunch. Read the original article for additional details.
View original source