Microsofts erstes KI-Modell für Cybersicherheit übertrifft GPT und Gemini zu halben Kosten

Microsoft enthüllte am Sonntag sein erstes dediziertes Cybersecurity-KI-Modell, einen kompakten Spezialisten namens MAI-Cyber-1-Flash, der die führenden konkurrierenden Modelle beim primären Sicherheitsbenchmark der Branche übertrifft und dabei die Betriebskosten etwa halbiert. Die Ankündigung auf einer Veranstaltung in San Francisco, geleitet von Microsoft AI CEO Mustafa Suleyman, stellte außerdem Project Perception vor – eine agentische Sicherheitsplattform, die Teams spezialisierter Agents einsetzt, um Angriffe zu simulieren, Schwachstellen zu erkennen und autonom Fixes zu schreiben.
MAI-Cyber-1-Flash ist ein code-getuntes Derivat des internen Microsoft-Modells MAI-Thinking-1, das speziell auf die eigenen Exploit- und Remediation-Datensätze des Unternehmens trainiert wurde. Im CyberGym – einem Benchmark mit 1.507 Vulnerability-Reproduktionsaufgaben, den Microsoft als Standardmaß für KI-Sicherheitssysteme beschreibt – erzielte MAI-Cyber-1-Flash 95,95% und schlug damit GPT-5.5 Cyber, GPT-5.6 Sol, Google Gemini und Anthropic Mythos 5. Das Modell liegt im selben Benchmark 12 Punkte vor Mythos.
Die Kostenarchitektur macht den Launch noch interessanter. MAI-Cyber-1-Flash übernimmt etwa 90% der Arbeitslast innerhalb des Microsoft-eigenen Vulnerability-Identification-Frameworks und leitet nur die schwierigsten 10% der Aufgaben an OpenAI GPT-5.4 weiter. Diese Aufteilung senkt die Kosten für den Betrieb des Gesamtsystems im Vergleich zur vorherigen Microsoft-Produktionskonfiguration um etwa die Hälfte – ein bedeutender Vorteil für Enterprise-Sicherheitsteams, die im großen Maßstab arbeiten.
Project Perception: Drei Teams von Agents
Neben dem Modell stellte Microsoft Project Perception vor, eine neue agentische Sicherheitsplattform, die auf MDASH aufbaut. Perception verteilt seine Arbeit auf drei verschiedene Agenten-Teams: Red Agents simulieren potenzielle Angriffe mit Angreiferkontext, Blue Agents erkennen und kategorisieren bestehende Bugs, und Green Agents führen Fixes aus. Laut Lead Engineer Dave Weston reduziert die Plattform Arbeit, die zuvor stundenlange Anstrengungen mehrerer spezialisierter Sicherheitsingenieure erforderte, auf Minuten – von der ersten Vulnerability-Erkennung über die Priorisierung bis zu deployed Patches.
Das System umfasst Enterprise-Grade-Kontrollen: rollenbasierte Zugriffssteuerung, Tenant-Isolation, Verschlüsselung, Audit-Logging und sandboxed Ausführungsumgebungen. Microsoft bestätigte, dass das Modell vor dem Launch die AI Red Team-Prüfung, adversarial Testing und eine unabhängige Drittanbieterbewertung durchlaufen hat.
Verfügbarkeit und Kontext
MAI-Cyber-1-Flash wird über Azure AI Foundry verfügbar sein. Project Perception tritt am 3. August 2026 in die Public Preview ein, mit der Planung von Microsoft, es im Laufe der Zeit um weitere spezialisierte Sicherheits-Agents zu erweitern. Der Launch positioniert Microsoft direkt gegen Anthropic Mythos-basierte Sicherheitsangebote und die OpenAI Daybreak-Plattform im schnell wachsenden Enterprise-KI-Sicherheitsmarkt.
Originally reported by TechCrunch. Read the original article for additional details.
View original source