AIO APEX

El primer modelo de IA de ciberseguridad de Microsoft supera a GPT y Gemini con la mitad del costo

TechCrunch
Compartir:
El primer modelo de IA de ciberseguridad de Microsoft supera a GPT y Gemini con la mitad del costo

Microsoft presentó el domingo su primer modelo de IA dedicado a ciberseguridad, un especialista compacto llamado MAI-Cyber-1-Flash que supera a los modelos frontera rivales en el benchmark principal de seguridad de la industria, mientras reduce los costos operativos aproximadamente a la mitad. El anuncio, realizado en un evento en San Francisco liderado por el CEO de Microsoft AI, Mustafa Suleyman, también introdujo Project Perception, una plataforma de seguridad agentiva que despliega equipos de agentes especializados para simular ataques, detectar vulnerabilidades y escribir correcciones de forma autónoma.

MAI-Cyber-1-Flash es un derivado ajustado con código del modelo interno MAI-Thinking-1 de Microsoft, entrenado específicamente con los propios registros de exploits y remediaciones de la compañía. En CyberGym, un benchmark que cubre 1,507 tareas de reproducción de vulnerabilidades y que Microsoft describe como la medida estándar para sistemas de IA de seguridad, MDASH ejecutando MAI-Cyber-1-Flash obtuvo un 95.95 %, superando a GPT-5.5 Cyber, GPT-5.6 Sol, Google Gemini y Anthropic Mythos 5. El modelo anota 12 puntos más que Mythos en el mismo benchmark.

La arquitectura de costos es donde el lanzamiento se vuelve más interesante. MAI-Cyber-1-Flash maneja aproximadamente el 90 % de la carga de trabajo dentro del framework de identificación de vulnerabilidades de Microsoft MDASH, enrutando solo el 10 % más complejo de las tareas a OpenAI GPT-5.4. Esa división de enrutamiento reduce el costo de ejecución de todo el sistema aproximadamente a la mitad en comparación con la configuración de producción anterior de Microsoft, una ventaja significativa para los equipos de seguridad empresarial que operan a escala.

Project Perception: Tres equipos de agentes

Junto con el modelo, Microsoft presentó Project Perception, una nueva plataforma de seguridad agentiva construida sobre MDASH. Perception divide su trabajo en tres equipos de agentes distintos: los agentes rojos simulan ataques potenciales con contexto del atacante, los agentes azules detectan y categorizan errores existentes, y los agentes verdes ejecutan correcciones. Según el ingeniero principal Dave Weston, la plataforma reduce el trabajo que antes requería horas de esfuerzo de múltiples ingenieros de seguridad especializados a minutos, desde el descubrimiento inicial de vulnerabilidades hasta la priorización y los parches implementados.

El sistema incluye controles de nivel empresarial: acceso basado en roles, aislamiento de tenants, cifrado, registro de auditoría y entornos de ejecución en sandbox. Microsoft confirmó que el modelo pasó por su revisión del AI Red Team, pruebas adversariales y una evaluación independiente de terceros antes del lanzamiento.

Disponibilidad y contexto

MAI-Cyber-1-Flash estará disponible a través de Azure AI Foundry. Project Perception entra en vista previa pública el 3 de agosto de 2026, y Microsoft planea expandirlo con agentes de seguridad especializados adicionales con el tiempo. El lanzamiento posiciona a Microsoft directamente frente a las ofertas de seguridad basadas en Anthropic Mythos y la plataforma OpenAI Daybreak en el mercado de IA de seguridad empresarial en rápida expansión.

Originally reported by TechCrunch. Read the original article for additional details.

View original source
Compartir: