O primeiro modelo de IA para cibersegurança da Microsoft supera GPT e Gemini com metade do custo

A Microsoft revelou neste domingo seu primeiro modelo de IA dedicado à segurança cibernética — um especialista compacto chamado MAI-Cyber-1-Flash que supera modelos concorrentes de fronteira no principal benchmark do setor, ao mesmo tempo que reduz os custos operacionais praticamente pela metade. O anúncio, feito em um evento em São Francisco liderado por Mustafa Suleyman, CEO de IA da Microsoft, também trouxe o Project Perception — uma plataforma agentic de segurança que mobiliza times de agentes especializados para simular ataques, detectar vulnerabilidades e escrever correções de forma autônoma.
O MAI-Cyber-1-Flash é uma derivação do modelo interno MAI-Thinking-1 da Microsoft, ajustado com dados de código e treinado especificamente nos registros de exploração e remediação da própria empresa. No CyberGym — um benchmark que cobre 1.507 tarefas de reprodução de vulnerabilidades e que a Microsoft descreve como a métrica padrão para sistemas de IA de segurança — o modelo rodando MAI-Cyber-1-Flash obteve 95,95%, superando GPT-5.5 Cyber, GPT-5.6 Sol, Google Gemini e Anthropic Mythos 5. O modelo marca 12 pontos a mais que o Mythos no mesmo benchmark.
A parte mais interessante do lançamento está na arquitetura de custos. O MAI-Cyber-1-Flash assume cerca de 90% da carga de trabalho dentro do framework de identificação de vulnerabilidades da Microsoft, direcionando apenas os 10% mais difíceis para o OpenAI GPT-5.4. Essa divisão de roteamento reduz o custo de operação do sistema completo em aproximadamente metade em comparação com a configuração anterior de produção da Microsoft — uma vantagem significativa para equipes de segurança empresarial operando em escala.
Project Perception: Três Times de Agentes
Junto com o modelo, a Microsoft apresentou o Project Perception, uma nova plataforma agentic de segurança construída sobre o MDASH. O Perception divide seu trabalho entre três times de agentes distintos: agentes vermelhos simulam ataques potenciais com contexto do atacante, agentes azuis detectam e categorizam bugs existentes, e agentes verdes executam correções. De acordo com o engenheiro líder Dave Weston, a plataforma reduz um trabalho que antes exigia horas de esforço de múltiplos engenheiros de segurança especializados para minutos — desde a descoberta inicial de vulnerabilidades até a priorização e implementação de patches.
O sistema inclui controles de nível empresarial: acesso baseado em papéis, isolamento de tenant, criptografia, logging de auditoria e ambientes de execução em sandbox. A Microsoft confirmou que o modelo passou por revisão do seu AI Red Team, testes adversariais e uma avaliação independente de terceiros antes do lançamento.
Disponibilidade e Contexto
O MAI-Cyber-1-Flash estará disponível através do Azure AI Foundry. O Project Perception entra em preview público em 3 de agosto de 2026, com a Microsoft planejando expandi-lo com agentes de segurança especializados adicionais ao longo do tempo. O lançamento posiciona a Microsoft diretamente contra as ofertas de segurança baseadas no Anthropic Mythos e na plataforma Daybreak da OpenAI no mercado corporativo de IA para segurança, que está em rápida expansão.
Originally reported by TechCrunch. Read the original article for additional details.
View original source