Tecnología

Microsoft lanzó su primer modelo de IA para ciberseguridad — y ya supera a Mythos 5 de Anthropic

Microsoft Project Perception y MAI-Cyber-1-Flash

Microsoft presentó el 27 de julio, en un evento en San Francisco, dos herramientas que apuntan a cambiar cómo las empresas se defienden de ataques informáticos: MAI-Cyber-1-Flash, su primer modelo de IA especializado en ciberseguridad, y Project Perception, una plataforma de agentes autónomos para detectar y parchear vulnerabilidades.

MAI-Cyber-1-Flash: el primer modelo propio de Microsoft para seguridad

MAI-Cyber-1-Flash está construido sobre la línea MAI-Thinking-1 y fue entrenado específicamente para encontrar vulnerabilidades difíciles en código complejo. No es un modelo de propósito general repropuesto: fue diseñado desde el principio para un caso de uso concreto — analizar código, identificar fallas de seguridad y proponer fixes.

Microsoft lo integra dentro de MDASH, su harness interno de identificación y remediación de vulnerabilidades. Cuando MAI-Cyber-1-Flash corre combinado con GPT-5.4 dentro de ese harness, el sistema obtuvo 96% en CyberGym — el benchmark de referencia en ciberseguridad —, 12 puntos por encima de Mythos 5 de Anthropic. Y lo hace al 50% del costo de la configuración anterior de MDASH.

Mustafa Suleiman, CEO de Microsoft AI (y co-fundador original de DeepMind), fue el encargado de anunciarlo: "Tenemos MAI-1 Cyber Flash en el harness MDASH que supera a Gemini, GPT-5.5 Cyber, GPT-5.6 Sol y Mythos 5 en CyberGym. Y lo estamos mandando a producción de inmediato."

Project Perception: agentes de seguridad en tres equipos

La otra novedad es Perception, la plataforma agentica de ciberseguridad de Microsoft. Funciona con tres equipos de agentes especializados que trabajan en conjunto:

Los agentes de red team simulan ataques — analizan la infraestructura, identifican vectores que podría usar un atacante real y generan reportes con contexto sobre amenazas concretas. Los agentes de blue team monitorean el sistema de forma continua, detectan bugs y los priorizan según su riesgo. Los agentes de green team toman acción directa: generan los parches, aplican fixes de configuración y cierran los agujeros encontrados.

El resultado según Dave Weston, el ingeniero principal de Perception: "Pasamos de horas y horas de trabajo manual de múltiples especialistas — cazadores de appsec, ingenieros de remediación — a tener, en minutos, un fix para todo. No solo descubrimos los problemas y los priorizamos, sino que tenemos detección, corrección de postura y hasta un fix en el código."

¿Por qué importa si no soy un equipo de IT corporativo?

Microsoft no es la primera en este espacio. Anthropic lanzó Mythos en abril a través del programa Glasswing, y OpenAI tiene Daybreak desde mayo. Pero la entrada de Microsoft es distinta por escala: Microsoft tiene acceso a más de 100 billones de señales de seguridad diarias de sus productos (Azure, Windows, Microsoft 365, Defender) y esa telemetría es lo que alimenta al modelo.

Para el usuario común, el impacto es indirecto pero real. Si las herramientas de las empresas que usan tu banco, tu empresa de servicios o tus plataformas favoritas empiezan a usar sistemas así, el tiempo entre que se descubre una vulnerabilidad y que se parchea se acorta de semanas a horas. Menos tiempo de exposición significa menos probabilidad de que te afecte una filtración.

Project Perception entra en preview público el 3 de agosto. MAI-Cyber-1-Flash ya está disponible para clientes enterprise de Microsoft en producción.