MAI-Cyber-1-Flash se integrará en el sistema MDASH y derivará las tareas más complejas a GPT-5.4. Microsoft afirma que la combinación reduce casi a la mitad el costo de su configuración actual, una comparación que no incluye metodología pública detallada.
Microsoft presentó MAI-Cyber-1-Flash, el primer modelo de ciberseguridad entrenado internamente por la compañía, y Project Perception, una plataforma que coordina modelos y agentes especializados para analizar vulnerabilidades y responder a riesgos.
El modelo funcionará dentro de MDASH, el sistema multiagente de Microsoft para descubrir, validar y ayudar a corregir fallas de software. La arquitectura utiliza MAI-Cyber-1-Flash para la mayor parte del análisis y deriva las tareas más exigentes a GPT-5.4.
Según David Weston, vicepresidente corporativo de seguridad de IA de Microsoft, el modelo especializado realiza cerca del 95% del trabajo del sistema. La estrategia busca reservar modelos de frontera, más costosos, para los casos que requieren mayor capacidad.
Resultados informados por Microsoft
La compañía afirma que la combinación obtuvo 95,95% en CyberGym, un benchmark basado en vulnerabilidades reales que mide la capacidad de generar pruebas de concepto funcionales. Microsoft redondea el resultado a 96% en su anuncio y lo sitúa doce puntos por encima de Mythos, de Anthropic.
También sostiene que la nueva configuración reduce casi 50% el costo frente a la versión de MDASH disponible actualmente.
Ambas cifras proceden de Microsoft. La publicación no entrega una metodología completa para reproducir la comparación de costos ni detalla todas las configuraciones, número de intentos y condiciones aplicadas a los modelos rivales. Por ello, los resultados permiten describir el rendimiento declarado en ese entorno, pero no establecer una superioridad general en operaciones reales.
Agentes Red, Blue y Green
Project Perception organiza tres clases de agentes. Los agentes Red buscan rutas potenciales de compromiso antes de que sean aprovechadas por atacantes. Los agentes Blue investigan señales y determinan cuáles representan riesgos relevantes. Los agentes Green preparan acciones correctivas y refuerzan las defensas.
Microsoft presenta esta coordinación como un ciclo continuo de descubrimiento, evaluación y corrección. La compañía señala que los agentes se integrarán con sus productos de seguridad, GitHub y Azure DevOps, mientras las organizaciones mantienen control humano sobre las acciones.
La automatización de tareas defensivas puede acelerar la revisión de bases de código extensas, pero también exige comprobar la calidad de los hallazgos, evitar correcciones defectuosas y definir qué acciones pueden ejecutarse sin autorización humana.
Acceso y calendario
Microsoft no publicará inicialmente los pesos de MAI-Cyber-1-Flash. El modelo estará disponible mediante Azure AI Foundry con los procesos de validación de clientes y provisión de capacidad de la compañía.
Project Perception entrará en vista previa pública el 3 de agosto. Microsoft señala que añadirá más agentes y extenderá el uso del modelo especializado a otros flujos de ciberseguridad.
Fuentes
Microsoft: Rethinking security for the age of AI
Axios: Microsoft Project Perception launches AI agents, specialized model
The Register: Microsoft’s solution to AI security
📬 Newsletter gratuito