- Origen
- Múltiples fuentes: Chema Alonso (El Lado del Mal, 0xWord)
- Fecha
- 2026-05-17T04:01:56.254043+00:00
- Resumen
- Según Chema Alonso, investigadores de varias empresas y universidades han desarrollado ExploitGym, un benchmark que evalúa la capacidad de agentes de IA como Mythos, GPT 5.5, Gemini Pro y Claude Opus para descubrir y explotar vulnerabilidades en tres ámbitos: USER Space (software de usuario con protecciones ASLR, PIE y Canary), BROWSER Space (Chromium con sandbox) y Kernel Space (Linux con KASLR). En una competición tipo CTF con límite de 2 horas, Mythos logró 157 banderas válidas y GPT 5.5 120, mientras que en total (explotando vulnerabilidades alternativas) alcanzaron 226 y 210 respectivamente. La superposición de exploits entre Mythos y GPT 5.5 fue parcial, indicando que la combinación de ambos ofrece una visión más amplia de la seguridad real. El estudio también destaca que muchas vulnerabilidades detectadas no pudieron ser explotadas debido a las medidas de mitigación, subrayando la importancia de fortalecerlas. Además, se resalta el papel creciente de la IA no solo en ofensiva sino también en defensa, mediante triage de ataques, generación de firmas y reglas de seguridad para proteger sistemas, especialmente frente a vulnerabilidades emergentes en servicios digitales basados en IA. Este avance obliga a transformar herramientas y procesos tradicionales de ciberseguridad para adaptarse a un entorno acelerado y complejo donde la IA amplifica tanto las amenazas como las defensas.