⚡️ACTUALIZACIÓN DE IA: Los registros de OpenAI ChatGPT 5 y DeepSeek V4 Flash muestran tasas de éxito ALTAS en tareas de ciberseguridad.

Los resultados de las pruebas de CyberGym indican que la IA se está moviendo rápidamente de simplemente escribir código a encontrar y reproducir de forma autónoma vulnerabilidades reales de seguridad.

El benchmark incluye:
- 1,507 vulnerabilidades reales
- 188 proyectos de software
- Tareas complejas de explotación y parcheo

La puntuación máxima original era de alrededor del 20%. Según se informa, los agentes especializados más nuevos superan el 90% en condiciones de prueba actualizadas.

La IA ahora puede:
- Reproducir vulnerabilidades conocidas
- Descubrir zero-days
- Identificar parches incompletos

Curiosamente, la MISMA tecnología puede fortalecer las defensas cibernéticas o escalar ataques.