Medición del progreso de los agentes de IA en escenarios de ciberataques de varios pasos
Resumen:Evaluamos las capacidades autónomas de ciberataque de los modelos de IA de frontera en dos rangos cibernéticos especialmente diseñados (un ataque a una red corporativa de 32 pasos y un ataque a un sistema de control industrial de 7 pasos) que requieren encadenar capacidades heterogéneas a lo largo de secuencias de acción extendidas.
Leer más →