Medición del progreso de los agentes de IA en escenarios de ciberataques de varios pasos

Resumen:Evaluamos las capacidades autónomas de ciberataque de los modelos de IA de frontera en dos rangos cibernéticos especialmente diseñados (un ataque a una red corporativa de 32 pasos y un ataque a un sistema de control industrial de 7 pasos) que requieren encadenar capacidades heterogéneas a lo largo de secuencias de acción extendidas.

Leer más →

Comentarios desactivados en Medición del progreso de los agentes de IA en escenarios de ciberataques de varios pasos

Diversificación guiada por entropía y obtención de preferencias en sistemas de recomendación agentes

Resumen: Los usuarios de plataformas de comercio electrónico pueden no estar seguros de sus preferencias al principio de su búsqueda. Las consultas a los sistemas de recomendación suelen ser ambiguas, incompletas o poco especificadas.

Leer más →

Comentarios desactivados en Diversificación guiada por entropía y obtención de preferencias en sistemas de recomendación agentes

PACED: Destilación en la frontera de la competencia estudiantil

Resumen: Los desechos de destilación estándar de LLM se calculan en dos frentes: problemas que el estudiante ya domina (gradientes cercanos a cero) y problemas que están mucho más allá de su alcance (gradientes incoherentes que erosionan las capacidades existentes).

Leer más →

Comentarios desactivados en PACED: Destilación en la frontera de la competencia estudiantil

Fin del contenido

No hay más páginas por cargar