MPCI-Bench: un punto de referencia para la evaluación de integridad contextual multimodal por pares de agentes de modelos de lenguaje

Resumen:A medida que los agentes modelo de lenguaje evolucionan de chatbots pasivos a asistentes proactivos que manejan datos personales, evaluar su adherencia a las normas sociales se vuelve cada vez más crítico, a menudo a través de la lente de la integridad contextual (CI).

Leer más →

Comentarios desactivados en MPCI-Bench: un punto de referencia para la evaluación de integridad contextual multimodal por pares de agentes de modelos de lenguaje

Fin del contenido

No hay más páginas por cargar