¿Podemos confiar en las explicaciones de la IA? Evidencia de subregistro sistemático en el razonamiento en cadena de pensamientos
Resumen: Cuando los sistemas de IA explican su razonamiento paso a paso, los profesionales a menudo suponen que estas explicaciones revelan lo que realmente influyó en la respuesta de la IA. Probamos esta suposición incorporando pistas en las preguntas y midiendo si los modelos las mencionaban. En un estudio de más de 9.
Leer más →