Resumen: El desarrollo de la conducción autónoma (AD) de alto nivel está pasando de limitaciones centradas en la percepción a un cuello de botella más fundamental, a saber, un déficit de razonamiento sólido y generalizable.
Leer más →
Resumen: Probamos si los agentes con objetivos de continuación terminales (Tipo A) producen estados latentes con mayor entropía de entrelazamiento que los agentes cuya continuación es meramente instrumental (Tipo B). Un mayor entrelazamiento refleja un acoplamiento estadístico entre particiones más fuerte.
Leer más →
Resumen: Trabajos recientes sintetizan tareas agentes para LLM que utilizan herramientas posteriores a la capacitación, pero una generalización sólida bajo cambios en tareas y conjuntos de herramientas sigue siendo un desafío abierto. Esta fragilidad la atribuimos a una diversidad insuficiente en las tareas sintetizadas.
Leer más →