Resumen: Las herramientas formales como los solucionadores SAT y SMT están cada vez más integradas en los procesos de razonamiento de modelos de lenguaje cuando una pregunta crítica de seguridad se puede formular en lógica.
Leer más →
Resumen: Documentos de posición recientes sostienen que el marco de incertidumbre aleatorio/epistémico clásico es insuficiente para los agentes interactivos de modelos de lenguaje grande (LLM) y exigen representaciones de incertidumbre comunicables, descompuestas y conscientes de la subespecificación que puedan desbloquear nuevas capacidades de los agentes, como la búsqueda proactiva de aclaracio
Leer más →
Resumen: Las redes convolucionales, las redes recurrentes y los transformadores codifican diferentes sesgos inductivos (localidad, memoria secuencial e interacción por pares dependiente del contenido) y se han mantenido matemáticamente distintos desde sus inicios.
Leer más →