Resumen: Los modelos de lenguaje grande (LLM) pueden producir recomendaciones clínicamente fluidas para la diabetes tipo 2 sin satisfacer las limitaciones de las guías ni justificar explícitamente las afirmaciones glucémicas relacionadas con el estilo de vida.
Leer más →
Resumen: Para un usuario de silla de ruedas, una línea azul estándar en un mapa suele ser una promesa incumplida. Si bien plataformas como OpenStreetMap (OSM) capturan con éxito dónde está un camino, con frecuencia no logran transmitir cómo se siente físicamente viajar por él. Esta barrera de información es problemática para los usuarios de sillas de ruedas.
Leer más →
Resumen: En tres dominios diversos: matemáticas de competencia (AIME 2025), planificación de robótica (LLM-BabyBench) y razonamiento de parentesco (CLUTRR), VeryTrace mejora la precisión sobre líneas de base de tiro cero en LLM de última generación sin requerir capacitación específica de dominio o ejemplos en contexto, lo que demuestra que la verificación de seguimiento formalizada logra precisió
Leer más →