Resumen:Presentamos XChoice, un marco explicable para evaluar la alineación humana-IA en la toma de decisiones restringida.
Leer más →
Resumen: Ofrecer LLM de contexto largo es un desafío porque la duración de las solicitudes y la composición de los lotes varían durante la generación del token, lo que hace que la huella de memoria fluctúe significativamente en el tiempo de ejecución.
Leer más →
Resumen: Los modelos de razonamiento grande (LRM) sobresalen en el razonamiento de varios pasos, pero a menudo sufren de procesos de razonamiento ineficientes como pensar demasiado y exagerar, donde el razonamiento excesivo o mal dirigido aumenta el costo computacional y degrada el rendimiento.
Leer más →