Mientras la guerra en Irán continúa envolviendo el Medio Oriente y el Estrecho de Ormuz permanece cerrado, uno de los efectos económicos globales más visibles han sido los precios de los combustibles fósiles.
Leer más →
Resumen: Los jueces agentes basados en LLM son un enfoque emergente para evaluar la IA conversacional, sin embargo, persiste una incertidumbre fundamental: ¿podemos confiar en sus evaluaciones y, de ser así, cuántas se necesitan?
Leer más →
Resumen: La estimación de incertidumbre (UE) tiene como objetivo detectar resultados alucinados de modelos de lenguaje grande (LLM) para mejorar su confiabilidad. Sin embargo, las métricas de UE a menudo muestran un rendimiento inestable en todas las configuraciones, lo que limita significativamente su aplicabilidad.
Leer más →