Resumen: Los modelos de lenguaje grande se utilizan cada vez más para evaluar otros modelos, pero estos juicios generalmente carecen de toda representación de confianza.
Leer más →
Resumen:A medida que los grandes modelos de lenguaje se convierten en componentes de sistemas agentes más grandes, la confiabilidad de la evaluación se vuelve crítica: los subagentes poco confiables introducen fragilidad en el comportamiento del sistema posterior.
Leer más →
Bienvenido de nuevo a The State of AI, una nueva colaboración entre Financial Times FT/MIT TECHNOLOGY REVIEW | ADOBE STOCK Un contraargumento plausible a la tesis de Tim sobre las desigualdades en la IA es que los modelos de código abierto (o más exactamente, de “peso abierto”) disponibles gratuitamente sigue bajando los precios.
Leer más →