Resumen: Los juegos de rol LLM tienen como objetivo retratar personajes arbitrarios en narrativas interactivas, sin embargo, los sistemas existentes a menudo sufren de inmersión y adaptabilidad limitadas.
Leer más →
Resumen: Estudiamos la curación de datos para el razonamiento multimodal a través del desafío NeurIPS 2025 Data Curation for Vision-Language Reasoning (DCVLR), que aísla la selección del conjunto de datos fijando el modelo y el protocolo de entrenamiento.
Leer más →
Resumen: La serie de pruebas comparativas ARC-AGI sirve como una medida crítica de generalización de pocas tomas en tareas novedosas, un aspecto central de la inteligencia. La competencia global ARC Prize 2025 se centró en el conjunto de datos ARC-AGI-2 recientemente lanzado, que presenta una mayor complejidad de tareas en comparación con su predecesor. La competencia de Kaggle atrajo a 1.
Leer más →