Resumen:Presentamos LLM-Wikirace, un punto de referencia para evaluar la planificación, el razonamiento y el conocimiento mundial en modelos de lenguajes grandes (LLM).
Leer más →
Resumen: Los agentes LLM se implementan cada vez más en entornos complejos de largo horizonte para resolver problemas desafiantes, pero esta expansión los expone a ataques de largo horizonte que explotan las interacciones usuario-agente-entorno de múltiples turnos para lograr objetivos inviables en entornos de un solo turno.
Leer más →
Resumen: Los kits de desarrollo de agentes (ADK) proporcionan plataformas y herramientas eficaces para la construcción de agentes, y sus diseños son fundamentales para el rendimiento de los agentes construidos, especialmente la funcionalidad de la topología, las herramientas y la memoria del agente.
Leer más →