Chatbot de transformación digital (DTchatbot): integración de un chatbot basado en modelos de lenguaje grande para satisfacer las necesidades de transformación digital

Resumen:Muchas organizaciones buscan la transformación digital para mejorar la eficiencia operativa, reducir los esfuerzos manuales y optimizar los procesos mediante la automatización y las herramientas digitales. Para lograr esto, se requiere una comprensión integral de sus necesidades únicas.

Leer más →

Comentarios desactivados en Chatbot de transformación digital (DTchatbot): integración de un chatbot basado en modelos de lenguaje grande para satisfacer las necesidades de transformación digital

No-Human in the Loop: Evaluación agente a escala para recomendación

Resumen:Evaluar grandes modelos de lenguaje (LLM) como jueces es cada vez más crítico para construir canales de evaluación escalables y confiables. Presentamos ScalingEval, un estudio comparativo a gran escala que compara sistemáticamente 36 LLM, incluidos GPT, Gemini, Claude y Llama, en múltiples categorías de productos utilizando un protocolo de evaluación basado en consenso.

Leer más →

Comentarios desactivados en No-Human in the Loop: Evaluación agente a escala para recomendación

Evaluación de la IA generativa como herramienta educativa para la redacción de informes de residentes de radiología

Resumen: Métodos: Analizamos 5.000 pares de informes de residentes-asistentes de la práctica habitual en un sistema de salud multisitio de EE. UU. A GPT-4o se le solicitaron instrucciones clínicas para identificar errores comunes y proporcionar comentarios. Se realizó un estudio de lectores utilizando 100 pares de informes.

Leer más →

Comentarios desactivados en Evaluación de la IA generativa como herramienta educativa para la redacción de informes de residentes de radiología

Fin del contenido

No hay más páginas por cargar