Eficiencia versus alineación: investigación de riesgos de seguridad y equidad en el ajuste eficiente de parámetros de los LLM
Resumen: Las organizaciones adoptan y adaptan cada vez más modelos de lenguajes grandes (LLM) alojados en repositorios públicos como HuggingFace. Aunque estas adaptaciones a menudo mejoran el rendimiento en tareas posteriores especializadas, la evidencia reciente indica que también pueden degradar la seguridad o la equidad de un modelo.
Leer más →