Google AI Research presenta el marco de optimización de preferencias por listas (LiPO): un nuevo enfoque de inteligencia artificial para alinear modelos de lenguaje con comentarios humanos
Alinear los modelos lingüísticos con las preferencias humanas es la piedra angular para su aplicación eficaz en muchos escenarios del mundo real. Con los avances en el aprendizaje automático, la…