La investigación de Salesforce AI propone una evaluación programática de VLM (PROVE): un nuevo paradigma de evaluación comparativa para evaluar las respuestas de VLM a consultas abiertas
Los modelos visión-lenguaje (VLM) se utilizan cada vez más para generar respuestas a consultas sobre contenido visual. A pesar de sus avances, a menudo sufren un problema importante: generar respuestas…