Tag: previamente

¿Por qué existen vectores de tareas en los LLM previamente capacitados? Esta investigación de IA del MIT e Improbable AI descubre cómo los transformadores forman abstracciones internas y los mecanismos detrás del aprendizaje en contexto (ICL)

Los modelos de lenguaje grande (LLM) han demostrado similitudes notables con la capacidad de los procesos cognitivos humanos para formar abstracciones y adaptarse a nuevas situaciones. Así como los humanos…

TRANSMI: un marco de aprendizaje automático para crear modelos de referencia adaptados para datos transliterados de modelos de lenguaje multilingües previamente entrenados mPLM sin ningún tipo de capacitación

La creciente disponibilidad de texto digital en diversos idiomas y escrituras presenta un desafío importante para el procesamiento del lenguaje natural (PLN). Los modelos de lenguaje multilingües previamente entrenados (mPLM)…