Anclas de pensamiento: un marco de aprendizaje automático para identificar y medir los pasos de razonamiento clave en modelos de idiomas grandes con precisión
Comprender los límites de las herramientas actuales de interpretabilidad en LLMS Los modelos de IA, como las variantes de Deepseek y GPT, dependen de miles de millones de parámetros que…