De la indicación a la predicción: comprensión del prellenado, la decodificación y la caché KV en los LLM
En el artículo anterior, vimos cómo un modelo de lenguaje convierte logits en probabilidades y toma muestras del siguiente token. ¿Pero de dónde vienen estos logits? En este tutorial, adoptamos…