LFM2-2.6B-Exp de Liquid AI utiliza RL de aprendizaje por refuerzo puro y razonamiento híbrido dinámico para reforzar el comportamiento de los modelos pequeños
Liquid AI ha introducido LFM2-2.6B-Exp, un punto de control experimental de su modelo de lenguaje LFM2-2.6B que se entrena con aprendizaje por refuerzo puro sobre la pila LFM2 existente. El…