NVIDIA presenta una metodología de preentrenamiento de 4 bits utilizando NVFP4, validada en un transformador Mamba híbrido de 12B en 10T Token Horizon
La formación previa de LLM a escala de frontera en el FP8 es ahora una práctica estándar, pero pasar al punto flotante de 4 bits sigue siendo un problema de…
NVIDIA AI lleva Nemotron-3-Nano-30B a NVFP4 con destilación consciente de la cuantificación (QAD) para una inferencia de razonamiento eficiente
NVIDIA ha lanzado Nemotron-Nano-3-30B-A3B-NVFP4, un punto de control de producción que ejecuta un modelo de razonamiento de parámetros 30B en formato NVFP4 de 4 bits manteniendo una precisión cercana a…
QeRL: El aprendizaje por refuerzo (RL) cuantificado mediante NVFP4 lleva la formación de 32.000 millones de LLM a un único H100, al tiempo que mejora la exploración
¿Qué construiría si pudiera ejecutar el aprendizaje por refuerzo (RL) después del entrenamiento en un LLM de 32 B en NVFP4 de 4 bits (en un solo H100) con una…