El panorama de la IA generativa y LLMS ha experimentado un notable salto adelante con el lanzamiento de Mercurio por la startup de vanguardia Laboratorios de inicio. Introducción de los primeros modelos de lenguaje de difusión de difusión a escala comercial (DLLMS), Inception Labs promete un cambio de paradigma en la velocidad, la rentabilidad e inteligencia para las tareas de generación de texto y código.
Mercurio: establecer nuevos puntos de referencia en la velocidad y la eficiencia de la IA
La serie de modelos de lenguaje grande de difusión de Difusión de Inception introduce un rendimiento sin precedentes, operando a velocidades previamente inalcanzables con las arquitecturas LLM tradicionales. Mercury logra un rendimiento notable, más de 1000 tokens por segundo en las GPU de productos básicos NVIDIA H100, una actuación que anteriormente era exclusiva del hardware diseñado a medida como Groq, Cerebras y Sambanova. Esto se traduce en un asombroso aumento de la velocidad de 5-10x en comparación con los modelos autorregresivos líderes actuales.
Modelos de difusión: el futuro de la generación de texto
Los LLM autorregresivos tradicionales generan texto secuencialmente, token-por token, causando costos significativos de latencia y computación, especialmente en tareas extensas de razonamiento y corrección de errores. Los modelos de difusión, sin embargo, aprovechan un proceso de generación único de “grueso a fin”. A diferencia de los modelos autorregresivos restringidos por la generación secuencial, los modelos de difusión refinan de forma iterativa las salidas de aproximaciones ruidosas, lo que permite actualizaciones de token paralelas. Este método mejora significativamente el razonamiento, la corrección de errores y la coherencia general del contenido generado.
Si bien los enfoques de difusión han demostrado ser revolucionarios en la generación de imágenes, audio y videos, aplicaciones impotentes como Midjourney y Sora, su aplicación en dominios de datos discretos como texto y código se inexploró en gran medida hasta el avance de Inception.
Mercury Coder: generación de código de alta velocidad y alta calidad
El producto insignia de Inception, Mercury Coder, está optimizado específicamente para aplicaciones de codificación. Los desarrolladores ahora tienen acceso a un modelo de respuesta rápida de alta calidad capaz de generar código en más de 1000 tokens por segundo, una mejora dramática sobre los modelos existentes centrados en la velocidad.
En los puntos de referencia de codificación estándar, Mercury Coder no solo coincide, sino que a menudo supera el rendimiento de otros modelos de alto rendimiento como GPT-4O Mini y Claude 3.5 Haiku. Además, Mercury Coder Mini aseguró una posición de primer rango en Copilot Arena, empatando para el segundo lugar y superando modelos establecidos como GPT-4O Mini y Gemini-1.5-Flash. Aún más impresionante, Mercurio logra esto mientras mantiene aproximadamente 4 veces velocidades más rápidas que GPT-4O Mini.
Versatilidad e integración
Los DLLM de Mercury funcionan sin problemas como reemplazos de entrega para LLM autorregresivos tradicionales. Apoyan sin esfuerzo los casos de uso, incluida la generación de recuperación, lo que se puede recuperar (TRAPO), integración de herramientas y flujos de trabajo basados en agentes. El refinamiento paralelo del modelo de difusión permite que múltiples tokens se actualicen simultáneamente, asegurando una generación rápida y precisa adecuada para entornos empresariales, integración de API e implementaciones locales.
Construido por innovadores de IA
La tecnología de Inception está respaldada por la investigación fundamental en Stanford, UCLA y Cornell de sus fundadores pioneros, reconocidos por sus contribuciones cruciales a la evolución de la IA generativa. Su experiencia combinada incluye el desarrollo original de modelos de difusión basados en imágenes e innovaciones, como la optimización de preferencias directas, la atención del flash y los transformadores de decisión, las tecnologías ampliamente reconocidas por su impacto transformador en la IA moderna.
La introducción de Inception del mercurio marca un momento crucial para la IA empresarial, desbloqueando niveles de rendimiento previamente imposibles, precisión y rentabilidad.
Verificar el Patio de juegos y Detalle técnico. Todo el crédito por esta investigación va a los investigadores de este proyecto. Además, siéntete libre de seguirnos Gorjeo Y no olvides unirte a nuestro Subreddit de 80k+ ml.
