IBM lanza los modelos de IA Granite 3.0 2B y 8B para empresas de IA

La inteligencia artificial avanza rápidamente, pero las empresas enfrentan muchos obstáculos cuando intentan aprovecharla de manera efectiva. Las organizaciones requieren modelos que sean adaptables, seguros y capaces de comprender contextos de dominios específicos y al mismo tiempo mantener los estándares de cumplimiento y privacidad. Los modelos tradicionales de IA a menudo tienen dificultades para ofrecer un rendimiento tan personalizado, lo que requiere que las empresas hagan un compromiso entre la personalización y la aplicabilidad general. Además, muchos modelos de IA carecen de transparencia, lo que dificulta la confianza entre los usuarios empresariales.

IBM ha lanzado oficialmente Granite 3.0 AI Models, una nueva línea de modelos básicos diseñados para brindar capacidades avanzadas de IA a las empresas. Estos modelos representan un paso crucial en los esfuerzos continuos de IBM para proporcionar a las empresas soluciones de IA que no sólo sean de alto rendimiento sino también seguras y confiables. Los modelos Granite 3.0 están diseñados para admitir diversos casos de uso en entornos empresariales, que van desde la comprensión del lenguaje natural hasta facilitar procesos mejorados de toma de decisiones. Construido sobre la plataforma de datos e inteligencia artificial watsonx de IBM, Granite 3.0 tiene como objetivo permitir a las empresas integrar fácilmente la inteligencia artificial en sus flujos de trabajo, mejorando así la eficiencia y al mismo tiempo cumpliendo con las necesidades específicas de seguridad y privacidad que las empresas suelen requerir.

Técnicamente hablando, los modelos de IA Granite 3.0 de IBM se basan en modelos de lenguaje grande (LLM), diseñados específicamente para aplicaciones empresariales de IA. Estos incluyen modelos solo decodificadores con densidad de parámetros 8B y 2B, que superaron a Llama-3.1 8B de tamaño similar en la tabla de clasificación OpenLLM de Hugging Face (v2). Los modelos están entrenados en más de 12 billones de tokens en 12 idiomas y 116 lenguajes de programación, lo que proporciona una base versátil para tareas de procesamiento del lenguaje natural (NLP) y garantiza la privacidad y la seguridad. Con capacidades que abarcan la comprensión de datos no estructurados, la generación de contenido, el resumen de información e incluso la facilitación de la toma de decisiones complejas, Granite 3.0 ofrece potentes funciones de PNL de forma segura y transparente.

Además, estos modelos son abiertos y extensibles, lo que brinda a los desarrolladores la libertad de adaptarlos según los requisitos de su empresa. Los modelos tienen licencia Apache 2.0, con datos y métodos de capacitación divulgados y están disponibles en la plataforma IBM Watsonx, así como a través de socios. En particular, los modelos fueron entrenados utilizando energía 100% renovable, lo que subraya el compromiso de IBM con la sostenibilidad.

Una de las razones fundamentales por las que Granite 3.0 es un avance significativo es su enfoque en la apertura, la extensibilidad y la transparencia, que aborda una de las barreras clave para la adopción de la IA en entornos empresariales: la confianza. Granite 3.0 proporciona transparencia sobre cómo se construyen los modelos, con documentación completa disponible, lo que facilita a las empresas comprender cómo el modelo toma decisiones. Además, la integración de Granite 3.0 con la plataforma Watsonx significa que se beneficia del conjunto de herramientas de Watsonx, que incluye capacidades para el gobierno de datos, monitoreo de modelos y ajuste rápido.

Según los puntos de referencia de IBM, Granite 3.0 ha demostrado una precisión mejorada en tareas específicas de la industria en comparación con modelos anteriores, lo que lleva a una mayor eficiencia en la toma de decisiones para los usuarios empresariales. Los modelos rivalizan con los modelos Meta y Mistral AI en puntos de referencia académicos, lideran en RAGBench para tareas empresariales, sobresalen en puntos de referencia de ciberseguridad y superan a sus pares en puntos de referencia de llamadas de funciones. La solidez líder en la industria en el punto de referencia AttaQ demuestra aún más la confiabilidad de Granite 3.0. El uso de elementos de código abierto también permite a las organizaciones auditar y perfeccionar los modelos para adaptarlos a sus necesidades específicas, lo que reduce el tiempo y el esfuerzo necesarios para la personalización y la implementación de la IA.

La versión Granite 3.0 también incluye ofertas de inferencia eficiente, como los modelos Mixture of Experts (MoE), 3B-A800M y 1B-A400M, diseñados para una alta eficiencia en servidores de CPU en el dispositivo y casos de uso de baja latencia. Además, un modelo decodificador especulativo acelera la inferencia en un 220 %, gracias a innovaciones en el acondicionamiento de tokens y el entrenamiento en dos fases. Estos avances hacen que Granite 3.0 sea particularmente atractivo para las empresas que requieren no sólo un alto rendimiento sino también opciones de implementación eficientes y rentables.

Los modelos de IA IBM Granite 3.0 marcan un salto importante en la IA empresarial, centrándose en los requisitos específicos de seguridad, adaptabilidad y transparencia. Al proporcionar modelos abiertos y extensibles que se integran con la plataforma Watsonx AI de IBM, Granite 3.0 ayuda a las empresas a superar algunas de las barreras tradicionales para la adopción de la IA, como las preocupaciones sobre la privacidad, la falta de personalización y la confianza en los sistemas de IA. La versatilidad de Granite 3.0 para tareas de lenguaje natural, combinada con su transparencia y capacidades de fácil integración, lo posiciona como una herramienta valiosa para las empresas que buscan aprovechar la IA de manera efectiva y responsable. A medida que las organizaciones continúan navegando por las complejidades de la implementación de la IA, Granite 3.0 de IBM sirve como una base ideal para impulsar la innovación, la eficiencia operativa y una mejor toma de decisiones en todas las industrias.


Mira el Detalles y Modelo abrazando la cara. Todo el crédito por esta investigación va a los investigadores de este proyecto. Además, no olvides seguirnos en Gorjeo y únete a nuestro Canal de telegramas y LinkedIn Grarriba. Si te gusta nuestro trabajo, te encantará nuestro hoja informativa.. No olvides unirte a nuestro SubReddit de más de 50.000 ml.

[Upcoming Live Webinar- Oct 29, 2024] La mejor plataforma para ofrecer modelos optimizados: motor de inferencia Predibase (promocionado)


Asif Razzaq es el director ejecutivo de Marktechpost Media Inc.. Como empresario e ingeniero visionario, Asif está comprometido a aprovechar el potencial de la inteligencia artificial para el bien social. Su esfuerzo más reciente es el lanzamiento de una plataforma de medios de inteligencia artificial, Marktechpost, que se destaca por su cobertura en profundidad del aprendizaje automático y las noticias sobre aprendizaje profundo que es técnicamente sólida y fácilmente comprensible para una amplia audiencia. La plataforma cuenta con más de 2 millones de visitas mensuales, lo que ilustra su popularidad entre el público.