Google presenta T5Gemma 2: modelos de codificador y decodificador con entradas multimodales a través de SigLIP y contexto de 128K
Google ha lanzado T5Gemma 2, una familia de puntos de control de transformador codificador-decodificador abiertos creados adaptando pesos previamente entrenados de Gemma 3 en un diseño de codificador-decodificador y luego…
Zhipu AI lanza GLM-4.6V: un modelo de lenguaje de visión contextual de 128K con llamadas de herramientas nativas
Zhipu AI ha abierto la serie GLM-4.6V como un par de modelos de lenguaje de visión que tratan imágenes, videos y herramientas como entradas de primera clase para los agentes,…
Microsoft AI lanzó LongRope2: un método casi pérdida para extender las ventanas de contexto del modelo de idioma grande a 128k tokens mientras conserva más del 97% de precisión de contexto corto
Los modelos de lenguaje grande (LLM) han avanzado significativamente, pero una limitación clave sigue siendo su incapacidad para procesar secuencias de contexto largo de manera efectiva. Mientras que modelos como…
Se lanzaron los modelos Qwen 2.5: incluye Qwen2.5, Qwen2.5-Coder y Qwen2.5-Math con parámetros de 72 B y compatibilidad con contexto de 128 K
El equipo Qwen de Alibaba ha causado revuelo recientemente en la comunidad de IA/ML al lanzar su última serie de modelos de lenguaje grandes (LLM), Qwen2.5Estos modelos han tomado por…
Microsoft AI lanza Phi 3.5 mini, MoE y Vision con contexto de 128K, multilingüe y licencia MIT
Microsoft ha ampliado recientemente sus capacidades de inteligencia artificial con la introducción de tres modelos sofisticados: Phi 3.5 Mini Instruct, Phi 3.5 MoE (Mixture of Experts) y Phi 3.5 Vision…