Alibaba presenta Qwen3.8-Max, un modelo multimodal de 2,4 billones de parámetros, días después del lanzamiento del peso abierto Kimi K3 de Moonshot




El 19 de julio, el equipo Qwen de Alibaba presentó una vista previa de Qwen3.8-Max-Preview, el próximo buque insignia de la familia Qwen. El equipo de investigación lo describe como un modelo de 2,4 billones de parámetros, “solo superado por Fable 5” entre los sistemas que comparó. La vista previa ya está disponible. La tabla de referencia, la tarjeta de modelo y la licencia no lo son.

El anuncio del 19 de julio de 2026 llegó durante la Conferencia Mundial de IA (WAIC) en Shanghai. También llegó dos días después de que Moonshot AI lanzara Kimi K3, un modelo de peso abierto de 2,8 billones de parámetros. El momento es tanto la historia como el modelo.

Este artículo separa lo que Alibaba confirmó de lo que solo afirmó. Cada cifra de desempeño a continuación conlleva esa advertencia.

Lo que anunció Qwen

La cuenta de Qwen publicó que Qwen3.8 se lanzará y estará abierto pronto. Calificó el modelo como “uno de los más potentes disponibles en la actualidad, comparable a los principales sistemas fronterizos”.

La versión preliminar es real y se puede comprar. El acceso se realiza a través de la suscripción al Token Plan de Alibaba. La vista previa se ofrece al 10% del precio estándar.

El desarrollador de Qwen, Shuai Bai, añadió detalles técnicos. Describió Qwen3.8 como el primer modelo multimodal del equipo por encima de 1 billón de parámetros. Procesa texto, imágenes, vídeos y documentos. El equipo de Alibaba afirma que el modelo debería superar a Qwen3.7-Max en codificación, desarrollo completo, análisis de datos y flujos de trabajo de oficina.

Explicador interactivo

Explicación de Qwen3.8

Explicador interactivo de Marktechpost

Qwen3.8-Max-Preview: lo que Alibaba confirmó, lo que solo afirmó

Una vista previa multimodal de parámetros de 2,4T enviada antes de cualquier punto de referencia, tarjeta de modelo o licencia. Explore los hechos a continuación.

Confirmado vs Reclamado

Escala de parámetros

Calculadora de costo de porción

Línea base verificada de 3.7-Max

La vista previa está disponible y se puede comprar. Qwen3.8-Max-Preview se vende a través de Alibaba Token Plan, Qoder y QoderWork al 10% del precio estándar.

Mezcla dispersa de expertos, multimodal. El desarrollador Shuai Bai dice que es el primer modelo multimodal del equipo por encima de los parámetros 1T, que maneja imágenes, videos y documentos.

Compatibilidad con OpenAI y protocolo Anthropic. Los agentes de codificación existentes pueden apuntar a Qwen3.8 sin reconstruir sus arneses.

2,4 billones de parámetros. Esta es la propia cifra de Alibaba. Ninguna ficha de modelo ni especificación lo confirma.

“Sólo superado por Fable 5”. No se ha publicado ninguna tabla de referencia. La clasificación se basa en la evaluación interna.

Abra las pesas “pronto”. Sin fecha, sin licencia, sin repositorio de Hugging Face. Los dos últimos buques insignia Max de Alibaba se enviaron cerrados.

Parámetros activos por token. No divulgado: el número único que decide el costo real del servicio para un modelo de MoE escaso.

Estado al 19 de julio de 2026. Cambie un tipo de hecho usando las pestañas de arriba.

Parámetros totales, modelos fronterizos divulgados públicamente, julio de 2026. El 2,4T del Qwen3.8 es una afirmación de Alibaba, no una cifra verificada.

El recuento total no es un cálculo utilizable. Un modelo MoE escaso activa solo una fracción de estos parámetros por token.

Si el modelo completo de 2,4T se enviara con peso abierto, ¿cuánto se necesitaría para cargarlo?

FP16 (16 bits) FP8 (8 bits) INT4 (4 bits)

Tarjetas Nvidia H200 (141 GB)

Estimar solo los pesos; agregue aproximadamente entre un 20% y un 30% para la caché de KV y la sobrecarga del tiempo de ejecución. El servicio de parámetros activos sería mucho más barato, pero Alibaba no ha publicado esa cifra.

El predecesor verificado. Cada número de “capacidad” de Qwen3.8 publicado es en realidad un número de Qwen3.7-Max hasta que Alibaba publique una tabla de referencia.

1M

Ventana de contexto (tokens)

$3.75

Por 1 millón de tokens de salida

Qwen3.7-Max, mayo de 2026, pesos cerrados. La ventaja histórica de Alibaba ha sido la relación precio-rendimiento, no encabezar una clasificación.

Marktechpost

Datos verificados el 19 de julio de 2026 · Las cifras marcadas como afirmadas son propias de Alibaba

La pregunta de los 2,4 billones de parámetros

El recuento total de parámetros no es lo mismo que el cálculo utilizable. Esta distinción importa más que el número principal. La propia historia de Qwen lo demuestra.

Qwen3-235B-A22B lleva 235 mil millones de parámetros totales pero activa 22 mil millones por token. Qwen3-30B-A3B activa aproximadamente 3 mil millones. Ambos son diseños MoE escasos, y el nivel Max de Qwen también lo es.

Para Qwen3.8, el recuento de parámetros activos es el número que nadie tiene. Sin él, los parámetros resaltados de 2.4T dicen poco sobre el costo del servicio. Como calculó Startup Fortune, un modelo de 2,4T con precisión de 4 bits necesita aproximadamente 1,2 terabytes solo para pesos. Una sola Nvidia H200 lleva 141 GB. Incluso ocho cartas dejan matemáticas incómodas.

Por eso la cuestión práctica no es la posición en la clasificación. Se trata de si Alibaba envía una variante más pequeña con parámetros activados, un buen punto de control cuantificado o un hermano destilado.

Cómo reaccionaron los desarrolladores

El 19 de julio de 2026, la reacción de la comunidad a la vista previa de Qwen3.8 se dividió en líneas predecibles. El entusiasmo por otro modelo de frontera de peso abierto se encontró con la fatiga de los puntos de referencia no verificados.

En Hacker News, la opinión dominante era que una carrera de peso abierto entre laboratorios chinos beneficia a todos. Los comentaristas debatieron el motivo y leyeron el momento como una respuesta directa a Kimi K3. Un pequeño grupo cuestionó el encuadre “solo superado por Fable 5” y llamó a Qwen un especialista de referencia junto a sus rivales.

En r/LocalLLaMA de Reddit, la conversación fue práctica. Las matemáticas de servicio de 2,4T dominaron, junto con la esperanza de una variante más pequeña o destilada que pudiera cargar una estación de trabajo. En X, el anuncio fue tendencia y las grandes cuentas, incluido el kimmonismus, amplificaron la línea de peso abierto.

El panel a continuación desglosa esa reacción por plataforma.

Sentimiento Qwen3.8

Señal social de Marktechpost

Cómo reaccionaron X, Reddit y Hacker News a Qwen3.8-Max-Preview

Una lectura cualitativa del debate público en las horas posteriores al anuncio del 19 de julio. Filtrar por plataforma a continuación.

Estado de ánimo general: cautelosamente positivo

Entusiasmo por otro modelo de frontera de peso abierto, frenado por la fatiga de puntos de referencia no verificados y dudas sobre quién realmente puede ejecutar parámetros de 2.4T.

Todas las plataformas

X/Twitter

Reddit r/LocalLLaMA

Noticias de piratas informáticos

Mezcla de sentimientos: todas las plataformas

Positivo
Escéptico
Neutral

Método: Muestra ilustrativa, no estadística. Los comentarios compartidos son una lectura editorial del hilo Qwen X y los amplificadores, la discusión de r/LocalLLaMA y un hilo de Hacker News de 29 comentarios (75 puntos), capturado el 19 de julio de 2026. Las citas están parafraseadas.

Marktechpost

Instantánea · 19 de julio de 2026 · El sentimiento cambiará una vez que lleguen los puntos de referencia y las ponderaciones