Alibaba lanza Qwen3.8-Max con 2,4 billones de parámetros y se convierte en el líder de los rankings chinos

Nuevo modelo multimodal activa 95 billones de parámetros por token y procesa 1 millón de tokens de contexto. Sube directamente a la cima de los benchmarks chinos, aún detrás de Claude Fable 5.
Alibaba lanzó el 3 de agosto el Qwen3.8-Max, el modelo más grande de la familia Qwen hasta el momento. La arquitectura es una mezcla dispersa de especialistas con 2,4 billones de parámetros totales y 95 billones activos por token, contexto de 1 millón de tokens y capacidad multimodal para texto, imagen y vídeo. El modelo entra hoy en Alibaba Cloud Model Studio, y la compañía informó que los pesos abiertos serán liberados la próxima semana.
El Qwen3.8-Max debutó como el modelo chino mejor posicionado en Arena.AI para tareas de texto y ocupó el segundo lugar a nivel mundial en tareas de visión, solo detrás de una variante del Claude Fable 5 de Anthropic. No es un liderazgo global, pero acorta la distancia. Para fines de referencia, el Kimi K3 de Moonshot, lanzado el mes pasado con 2,8 billones de parámetros, ocupaba hasta entonces el primer lugar en el ranking chino. El cambio en el ranking se produjo en menos de 40 días.
Qué cambia para quienes compran IA al por mayor
La propuesta comercial es agresiva. Al activar solo 95 billones de parámetros por token, el Qwen3.8-Max ofrece un costo de inferencia sustancialmente menor que los modelos densos de tamaño comparable. Para clientes corporativos que ejecutan pipelines de RAG sobre bases jurídicas, contractuales o de código, la diferencia por millón de tokens pesa al final del trimestre. La apertura de los pesos, prevista para la próxima semana, transforma al Qwen en una opción viable para alojamiento privado en cualquier nube, lo que atiende a bancos y organismos gubernamentales que no pueden enviar datos a centros de datos estadounidenses.
La ventana de contexto de 1 millón de tokens ataca directamente el caso de uso más valorado por abogados y auditores: el análisis de conjuntos documentales enteros en una sola llamada. Es un espacio en el que Claude y Gemini han construido ventaja en el último año. Con Qwen en la misma categoría y a precio chino, la discusión de compras en las Big 4 y en los despachos de contencioso gana una nueva columna en la hoja de cálculo.
El contexto competitivo
El Qwen3.8-Max llega el mismo día en que DeepSeek anunció una variante ultra-económica de su línea, manteniendo la presión sobre el costo por token en el mercado chino. La lectura del mercado es clara: las acciones de Alibaba cerraron el lunes en fuerte alza tras el anuncio, con inversores interpretando el movimiento como una afirmación de que la compañía ha recuperado el espacio perdido ante DeepSeek y Moonshot en las últimas dos rondas de comparación. En CNBC, analistas describieron la competencia china como "una carrera armamentista dentro de la carrera armamentista", con cuatro proveedores locales alternando el primer lugar en ciclos de 30 a 60 días.
Del lado estadounidense, la respuesta llegará en septiembre según los cronogramas de lanzamiento ya indicados por OpenAI y Google. Anthropic, que mantiene a Claude Fable 5 en la cima del ranking global de visión, aún no ha indicado una fecha para la próxima generación. El patrón del último trimestre sugiere que los ciclos de lanzamiento se están comprimiendo: menos de 60 días entre grandes actualizaciones de frontera, con un enfoque cada vez mayor en el costo por token y en la ventana de contexto, no en el rendimiento bruto en benchmarks académicos.
Lectura por mercados
En Alemania y Francia, los CIOs de bancos y aseguradoras que hoy pagan por Claude y GPT a través de Azure obtienen una alternativa concreta de alojamiento soberano, siempre que el cumplimiento con la AI Act cubra las obligaciones de documentación exigidas del proveedor. Una implementación privada de Qwen sobre hardware europeo resuelve la residencia de datos, pero la oficina de AI europea aún debe pronunciarse sobre cómo aplicar las obligaciones del Artículo 53 a operadores que alojan un modelo de origen chino en territorio comunitario. Es una zona gris que Deutsche Bank y BNP Paribas tendrán que mapear con abogados antes de cualquier prueba de concepto.
En India, TCS e Infosys ya estaban incorporando modelos Qwen en ofertas para clientes asiáticos; la llegada del Max amplía el portafolio que estas empresas pueden ofrecer a bancos y telecomunicaciones del sudeste asiático que evitan el eje EE. UU.-China por razones geopolíticas. En Japón, MUFG y Mizuho evaluarán el modelo dentro de los programas de prueba que están en curso con el METI, aunque la decisión de producción se ve obstaculizada por preocupaciones regulatorias sobre modelos chinos en infraestructura crítica.
La velocidad de la carrera china expone una cuestión que los proveedores estadounidenses aún no han respondido: si la cima global cambia de manos cada trimestre, el valor comercial de estar en primer lugar en los benchmarks comienza a diluirse. Lo que sostiene el precio-prémium es la integración, el soporte corporativo y la previsibilidad del roadmap, tres dimensiones en las que Anthropic y OpenAI aún tienen una clara ventaja, pero que no son insuperables.