Alibaba liberó el 13 de agosto los pesos de Qwen3.8-Max, el modelo más grande de la familia, con una semana de atraso sobre lo prometido y bajo una licencia que rompe con el Apache 2.0 que usó siempre el proyecto. Un día después, el 14 de agosto a las 15:00 UTC, salió también Qwen3.8-27B, la versión chica pensada para correr en una computadora de escritorio, esta sí sin condiciones comerciales. Para el 15 de agosto el modelo chico ya ocupaba el primer puesto de Hacker News, con 893 puntos.

Qué cambia en los pesos frente a la API

El Qwen3.8-Max que corre por la API de Alibaba desde principios de mes procesa texto, imagen y video con una ventana de contexto nativa de un millón de tokens. La versión que ahora puede descargarse, identificada como Qwen3.8-2.4T-A95B, llega recortada:

Qwen3.8-Max (API) Qwen3.8-Max (pesos abiertos)
Texto, imagen y video Solo texto
Contexto nativo: 1.000.000 de tokens Contexto nativo: 256.000 tokens
Razonamiento opcional Razonamiento forzado a activo

El modelo mantiene la arquitectura de mezcla de expertos dispersa: 2,4 billones de parámetros totales, de los cuales unos 95.000 millones se activan por token. Alibaba no publicó qué motivó el recorte de modalidad y contexto en la versión descargable frente a la que sirve por API.

Una licencia por escalones

Hasta ahora, cualquier Qwen podía bajarse y desplegarse en infraestructura propia sin costo, bajo Apache 2.0. Qwen3.8-Max es el primero de la familia con letra chica comercial.

Un producto con más de 100 millones de usuarios activos mensuales, o más de 20 millones de dólares de ingreso mensual, debe exhibir el nombre del modelo. Una empresa que ofrezca Qwen3.8-Max como servicio con más de 50 millones de dólares de ingreso anual necesita un acuerdo de licencia aparte.

Son los términos que fija la licencia publicada junto a los pesos. Alibaba no dijo qué porcentaje de ingresos exige ese acuerdo aparte, solo que existe.

El hermano chico, sin esas condiciones

Qwen3.8-27B sí salió bajo Apache 2.0 puro, sin ninguna de las restricciones de escala del modelo grande. Tiene 27.000 millones de parámetros, un archivo de pesos de 51,76 GiB en BF16 (28,76 GiB en FP8) y un contexto nativo de 262.144 tokens, ampliable hasta un millón mediante la técnica YaRN, con una pérdida conocida de precisión en contexto corto cuando se lo estira así. Correrlo completo en BF16 con la caché de atención llena pide unos 67,76 GiB de memoria; en una placa de consumo de 24 GB, tipo RTX 4090, hace falta bajarlo a cuantización de 4 bits.

Qwen reportó mejoras del modelo frente a su antecesor, Qwen3.6-27B, en seis pruebas de agentes y código: Terminal-Bench 2.1 subió de 63,4 a 73,0 puntos, SWE-bench Pro de 53,5 a 61,7, DeepSWE 1.1 de 13,3 a 42,2, OSWorld-Verified de 63,9 a 84,3, AndroidWorld de 70,3 a 81,9 y LiveCodeBench v6 de 83,9 a 90,3. Son cifras que corrió el propio equipo de Qwen; hasta ahora nadie las reprodujo de forma independiente.

Lo que venía prometido

Qwen3.8-Max había debutado el 20 de julio en la WAIC de Shanghái como una vista previa cerrada, sin fecha de apertura. El 4 de agosto Alibaba lo puso disponible por API y prometió los pesos para "la próxima semana". Llegaron una semana después de esa promesa, y con una condición que el anuncio original no adelantaba: la primera licencia de la serie Qwen que ata el uso comercial a gran escala a un acuerdo aparte. Falta ver si Alibaba aplica esos umbrales en la práctica, y si algún laboratorio externo confirma los seis benchmarks que Qwen publicó para el 27B.