La arquitectura de Qwen4 está aquí temprano, lanzando 6 mil millones de parámetros de 125 mil millones.
El equipo de Qwen de Alibaba ha lanzado Qwen3.8-Flash-Next, una vista previa de peso abierto de la arquitectura que pretende utilizar para Qwen4, que cuenta con 125B de parámetros pero activa solo 6B para cada token. Su licencia puede no calificar para la exención de código abierto de la Ley de IA de la UE.
El equipo de Qwen de Alibaba ha publicado la arquitectura sobre la que planea construir Qwen4. Qwen3.8-Flash-Next tiene 125B de parámetros y activa solo 6B de ellos para cada token que produce.
La afirmación se refiere al costo más que a la capacidad. El equipo dice que su preocupación es lo que las elecciones arquitectónicas hacen a las facturas de inferencia a medida que los trabajos agénticos con contextos muy largos se convierten en la carga de trabajo normal.
La comparación que establece es con su propio último modelo. Qwen3.7-Plus tiene 397B de parámetros y activa 17B, por lo que este funciona con aproximadamente un tercio de la computación activa.
Tres de los cuatro cambios son lo suficientemente convencionales. Un nuevo esquema de atención dispersa trabaja en micro-bloques en lugar de seleccionar tokens individuales, un mecanismo residual controlado regula lo que pasa entre capas, y la receta de entrenamiento elimina por completo el calentamiento del tamaño del lote.
El cuarto es el extraño. En lugar de añadir expertos, el modelo incorpora 51B de parámetros como una incrustación separada indexada por fragmentos de dos y tres caracteres, lo que el equipo dice que cuesta menos computación y es más fácil de descargar en aceleradores con memoria limitada.
Esa última frase vale la pena leerla dos veces. Diseñar para aceleradores con poca memoria es lo que se hace cuando no se pueden comprar los mejores chips, que es la posición en la que los controles de exportación han puesto a los laboratorios chinos.
Los números adjuntos a todo esto son propios de Alibaba. TNW señaló este mes que la compañía llamó a Qwen3.8 el segundo mejor modelo del mundo y no mostró pruebas, y estas puntuaciones nuevamente provienen de los propios arneses del equipo.
Algunas de las elecciones son inusualmente sinceras. La tarjeta del modelo dice que su puntuación en el Último Examen de la Humanidad fue calificada por GPT-4o en lugar de por el propio evaluador del benchmark, lo que es una divulgación en lugar de neutralidad.
La licencia es donde Europa tiene una pregunta. Los pesos están en Hugging Face bajo una licencia de qwen-community, y TNW informó el 7 de agosto que Alibaba quiere cobrar a sus mayores usuarios comerciales.
La Ley de IA trata esa distinción como portante. El artículo 53(2) elimina dos obligaciones de documentación para modelos bajo una licencia libre y de código abierto, y el considerando 103 dice que los componentes proporcionados a cambio de un precio o de otra manera monetizados no deberían obtener la exención.
Las empresas europeas no están esperando la respuesta. Thomson Reuters construyó su modelo sobre Qwen, y cualquiera que lo haga hereda lo que la licencia eventualmente se convierta.
Publicado el 26 de agosto de 2026 - 7:55 pm UTC
Volver arriba
Otros artículos
La arquitectura de Qwen4 está aquí temprano, lanzando 6 mil millones de parámetros de 125 mil millones.
Qwen3.8-Flash-Next activa 6B de sus 125B parámetros por token. Su licencia, no su arquitectura, es la parte que importa bajo la Ley de IA de la UE.
