En resumen
- El equipo Qwen de Alibaba lanzará Qwen 3.8-Flash-Next el miércoles, un modelo de mezcla de expertos descrito como una vista previa de la arquitectura Qwen4.
- La sesión informativa previa al lanzamiento del equipo cita 125 mil millones de parámetros totales con solo 6 mil millones activos por token.
- Las puntuaciones de referencia duras aún no se han publicado, y los pesos no están disponibles en ModelScope al momento de escribir esto.
Alibaba lanzará Qwen 3.8-Flash-Next el miércoles, un modelo de 125 mil millones de parámetros que activa solo 6 mil millones por token. El equipo Qwen lo presentó como una vista previa de la arquitectura de próxima generación Qwen 4, no como un buque insignia terminado.
No hay información oficial sobre el modelo, pero según rumores, probablemente será un sistema de mezcla de expertos, un diseño que divide la red en muchos submodelos especializados y activa solo los relevantes para cada tarea. Un modelo de 125 mil millones de parámetros funcionaría así con el costo computacional de uno de solo 6 mil millones de parámetros.

Los parámetros son básicamente todos los diales que un modelo puede ajustar. Cuantos más parámetros, más capaz es un modelo y más potencia de cómputo requerirá. Una mezcla de expertos hace posible que un modelo extremadamente potente active solo lo que necesita para proporcionar el mejor resultado sin desperdiciar recursos.
Qwen 3.8 Flash Next se lanza mañana. 125B parámetros +51B N-gram y 6B activos. Está basado en la próxima generación de la arquitectura Qwen 4.
Qwen 4 está llegando https://t.co/xduZNdKnKUpic.twitter.com/rAcBZlNwKs
— AiBattle (@AiBattle_) 25 de agosto de 2026
El equipo Qwen de Alibaba describe el modelo como multimodal y construido sobre la próxima arquitectura Qwen 4, y dice que envió la versión preliminar para que los desarrolladores puedan prepararse para la familia completa.
Por qué el "3.8" no es la noticia

Alibaba ha publicado un adelanto, aunque el equipo lo llama una vista previa. El plan es enviar las mejoras de arquitectura ahora, antes del lanzamiento completo de Qwen 4. Hugging Face, donde también viven los pesos, también lo describe como "una vista previa de la arquitectura de Qwen 4."
Los benchmarks duros aún no han llegado. Qwen no ha publicado puntuaciones comparativas contra su propia línea Qwen 3 o rivales occidentales, por lo que las cifras de 125 mil millones y 6 mil millones de parámetros no están verificadas, y solo podemos especular sobre su rendimiento.
El ritmo de pesos abiertos de China ha sido implacable. Un misterioso modelo gratuito, Ox Alpha, recientemente superó a Fable de Anthropic en ciertos benchmarks de codificación, sin un constructor conocido detrás. Alibaba, DeepSeek y Moonshot han lanzado pesos capaces que cualquiera puede descargar, ajustar y ejecutar.
Los pesos abiertos permiten a los desarrolladores construir sin enviar datos a una API cerrada, y reducen el costo de los modelos alojados. Por eso importa un modelo abierto de 125 mil millones de parámetros con 6 mil millones de parámetros activos: pone capacidad casi de vanguardia en hardware de consumo.
Pero tendremos que esperar por los números. Qwen no había publicado puntuaciones de benchmark para el lanzamiento al momento de escribir esto.






