En resumen

  • El equipo Qwen de Alibaba lanzará Qwen 3.8-Flash-Next el miércoles, un modelo de mezcla de expertos descrito como una vista previa de la arquitectura Qwen4.
  • La sesión informativa previa al lanzamiento del equipo cita 125 mil millones de parámetros totales con solo 6 mil millones activos por token.
  • Las puntuaciones de referencia duras aún no se han publicado, y los pesos no están disponibles en ModelScope al momento de escribir esto.

Alibaba lanzará Qwen 3.8-Flash-Next el miércoles, un modelo de 125 mil millones de parámetros que activa solo 6 mil millones por token. El equipo Qwen lo presentó como una vista previa de la arquitectura de próxima generación Qwen 4, no como un buque insignia terminado.

No hay información oficial sobre el modelo, pero según rumores, probablemente será un sistema de mezcla de expertos, un diseño que divide la red en muchos submodelos especializados y activa solo los relevantes para cada tarea. Un modelo de 125 mil millones de parámetros funcionaría así con el costo computacional de uno de solo 6 mil millones de parámetros.