Em resumo

  • A equipe Qwen da Alibaba lançará o Qwen 3.8-Flash-Next na quarta-feira, um modelo de Mistura de Especialistas descrito como uma prévia da arquitetura Qwen4.
  • O briefing pré-lançamento da equipe cita 125 bilhões de parâmetros totais com apenas 6 bilhões ativos por token.
  • Pontuações de benchmarks rígidos ainda não foram publicadas, e os pesos não estão disponíveis no ModelScope no momento em que este texto foi escrito.

A Alibaba lançará o Qwen 3.8-Flash-Next na quarta-feira, um modelo de 125 bilhões de parâmetros que ativa apenas 6 bilhões por token. A equipe Qwen o apresentou como uma prévia da arquitetura de próxima geração Qwen 4, não como um carro-chefe finalizado.

Não há informações oficiais sobre o modelo, mas com base em rumores, provavelmente será um sistema de mistura de especialistas, um design que divide a rede em muitos submodelos especializados e ativa apenas os relevantes para cada tarefa. Um modelo de 125 bilhões de parâmetros, portanto, funcionaria com o custo computacional de um que tem apenas 6 bilhões de parâmetros.