Em resumo
- A equipe Qwen da Alibaba lançará o Qwen 3.8-Flash-Next na quarta-feira, um modelo de Mistura de Especialistas descrito como uma prévia da arquitetura Qwen4.
- O briefing pré-lançamento da equipe cita 125 bilhões de parâmetros totais com apenas 6 bilhões ativos por token.
- Pontuações de benchmarks rígidos ainda não foram publicadas, e os pesos não estão disponíveis no ModelScope no momento em que este texto foi escrito.
A Alibaba lançará o Qwen 3.8-Flash-Next na quarta-feira, um modelo de 125 bilhões de parâmetros que ativa apenas 6 bilhões por token. A equipe Qwen o apresentou como uma prévia da arquitetura de próxima geração Qwen 4, não como um carro-chefe finalizado.
Não há informações oficiais sobre o modelo, mas com base em rumores, provavelmente será um sistema de mistura de especialistas, um design que divide a rede em muitos submodelos especializados e ativa apenas os relevantes para cada tarefa. Um modelo de 125 bilhões de parâmetros, portanto, funcionaria com o custo computacional de um que tem apenas 6 bilhões de parâmetros.

Parâmetros são basicamente todos os dials que um modelo pode ajustar. Quanto mais parâmetros, mais capaz é o modelo e mais poder computacional ele exigirá. Uma mistura de especialistas torna possível que um modelo extremamente poderoso ative apenas o que precisa para fornecer a melhor saída sem desperdiçar recursos.
Qwen 3.8 Flash Next será lançado amanhã. 125B parâmetros +51B N-gram e 6B ativos. É baseado na próxima geração da arquitetura Qwen 4.
Qwen 4 está chegando https://t.co/xduZNdKnKUpic.twitter.com/rAcBZlNwKs
— AiBattle (@AiBattle_) 25 de agosto de 2026
A equipe Qwen da Alibaba descreve o modelo como multimodal e construído na próxima arquitetura Qwen 4, e diz que enviou a versão inicial para que os desenvolvedores possam se preparar para a família completa.
Por que o "3.8" não é a notícia

A Alibaba lançou um teaser, embora a equipe o chame de prévia. O plano é enviar as melhorias de arquitetura agora, antes do lançamento completo do Qwen 4. O Hugging Face, onde os pesos também estão hospedados, também o descreve como "uma prévia da arquitetura do Qwen 4".
Os benchmarks definitivos ainda não foram divulgados. A Qwen não publicou pontuações comparativas contra sua própria linha Qwen 3 ou rivais ocidentais, portanto os números de 125 bilhões e 6 bilhões de parâmetros não são verificados, e só podemos especular sobre seu desempenho.
O ritmo dos pesos abertos da China tem sido implacável. Um modelo gratuito misterioso, Ox Alpha, recentemente superou o Fable da Anthropic em certos benchmarks de codificação, sem nenhum criador conhecido por trás dele. Alibaba, DeepSeek e Moonshot lançaram pesos capazes que qualquer pessoa pode baixar, ajustar e executar.
Os pesos abertos permitem que os desenvolvedores criem sem enviar dados para uma API fechada, e eles reduzem o custo dos modelos hospedados. É por isso que um modelo aberto de 125 bilhões de parâmetros com 6 bilhões de parâmetros ativos importa: ele coloca capacidade quase de ponta em hardware comum.
Mas teremos que esperar pelos números. A Qwen não havia publicado pontuações de benchmark para o lançamento até o momento desta escrita.






