Кратко

  • Команда Qwen из Alibaba планирует выпустить Qwen 3.8-Flash-Next в среду, модель смеси экспертов, описанную как предварительный просмотр архитектуры Qwen4.
  • В предварительном брифинге команды упоминается 125 миллиардов общих параметров, при этом только 6 миллиардов активны на токен.
  • Точные результаты бенчмарков еще не опубликованы, и веса не доступны на ModelScope на момент написания.

Alibaba планирует выпустить Qwen 3.8-Flash-Next в среду, модель с 125 миллиардами параметров, которая активирует только 6 миллиардов на токен. Команда Qwen представила ее как предварительный просмотр архитектуры следующего поколения Qwen 4, а не как готовый флагман.

Официальной информации о модели нет, но, основываясь на слухах, она, вероятно, будет системой смеси экспертов, конструкцией, которая разделяет сеть на множество специализированных подмоделей и активирует только соответствующие для каждой задачи. Таким образом, модель со 125 миллиардами параметров будет работать с вычислительными затратами модели всего с 6 миллиардами параметров.