Кратко
- Команда Qwen из Alibaba планирует выпустить Qwen 3.8-Flash-Next в среду, модель смеси экспертов, описанную как предварительный просмотр архитектуры Qwen4.
- В предварительном брифинге команды упоминается 125 миллиардов общих параметров, при этом только 6 миллиардов активны на токен.
- Точные результаты бенчмарков еще не опубликованы, и веса не доступны на ModelScope на момент написания.
Alibaba планирует выпустить Qwen 3.8-Flash-Next в среду, модель с 125 миллиардами параметров, которая активирует только 6 миллиардов на токен. Команда Qwen представила ее как предварительный просмотр архитектуры следующего поколения Qwen 4, а не как готовый флагман.
Официальной информации о модели нет, но, основываясь на слухах, она, вероятно, будет системой смеси экспертов, конструкцией, которая разделяет сеть на множество специализированных подмоделей и активирует только соответствующие для каждой задачи. Таким образом, модель со 125 миллиардами параметров будет работать с вычислительными затратами модели всего с 6 миллиардами параметров.

Параметры — это, по сути, все регуляторы, которые модель может настраивать. Чем больше параметров, тем более способной является модель и тем больше вычислительной мощности она требует. Смесь экспертов позволяет чрезвычайно мощной модели активировать только то, что необходимо для обеспечения наилучшего результата, не тратя ресурсы впустую.
Qwen 3.8 Flash Next выходит завтра. 125B параметров +51B N-грамм и 6B активных. Он основан на архитектуре следующего поколения Qwen 4.
Qwen 4 скоро https://t.co/xduZNdKnKUpic.twitter.com/rAcBZlNwKs
— AiBattle (@AiBattle_) 25 августа 2026 г.
Команда Qwen из Alibaba действительно описывает модель как мультимодальную и построенную на предстоящей архитектуре Qwen 4, и сообщает, что выпустила раннюю сборку, чтобы разработчики могли подготовиться к полному семейству.
Почему «3.8» — не новость

Alibaba выпустила тизер, хотя команда называет это превью. Планируется внедрить улучшения архитектуры сейчас, до полного развертывания Qwen 4. Hugging Face, где также размещены веса, описывает его как «превью архитектуры Qwen 4».
Жесткие бенчмарки еще не опубликованы. Qwen не публиковал сравнительные результаты против собственной линейки Qwen 3 или западных конкурентов, поэтому цифры в 125 миллиардов и 6 миллиардов параметров не проверены, и мы можем только строить догадки о его производительности.
Темп открытых весов в Китае был неустанным. Загадочная бесплатная модель Ox Alpha недавно превзошла Anthropic’s Fable на некоторых бенчмарках кодирования, и за ней не стоит известный разработчик. Alibaba, DeepSeek и Moonshot выпустили способные веса, которые любой может скачать, дообучить и запустить.
Открытые веса позволяют разработчикам создавать приложения без отправки данных в закрытый API и снижают стоимость размещенных моделей. Вот почему открытая модель со 125 миллиардами параметров и 6 миллиардами активных параметров имеет значение: она приближает возможности, близкие к передовым, к стандартному оборудованию.
Но нам придется подождать цифр. На момент написания этой статьи Qwen не публиковал результаты бенчмарков для этого релиза.






