Коротко
- Команда Qwen від Alibaba планує випустити Qwen 3.8-Flash-Next у середу, модель Mixture-of-Experts, яку описують як попередній перегляд архітектури Qwen4.
- У попередньому брифінгу команди зазначено 125 мільярдів загальних параметрів, з яких лише 6 мільярдів активуються на кожен токен.
- Тверді результати бенчмарків ще не опубліковані, і ваги не доступні на ModelScope на момент написання цього тексту.
Alibaba планує випустити Qwen 3.8-Flash-Next у середу, модель з 125 мільярдами параметрів, яка активує лише 6 мільярдів на токен. Команда Qwen представила її як попередній перегляд архітектури наступного покоління Qwen 4, а не як готовий флагман.
Офіційної інформації про модель немає, але на основі чуток, це, ймовірно, буде система mixture-of-experts, дизайн, який розділяє мережу на багато спеціалізованих підмоделей і активує лише відповідні для кожного завдання. Таким чином, модель з 125 мільярдами параметрів працюватиме з обчислювальними витратами моделі лише з 6 мільярдами параметрів.

Параметри — це, по суті, всі регулятори, які модель може налаштовувати. Чим більше параметрів, тим потужніша модель і тим більше обчислювальної потужності вона потребує. Суміш експертів дозволяє надзвичайно потужній моделі активувати лише те, що їй потрібно для найкращого результату, не витрачаючи ресурси даремно.
Qwen 3.8 Flash Next виходить завтра. 125B параметрів + 51B N-грам і 6B активних. Він заснований на архітектурі наступного покоління Qwen 4.
Qwen 4 наближається https://t.co/xduZNdKnKUpic.twitter.com/rAcBZlNwKs
— AiBattle (@AiBattle_) 25 серпня 2026 р.
Команда Qwen з Alibaba описує модель як мультимодальну, побудовану на майбутній архітектурі Qwen 4, і каже, що вони випустили ранню збірку, щоб розробники могли підготуватися до повної родини моделей.
Чому «3.8» — це не новина

Alibaba випустила тизер, хоча команда називає це попереднім переглядом. План полягає в тому, щоб впровадити покращення архітектури вже зараз, до повного запуску Qwen 4. Hugging Face, де також розміщені ваги, також описує це як «попередній перегляд архітектури Qwen 4».
Жорсткі бенчмарки ще не опубліковані. Qwen не опублікував порівняльні результати з власною лінійкою Qwen 3 або західними конкурентами, тому цифри в 125 мільярдів і 6 мільярдів параметрів не підтверджені, і ми можемо лише припускати його продуктивність.
Темп відкритих ваг у Китаї був невпинним. Таємнича безкоштовна модель Ox Alpha нещодавно перевершила Fable від Anthropic на деяких бенчмарках кодування, і за нею не стоїть жоден відомий розробник. Alibaba, DeepSeek і Moonshot випустили потужні ваги, які будь-хто може завантажити, доналаштувати та запустити.
Відкриті ваги дозволяють розробникам створювати без надсилання даних до закритого API, і вони знижують вартість хостингових моделей. Ось чому відкрита модель зі 125 мільярдами параметрів і 6 мільярдами активних параметрів має значення: вона наближає можливості, близькі до передових, до звичайного обладнання.
Але нам доведеться почекати на цифри. На момент написання цієї статті Qwen не опублікував результати бенчмарків для цього релізу.






