W skrócie
- Zespół Qwen z Alibaba ma opublikować w środę model Qwen 3.8-Flash-Next, model Mixture-of-Experts opisany jako zapowiedź architektury Qwen4.
- W materiałach przedpremierowych zespół podaje łącznie 125 miliardów parametrów, z czego tylko 6 miliardów aktywnych na token.
- Wyniki twardych benchmarków nie zostały jeszcze opublikowane, a wagi nie są dostępne na ModelScope w momencie pisania tego tekstu.
Alibaba ma opublikować w środę model Qwen 3.8-Flash-Next, model o 125 miliardach parametrów, który aktywuje tylko 6 miliardów na token. Zespół Qwen przedstawił go jako zapowiedź architektury nowej generacji Qwen 4, a nie gotowy flagowy model.
Nie ma oficjalnych informacji na temat modelu, ale na podstawie plotek, prawdopodobnie będzie to system mixture-of-experts, czyli architektura, która dzieli sieć na wiele wyspecjalizowanych podmodeli i uruchamia tylko te istotne dla danego zadania. Model o 125 miliardach parametrów działałby zatem z kosztem obliczeniowym modelu o zaledwie 6 miliardach parametrów.

Parametry to w zasadzie wszystkie pokrętła, które model może regulować. Im więcej parametrów, tym bardziej zdolny jest model i tym więcej mocy obliczeniowej będzie wymagał. Mieszanka ekspertów (mixture of experts) umożliwia niezwykle potężnemu modelowi aktywowanie tylko tego, czego potrzebuje, aby zapewnić najlepsze wyniki bez marnowania zasobów.
Qwen 3.8 Flash Next zostanie wydany jutro. 125B parametrów +51B N-gram i 6B aktywnych. Jest oparty na architekturze następnej generacji Qwen 4.
Qwen 4 nadchodzi https://t.co/xduZNdKnKUpic.twitter.com/rAcBZlNwKs
— AiBattle (@AiBattle_) 25 sierpnia 2026
Zespół Qwen z Alibaba opisuje model jako multimodalny i zbudowany na nadchodzącej architekturze Qwen 4, i twierdzi, że dostarczył wczesną wersję, aby programiści mogli przygotować się na pełną rodzinę modeli.
Dlaczego „3.8” nie jest wiadomością

Alibaba opublikował zapowiedź, choć zespół nazywa to podglądem. Plan polega na wdrożeniu ulepszeń architektury już teraz, przed pełnym wydaniem Qwen 4. Hugging Face, gdzie również znajdują się wagi, również opisuje to jako „podgląd architektury Qwen 4”.
Twarde benchmarki jeszcze nie zostały opublikowane. Qwen nie opublikował wyników porównawczych z własną linią Qwen 3 ani z zachodnimi rywalami, więc liczby 125 miliardów i 6 miliardów parametrów nie są zweryfikowane i możemy jedynie spekulować na temat jego wydajności.
Tempo publikacji otwartych wag w Chinach jest nieustanne. Tajemniczy darmowy model, Ox Alpha, niedawno pokonał Anthropic’s Fable w niektórych benchmarkach kodowania, bez znanego twórcy. Alibaba, DeepSeek i Moonshot wypuścili wydajne wagi, które każdy może pobrać, dostroić i uruchomić.
Otwarte wagi pozwalają programistom tworzyć bez wysyłania danych do zamkniętego API i obniżają koszty modeli hostowanych. Dlatego otwarty model o 125 miliardach parametrów z 6 miliardami aktywnych parametrów ma znaczenie: umieszcza możliwości bliskie granicom na sprzęcie powszechnym.
Ale będziemy musieli poczekać na liczby. Qwen nie opublikował wyników benchmarków dla tego wydania w momencie pisania tego tekstu.






