W skrócie

  • Qwen3.8-Max ma 2,4 biliona parametrów i jest pierwszym modelem klasy Max, który Alibaba udostępni jako otwarte wagi.
  • Dostarczany jest z instrukcjami konfiguracji dla Claude Code od Anthropic i Codex od OpenAI — narzędzi konkurencyjnych.
  • W tabeli benchmarków Alibaby, Fable 5 wygrywa 15 z 31 testów. Qwen3.8-Max wygrywa siedem.

Alibaba wypuściła Qwen3.8-Max w poniedziałek, nazywając go najbardziej zaawansowanym modelem, jaki kiedykolwiek zbudowała. Wagi trafią na Hugging Face i ModelScope w przyszłym tygodniu — to pierwszy raz, kiedy firma udostępniła model w skali Max.

Specyfikacje są imponujące: łącznie 2,4 biliona parametrów, z czego 95 miliardów jest aktywnych w danym momencie. Parametry to liczba pokręteł, którymi model może manipulować.

To niezwykle ważne dla wydajności, ponieważ oznacza, że nie wymaga zbyt wielu zasobów do działania. Wyobraź sobie ogromną bibliotekę, w której dla każdego pytania zapala się tylko odpowiednia półka. Małe firmy i laboratoria z wystarczająco dobrym sprzętem mogą teraz uruchomić model najnowszej generacji bez wydawania tyle, co ogromne centrum danych.

Wpis Alibaby o wydaniu pomija typową narrację o ściganiu benchmarków i stawia na wytrzymałość. Model spędził 16 dni na samodzielnym budowaniu narzędzia do kodowania — 265 commitów, 127 pull requestów, 151 issues, bez dotykania klawiatury przez człowieka. Spędził pięć dni na odtwarzaniu artykułu naukowego, dla którego nigdy nie widział kodu, a następnie pobił wyniki samego artykułu o 2,7 punktu. W 24-godzinnym konkursie uczenia maszynowego wyprzedził 458 z 526 ludzkich zespołów.

Zbudowany do działania w narzędziach konkurencji

Qwen3.8-Max jest dostarczany z instrukcjami dla Claude Code i Codex, narzędzi do kodowania stworzonych przez Anthropic i OpenAI. API Alibaby mówi protokołami obu firm. Większość jego benchmarków kodowania została uruchomiona wewnątrz Claude Code.

A te benchmarki nie są dla niego pochlebne. W 31 testach tekstowych, Fable 5 od Anthropic zajmuje 15 pierwszych miejsc, GPT-5.6 Sol od OpenAI dziewięć, Qwen siedem. W 12 testach kodowania Qwen wygrywa dokładnie jeden. Jednak pod względem kosztów inteligencji ten model jest niezwykle tani i wydajny, co oznacza, że nawet jeśli wymaga więcej iteracji lub rozumowania, koszt wykonania zadania będzie znacznie niższy, wynoszący prawie 30% tego, co pobiera Claude Fable 5.

To powiedziawszy, przechodząc do pracy multimodalnej — dokumenty, wideo, rozumowanie przestrzenne — rankingi się odwracają. Qwen prowadzi w większości tej tabeli.

Istnieje również odwrócenie w zakresie strategii biznesowej. W kwietniu Alibaba zlikwidował darmowy poziom Qwen Code, a zespół skłaniał się ku zamkniętym, płatnym modelom po odejściu liderów. Nasza recenzja Qwen 3.7 Max zauważyła, że wersja Plus będzie otwarta, podczas gdy Max pozostanie zamknięty za API.

Te drzwi są teraz otwarte, a ten moment nie jest przypadkowy. Chińskie modele o otwartych wagach wzrosły z mniej niż 2% tokenów na OpenRouter pod koniec 2024 roku do około 61% do połowy 2026 roku. Qwen wyprzedził Meta's Llama jako najbardziej samodzielnie hostowany model na świecie.

Tymczasem Waszyngton ograniczył Fable 5 i Mythos 5 na mocy kontroli eksportu w czerwcu, a Pekin podobno rozważa własne ograniczenia dotyczące chińskich modeli wyjeżdżających za granicę.

Więc Alibaba przegrywa na papierze, ale wygrywa na dystrybucji. Jeśli możesz pobrać coś, co jest blisko za darmo, drugie miejsce to dobre miejsce.