Kurzfassung

  • Qwen3.8-Max verfügt über 2,4 Billionen Parameter und ist das erste Max-Klasse-Qwen-Modell, das Alibaba als Open Weights veröffentlicht.
  • Es wird mit Einrichtungsanweisungen für Anthropics Claude Code und OpenAIs Codex geliefert – konkurrierende Tools.
  • Auf Alibabas eigener Benchmark-Tabelle gewinnt Fable 5 15 von 31 Tests. Qwen3.8-Max gewinnt sieben.

Alibaba hat Qwen3.8-Max am Montag veröffentlicht und bezeichnet es als das leistungsfähigste Modell, das es je gebaut hat. Die Gewichte werden nächste Woche auf Hugging Face und ModelScope verfügbar sein – das erste Mal, dass das Unternehmen ein Modell im Max-Maßstab kostenlos zur Verfügung stellt.

Die Spezifikationen sind groß: insgesamt 2,4 Billionen Parameter, von denen zu jedem Zeitpunkt 95 Milliarden aktiviert sind. Parameter sind die Anzahl der Stellschrauben, die ein Modell handhaben kann.

Dies ist für die Effizienz äußerst wichtig, da es bedeutet, dass nicht zu viele Ressourcen für den Betrieb benötigt werden. Stellen Sie es sich wie eine riesige Bibliothek vor, in der für jede Frage nur das relevante Regal aufleuchtet. Kleine Unternehmen und Labore mit ausreichend guter Hardware können nun ein hochmodernes Modell ausführen, ohne so viel auszugeben wie ein großes Rechenzentrum.

Alibabas Veröffentlichungsbeitrag überspringt die übliche Benchmark-Jagd-Erzählung und setzt stattdessen auf Ausdauer. Das Modell verbrachte 16 Tage damit, ein Codierungstool selbst zu bauen – 265 Commits, 127 Pull Requests, 151 Issues, kein Mensch hat die Tastatur berührt. Es verbrachte fünf Tage damit, ein Forschungspapier zu reproduzieren, für das es nie Code gesehen hatte, und übertraf dann die eigenen Ergebnisse des Papiers um 2,7 Punkte. Bei einem 24-stündigen Machine-Learning-Wettbewerb landete es vor 458 von 526 menschlichen Teams.

Entwickelt, um in den Tools eines Konkurrenten zu laufen

Qwen3.8-Max wird mit Anweisungen für Claude Code und Codex geliefert, die Codierungstools von Anthropic und OpenAI. Alibabas API spricht die Protokolle beider Unternehmen. Die meisten seiner Codierungs-Benchmarks wurden in Claude Code ausgeführt.

Und diese Benchmarks schmeicheln ihm nicht. Bei 31 Texttests belegt Anthropics Fable 5 15 erste Plätze, OpenAIs GPT-5.6 Sol neun, Qwen sieben. Bei den 12 Codierungstests gewinnt Qwen genau einen. Allerdings ist dieses Modell in Bezug auf die Intelligenzkosten äußerst günstig und effizient, was bedeutet, dass selbst wenn es mehr Iterationen oder Überlegungen erfordert, die Kosten für die Erledigung der Aufgabe viel niedriger sein werden, fast 30% dessen, was Claude Fable 5 verlangt.

Das heißt, wenn man zu multimodalen Aufgaben wechselt – Dokumente, Video, räumliches Denken – kehren sich die Ranglisten um. Qwen führt die meiste dieser Tabelle an.

Es gibt auch eine Umkehrung in Bezug auf die Geschäftsstrategie. Im April hat Alibaba die kostenlose Stufe von Qwen Code eingestellt, wobei sich das Team nach Führungswechseln in Richtung geschlossener, kostenpflichtiger Modelle bewegte. Unser Test von Qwen 3.7 Max stellte fest, dass die Plus-Version offen sein würde, während Max hinter der API verschlossen bliebe.

Diese Tür ist jetzt offen, und der Zeitpunkt ist kein Zufall. Chinesische Open-Weight-Modelle stiegen von unter 2 % der Tokens auf OpenRouter Ende 2024 auf etwa 61 % Mitte 2026. Qwen überholte Metas Llama als das am häufigsten selbst gehostete Modell der Welt.

In der Zwischenzeit beschränkte Washington im Juni Fable 5 und Mythos 5 unter Exportkontrollen, und Peking erwägt Berichten zufolge eigene Beschränkungen für chinesische Modelle, die ins Ausland gehen.

Alibaba verliert also auf dem Papier und gewinnt bei der Verbreitung. Wenn man etwas herunterladen kann, das fast gleichwertig ist und kostenlos, ist der zweite Platz ein guter Platz.