Kurzfassung

  • Alibabas Qwen-Team wird am Mittwoch Qwen 3.8-Flash-Next veröffentlichen, ein Mixture-of-Experts-Modell, das als Vorschau auf die Qwen4-Architektur beschrieben wird.
  • In der Vorab-Briefing des Teams werden insgesamt 125 Milliarden Parameter genannt, von denen pro Token nur 6 Milliarden aktiv sind.
  • Harte Benchmark-Ergebnisse wurden noch nicht veröffentlicht, und die Gewichte sind zum Zeitpunkt dieses Schreibens noch nicht auf ModelScope verfügbar.

Alibaba wird am Mittwoch Qwen 3.8-Flash-Next veröffentlichen, ein Modell mit 125 Milliarden Parametern, das pro Token nur 6 Milliarden aktiviert. Das Qwen-Team stellte es als Vorschau auf die nächste Generation der Qwen-4-Architektur dar, nicht als fertiges Flaggschiff.

Es gibt keine offiziellen Informationen über das Modell, aber basierend auf Gerüchten wird es wahrscheinlich ein Mixture-of-Experts-System sein, ein Design, das das Netzwerk in viele spezialisierte Teilmodelle aufteilt und für jede Aufgabe nur die relevanten aktiviert. Ein Modell mit 125 Milliarden Parametern würde also mit den Rechenkosten eines Modells mit nur 6 Milliarden Parametern laufen.