HeadlinesBriefing favicon HeadlinesBriefing.com

Qwen3.8-Flash-Next: Alibaba präsentiert Qwen4

Hacker News •
×

Alibaba hat Qwen3.8-Flash-Next veröffentlicht, ein Open-Weight-Multimodal-Mixture-of-Experts-Modell, das auf der Qwen4-Architektur basiert, bevor überhaupt ein Qwen4-Modell existiert. Das offizielle Hugging-Face-Repository wurde am 24. August veröffentlicht, zwei Tage vor der geplanten Model-Scope-Veröffentlichung am 26. August. Die Modellkarte bestätigt, dass es sich um „eine experimentelle Vorschau der Architektur handelt, die Qwen4 zugrunde liegen wird“.

Zu den wichtigsten architektonischen Änderungen gehören das Gated Delta Network (GDN) und die Qwen Sparse Attention (QSA) in einer hybriden Schicht aus 48 Schichten, mit 36 Schichten linearer Aufmerksamkeit und 12 Schichten voller Aufmerksamkeit. Das Modell hat 125B Gesamtparameter mit 6B aktivierten pro Token, 512 Experten, eine separate 51B n-Gramm-Einbettungstabelle und einen nativen Kontext von 262.144 Token, erweiterbar auf 1.000.000. Die Gewichte sind nicht gegated und vollständig spezifiziert.

Alibaba präsentiert dies als technisches Engagement: zuerst den schwierigen Teil vorab zu zeigen, damit Laufzeiten und Anwendungen für die Qwen4-Familie bereit sind. Allerdings bleiben Benchmark-Ergebnisse unbestätigt und unabhängig nicht reproduziert. Die offizielle Model-Scope-Veröffentlichung ist weiterhin für den 2026-08-26 23:00 (UTC+08:00) geplant, aber die Gewichte haben den Timer bereits geschlagen.

Wichtige Entitäten: Unternehmen: Alibaba | Personen: @kimmonismus | Standorte: Hugging Face, Model Scope