HeadlinesBriefing favicon HeadlinesBriefing.com

Qwen3.8-Flash-Next:AlibabaがQwen4を公開

Hacker News •
×

Alibabaは、Qwen4モデルが存在する前に、Qwen4アーキテクチャに基づくオープンウェイトのマルチモーダル混合専門家モデルであるQwen3.8-Flash-Nextをリリースしました。公式のHugging Faceリポジトリは8月24日に公開され、予定されていたModel Scopeのリリース(8月26日)の2日前でした。モデルカードは、「Qwen4の基盤となるアーキテクチャの実験的プレビュー」であることを確認しています。

主なアーキテクチャの変更には、Gated Delta Network(GDN)とQwen Sparse Attention(QSA)が含まれ、48層のハイブリッド構造で、36層の線形アテンションと12層のフルアテンションで構成されています。モデルは合計125Bパラメータ、トークンあたり6Bアクティブ、512エキスパート、別の51B n-gram埋め込みテーブル、ネイティブコンテキスト262,144トークン(1,000,000まで拡張可能)を備えています。重みは非ゲートで完全に仕様化されています。

Alibabaはこれを技術的なコミットメントとして位置付けています。難しい部分を先にプレビューし、ランタイムとアプリケーションがQwen4ファミリーに備えられるようにするためです。ただし、ベンチマークスコアは未確認であり、独立して再現されていません。正式なModel Scopeのリリースは2026-08-26 23:00(UTC+08:00)に予定されていますが、重みはすでにタイマーを上回っています。

主要エンティティ:企業:Alibaba | 人物:@kimmonismus | 場所:Hugging Face, Model Scope