詳細・ビジネスへの影響
中国Alibaba(アリババ)のQwen開発チームは、次世代フラッグシップ「Qwen4」のアーキテクチャを先行採用したオープンウェイトのマルチモーダルMoEモデル「Qwen3.8-Flash-Next」を正式公開しました。
本モデルは総パラメータ1,250億(125B)のうち、トークン生成ごとにアクティブ化されるのはわずか60億(6B)という超高効率なMixture-of-Experts(MoE)設計を採用。
Gated DeltaNet(GDN)とQwen Sparse Attention(QSA)を組み合わせたハイブリッド構造により、標準で約26万トークン(262,144トークン)、YaRN拡張時で最大100万トークンの広大なコンテキストウィンドウをサポートします。
さらに、システムRAM上で動作する510億パラメータのN-gram埋め込み層を導入し、VRAM消費と推論コストを大幅に抑制。
Hugging FaceやModelScope上で重みが一般公開されており、ローカル環境やクラウドでのオープンAI活用を大きく加速させます(一次ソース:Alibaba Qwen 公式GitHub / Hugging Face公開)。
