Qwen Team に関する報道
関連記事 1 件
Alibaba’s Qwen Team Releases Qwen3.8-Flash-Next: A 125B Multimodal MoE With 6B Active Parameters Previewing the Qwen4 Architecture
AI インサイト阿里巴バのQwenチームは、125億を超える多様なMoEと6億の活性パラメータを備えたQwen 3.8-Flash-Nextモデルをリリースしました。このモデルは、Qwen 4アーキテクチャのプレビュー版であり、Gated DeltaNetとQwen Sparse Attentionのハイブリッドアーキテクチャ、Gated Residual、N-gram Embedding、Muon Optimizerなどの技術を採用しています。このモデルのトレーニングコストは、Qwen 3.7-Plusより9倍低く、172.78 GiB FP8チェックポイントが必要です。