阿里巴巴发布Qwen3.8-Flash-Next,瞄准“终极成本效率”
Alibaba releases Qwen3.8-Flash-Next, targeting "ultimate cost efficiency"
イベント要約
阿里巴巴Qwen团队发布了Qwen3.8-Flash-Next模型,采用混合专家模型架构和Muon优化器,训练成本比Qwen3.7-Plus降低9倍。该模型在编码和办公benchmarks上超越了更大的竞争对手,如DeepSeek-V4-Flash和Claude Opus 4.6。该成就对OpenAI和Anthropic等公司带来了更大的价格压力。
情報源 · 2
阿里巴巴的Qwen团队发布了Qwen3.8-Flash-Next:一个125亿多模态MoE,具有6亿活跃参数,预览Qwen4架构
阿里巴バのQwenチームは、125億を超える多様なMoEと6億の活性パラメータを備えたQwen 3.8-Flash-Nextモデルをリリースしました。このモデルは、Qwen 4アーキテクチャのプレビュー版であり、Gated DeltaNetとQwen Sparse Attentionのハイブリッドアーキテクチャ、Gated Residual、N-gram Embedding、Muon Optimizerなどの技術を採用しています。このモデルのトレーニングコストは、Qwen 3.7-Plusより9倍低く、172.78 GiB FP8チェックポイントが必要です。
出典を確認 →阿里巴巴发布Qwen3.8-Flash-Next,瞄准“终极成本效率”
阿里巴巴のQwenチームは、Qwen3.8-Flash-Nextモデルをリリースした。これは、各125億のパラメータのうち6つだけをアクティブ化する混合専門家モデルである。訓練コストは1/9で、より大きな競合他社であるDeepSeek-V4-FlashやClaude Opus 4.6を上回るパフォーマンスを発揮した。この業績は、OpenAIやAnthropicなどの企業にさらなる価格圧力をもたらす。
出典を確認 →