AlibabaはマルチモーダルMoEモデル「Qwen3.8-Flash-Next」の重みをHugging FaceとModelScopeで公開しました。同モデルは、Qwen4シリーズで使われる予定のアーキテクチャを早期にコミュニティへ示す役割を果たします。これはQwen3-NextがQwen3.5に対して担った役割と同様です。

技術面では、アテンション、残差、埋め込み、最適化の4点を改良しています。メインモデルは125Bパラメータで、N-gram埋め込みとして51Bパラメータを追加しています。トークンあたり6Bパラメータが活性化される設計です。

Qwen3.7-Plusと比較すると、訓練コストは約1/9に抑えられています。コーディングやオフィスタスクでの能力は向上しています。ネイティブで262,144トークンのコンテキストをサポートし、YaRNにより100万トークンまで拡張可能です。

本番版はQwenCloudで「Qwen3.8-Flash」として提供されます。デフォルトで1Mコンテキストを備え、公式ツールが組み込まれています。価格は入力トークン100万あたり0.15ドル、出力トークン100万あたり0.47ドルです。


出典: Qwen3.8-Flash-Next(HN 701pt・233コメント)(HN Search (backfill)、2026-08-26)