2026年7月19日、アリババのQwenチームは上海WAIC期間中にQwen3.8-Max-Previewをプレビュー公開した。同モデルの総パラメータ数は2.4兆に達し、Fable 5に次ぐフロンティアシステムと位置付けられている。
事実の整理
プレビュー版はAlibaba Token Planサブスクリプションサービスを通じて提供されており、価格は標準価格の10%に設定されている。モデルはテキスト、画像、動画、ドキュメント処理に対応しており、Qwenチームとして初めて1兆パラメータを超えたマルチモーダルモデルとなる。発表によると、コーディング、フルスタック開発、データ分析、オフィスワークフローの各領域においてQwen3.7-Maxを上回るとされている。また、近日中に重みの公開が予定されている。
今回の発表は、Moonshot AIがKimi K3(パラメータ数2.8兆、現時点で世界最大のオープンウェイトモデル)を発表してからわずか2日後にあたる。両ラボの発表時期が重なり、いずれもWAICの開催期間中を選んだ形となった。
仕組みの解説
Qwen3.8-Max-Previewはスパースなmixture-of-experts(MoE)アーキテクチャを採用しており、総パラメータ数は2.4兆だが、アクティベーションパラメータ数は非公開となっている。これまでQwen3-235B-A22Bは22億パラメータをアクティベートし、Qwen3-30B-A3Bは約3億パラメータをアクティベートしていたことから、アクティベーション規模が推論コストを直接左右することが示されている。2.4兆パラメータを4ビット精度で保存した場合、重みには約1.2TBのストレージが必要となり、Nvidia H200一枚あたりのVRAMは141GBであるため、8枚構成でも実際のデプロイには制約が残る。
プレビュー版はAPI経由で提供され、OpenAIおよびAnthropicプロトコルと互換性を持つ。コンテキストウィンドウはQwen3.7-Maxの100万トークンを継承している。Shuai Baiは、同モデルが継続的に進化する状態にあり、現時点では初期バージョンであると述べている。
産業への影響
開発者にとっては、10%という価格設定がAPIコールの敷居を下げるものの、アクティベーションパラメータやベンチマークの詳細が公開されていないため、長期的なセルフホスティングコストの評価が難しい。企業ユーザーはサブスクリプションを通じてマルチモーダル機能を迅速にテストできるが、セルフホスティングにはオープンウェイト版の公開を待つ必要がある。
競争環境の観点では、Kimi K3とQwen3.8-Max-Previewがほぼ同時に登場したことで、中国のラボが数兆パラメータ規模のモデルを並行して推進する構図が浮かび上がった。オープンウェイト化の計画は、企業による制御可能なデプロイを加速し、クローズドソースモデルへの依存を減らす可能性がある。
上下流への影響としては、総パラメータ規模の増大に伴い算力需要が高まるほか、プレビュー期間の割引価格と正式版での収益とのバランスをどう取るかが価格戦略上の課題となる。
比較と前例
Kimi K3との比較では、両モデルともオープンウェイト路線を採用しており、パラメータ規模も近接している。Qwenのこれまでの歴史は、MoEデザインがアクティベーションコストを低減できることを示しているが、今回はアクティベーションパラメータが開示されておらず、従来バージョンとは対照的な状況となっている。
戦略的判断
今後最も起こりやすいシナリオとして、アリババがアクティベーションパラメータを公開するか、デプロイの敷居を下げるための量子化チェックポイントを提供することが考えられる。確認すべきシグナルは、オープンウェイトの公開時期および実際のベンチマークデータのリリースである。
© 2026 Winzheng.com 赢政天下 | 转载请注明来源并附原文链接