Alibaba、2.4兆パラメータのQwen3.8 Maxを公開 — 「Fable 5に次ぐ」という自己申告の中身
「今日利用可能なモデルの中で最も強力なものの一つ。フロンティアモデルと肩を並べ、Fable 5に次ぐ」——Qwenの公式アカウントが7月19日にそう投稿したとき、正直、まず思ったのは「ベンチマークは?」だった。
Alibabaが同日、フラッグシップの新モデル Qwen3.8 Max のプレビュー版を公開した。うたい文句は2.4兆パラメータ、Qwenとして初の1兆パラメータ超えマルチモーダルモデル、そして近日中のオープンウェイト化。数字だけ並べれば圧巻だが、公開されたのは主張だけで、第三者が検証できるスコアは今のところ何も出ていない。
何が公開されたのか
まず事実関係を整理する。
7月19日、Qwen3.8 Max のプレビュー版が Alibaba Cloud の Token Plan と、同社のAIコーディング環境 Qoder / QoderWork 経由で早期アクセス可能になった。開発チームの Shuai Bai 氏によれば、これはQwenにとって初の1兆パラメータを超えるマルチモーダルモデルで、画像・動画・ドキュメントを扱える。
パラメータ数は2.4兆(2.4T)。もし本当にオープンウェイトで公開されれば、先日リリースされたMoonshotのKimi K3と並び、実質的に「史上最大級のオープンモデル」の座を争うことになる。実際、今回の発表はKimi K3を明確に意識したタイミングだ。中国のオープンモデル勢が、規模でも性能でも競り合いを始めている。
「Fable 5に次ぐ」をどう受け取るか
ここが今回いちばん引っかかる部分だ。
Alibabaは「フロンティアモデルに匹敵し、Anthropicの Fable 5 に次ぐ」と表現した。額面通りなら、Qwen3.8 Max は GPT-5.6 SolやGrok 4.5すら上回り、世界2位の座にいることになる。
だが現時点で公開されているのは、この一文とパラメータ数だけ。モデルカードもコンテキストウィンドウの仕様も、公開ベンチマークの表も、トークン単価すら出ていない。「Fableに次ぐ」という順位づけは、完全に自社評価に基づくものだ。
Qwenシリーズを追ってきた人なら既視感があるはずだ。Qwen 3.6 Max のときも「コーディングベンチマーク世界1位」と謳われたが、実際の開発現場では「Claude Codeの方が扱いやすい」という声が少なくなかった。ベンチマークの数字と、毎日触ったときの使い心地は別物だ。だから今回の「2位」も、独立した検証が出るまでは話半分で見ておくのが健全だと思う。
とはいえ、Alibabaがこの規模のモデルを「プレビュー」として実際に触れる形で出してきた事実は重い。ハッタリだけなら、開発者が叩けるQoderやToken Planに載せるリスクは負わないはずだ。
使う方法と料金
現時点でQwen3.8 Max を触るルートは主に3つ。Alibaba Cloud の Token Plan、Qoder、QoderWork だ。
Token Plan はサブスク型で、国際版は月額 $6(約940円)のLiteプラン(7日ごとに2,500クレジット)から、月額 $68(約1万700円)のProプラン(同40,000クレジット)まで。中国国内向けは月39元スタートと安い。
Qoder上では、プレビュー期間中の消費が通常時0.05倍・オフピーク時0.01倍という破格の設定になっている。要するに「まずは試してほしい」という値付けだ。
一方で、API向けのトークン単価はまだ正式発表されていない。Qwen 3.7 Max が入力100万トークンあたり$2.50という「桁違いの安さ」で注目を集めたことを考えると、3.8 Max の正式な単価が出た瞬間が、実質的な本番になるだろう。
オープンウェイト化が意味すること
このモデルの本当のインパクトは、性能ランキングよりも「2.4兆パラメータのマルチモーダルモデルがオープンウェイトで降ってくる」という点にあると考えている。
もし予告通りに公開されれば、3つの可能性が現実味を帯びる。
ひとつは、自社データで巨大マルチモーダルモデルをファインチューニングできること。画像・動画・ドキュメントを理解する2.4Tモデルを、クラウドに預けずに手元で改造できるなら、機密性の高い業務(医療画像、社内文書解析など)でクローズドモデルを避けたい層に刺さる。
ふたつめは、エージェント型ワークフローのコスト構造の転換だ。Qwenシリーズの安さがそのまま続くなら、大量のAPIコールを前提とする自律エージェントを、フロンティア級の知能で回しても採算が取れる領域が広がる。
そして三つめ、いちばん大きいのは米中モデル格差の縮小そのものだ。半年前のQwen 3.5がGPT-4oクラスだったことを思えば、オープンなモデルが「Fableに次ぐ」と自称できる地点まで来たこと自体が、業界の重心の動きを示している。仮に自己申告が多少盛られていたとしても、その差が縮まっている方向性は否定しにくい。
現時点での評価
素直にすごいと思う点は、規模とオープン化の姿勢、そして「プレビュー」を実際に触れる形で即座に出してきたスピード感だ。中国AI勢の開発サイクルは、もはやOpenAIやAnthropicと同じテンポで回っている。
微妙なのは、やはり検証材料の欠如。「2位」を名乗るなら、それを裏づけるベンチマークとモデルカードをセットで出してほしかった。マーケティングの一文が先行し、実体が後追いになる構図は、これまでのQwen Maxシリーズと同じパターンだ。
結論としては、期待して追う価値はあるが、飛びつくのはオープンウェイトと第三者ベンチマークが出てからで十分、というのが今の見立てだ。正式版とトークン単価の発表が、次の見どころになる。
関連記事
35時間放置したらコードが10倍速くなっていた — Qwen 3.7 Maxの自律コーディング実験
Qwen 3.7 Maxが知能指数1位。Opus比1/10の料金で35時間自律コーディング。性能と制約を整理
見て、考えて、コードを書いて、自分で検証する — Qwen 3.7-Plusが持つ5つのエージェント能力
Alibaba Qwen 3.7-Plusは画像・動画を理解するマルチモーダルAI。5つのエージェント能力、Maxとの違い、API料金を解説する。
カメラに映した手書きスケッチからReactアプリを作る — Qwen 3.5-Omniの衝撃と、クローズド化の波紋
Alibaba Qwen 3.5-Omniはテキスト・画像・音声・動画を統合処理するマルチモーダルAI。カメラ入力からのコード生成やAPI料金を解説。