Alibabaが自前チップまで出してきた — Qwen 4と「10兆パラメータ」構想で見えた全体戦略
9月22日、杭州で開かれたAlibabaのApsara Conferenceは、単なるモデル発表会ではなかった。**チップ・クラウド基盤・モデル・エージェントを全部つなげた「フルスタックAI戦略」**の宣言だった、と受け取るのが正しいと思う。
個々の発表を追う前に、この全体像を先に押さえておきたい。今回いちばん重要なのは、Qwen 4という新モデルそのものより、「Alibabaがどこまで自前で垂直統合するつもりか」がはっきりしたことだからだ。
Qwen 4は4モデル同時発表、ただし中身はまだ未公開
まず発表されたのが Qwen 4 ファミリー。Qwen 4 Max / Flash / Plus / 27B の4モデルが一度に披露された。用途と規模で階層を分ける構成で、フラッグシップのMaxから軽量な27Bまでを一気に揃える意図が見える。
ただし——ここは正直に書いておく——4モデルとも、発売日も価格もダウンロード可能なweightsも、まだ出ていない。ベンチマークも公開されていない。つまり現時点では「こういうラインナップを出す」という予告であって、性能を評価できる段階にはない。Qwenといえばオープンウェイトの積極公開でここまで存在感を高めてきただけに、weightsの扱いがどうなるかは注視したいところだ。
本命は「5〜10兆パラメータ」のその先
CEOのEddie Wu氏は、Qwen 4の先に 5兆〜10兆パラメータ 規模の後継を見据えていると語った。具体的には Qwen 4.5 と Qwen 5 のロードマップが示され、そこまでスケールを引き上げる計画だという。
数字だけ見ると景気のいい話だが、こういう超巨大モデルの構想は「言うだけ」なら誰でもできる。効いてくるのは、それを回すための計算基盤を自前で持てるかどうか。そしてAlibabaは、まさにその答えを同じ壇上で出してきた。
自社チップ「Zhenwu V900」が戦略の要
今回いちばん驚いたのが、自社製AIチップ Zhenwu V900 の発表だ。
スペックは、GPUメモリ216GB、チップ間帯域1,200GB/s。Eddie Wu氏はこれを「中国で最も強力なAIチップ」と称し、前世代M890の3倍の性能だと主張する。量産と商用リリースは2027年第1四半期の予定で、最大50万チップ規模のスーパークラスタを構成でき、そこで10兆パラメータ級のQwenを走らせる、という絵を描いている。
これが意味するところは大きい。米国の輸出規制でNVIDIA製の最先端GPU調達が難しくなるなか、Alibabaは「モデルを作る会社」から「モデルを動かすチップまで自分で作る会社」へ踏み込んだ。チップ→クラウド→モデル→エージェントという縦のラインを全部自社で握れば、外部依存を減らしつつ、各レイヤーを最適化できる。この垂直統合こそ、今回のApsaraの核心だ。
この構成が揃うと何が起きるか
フルスタックを自前で持つ強みは、単なる自給自足ではない。価格と提供スピードの主導権を握れる点にある。
たとえばQwen 3.8世代でAlibabaが見せた激しい値下げ攻勢は、外部のチップやクラウドに支払うコストが減れば、さらに加速できる。自社チップで推論コストを下げ、その分をAPI価格に反映する——このループが回り始めると、海外勢にとっては相当に厄介な価格競争相手になる。日本の開発者にとっても、「安くて高性能な中国製モデル」の選択肢がまた一段強くなる可能性がある。
エージェント端末やウェアラブルといったハード側の展開も同じ文脈で語られていた。モデルとチップを握ったうえで、出口となるデバイスまで自社で用意する。全部の階層で辻褄を合わせにきている。
現時点での見立て
構想としては非常に筋が通っている。ただ、繰り返しになるが、Qwen 4は性能未公開、Zhenwu V900は量産が2027年Q1と、まだ「約束」の段階が多い。特にチップは、発表スペックと実運用性能が乖離することがこの業界の常だ。「中国最強」の看板が実測でどう出るかは、量産品が回り始めてからでないと判断できない。
とはいえ、Alibabaがフルスタックで殴りにきた事実は、今後のAIコスト競争の地図を書き換えうる。詳細はAlibaba Cloud公式の戦略発表や、チップの技術的な読み解きはTom's Hardwareの記事が詳しい。
関連記事
音声AIの料金が最大95%下がった — AlibabaのQwen-Audio 3.1がElevenLabsに仕掛けた価格戦争
Alibabaが9月公開のQwen-Audio 3.1を解説。ASR最大95%・TTS約70%の値下げ、新モデルTTS-Next/ASR-Nextの中身、ElevenLabsとの価格差と日本語での使いどころを整理する。
見て、聴いて、ツールを叩く — Qwen3.8-Omni-Flashが音声1時間を前世代の50分の1のコストで処理する
AlibabaのQwen3.8-Omni-Flashはテキスト・画像・音声・動画を1つの100万トークンで扱うオムニモーダルモデル。音声113言語対応、前世代比98%のコスト削減、エージェント用途に振った中身を解説。
Alibabaが「非公開」をやめた — 2.4兆パラメータのQwen3.8-Max、重みごと公開の狙い
AlibabaのフラグシップQwen3.8-Maxは2.4兆パラメータ・100万トークン文脈のMoE。Fable 5に迫るベンチ、料金、オープンウェイト回帰の意味を解説する。