FlowTune Media

Alibabaが自前チップまで出してきた — Qwen 4と「10兆パラメータ」構想で見えた全体戦略

9月22日、杭州で開かれたAlibabaのApsara Conferenceは、単なるモデル発表会ではなかった。**チップ・クラウド基盤・モデル・エージェントを全部つなげた「フルスタックAI戦略」**の宣言だった、と受け取るのが正しいと思う。

個々の発表を追う前に、この全体像を先に押さえておきたい。今回いちばん重要なのは、Qwen 4という新モデルそのものより、「Alibabaがどこまで自前で垂直統合するつもりか」がはっきりしたことだからだ。

Qwen 4は4モデル同時発表、ただし中身はまだ未公開

まず発表されたのが Qwen 4 ファミリー。Qwen 4 Max / Flash / Plus / 27B の4モデルが一度に披露された。用途と規模で階層を分ける構成で、フラッグシップのMaxから軽量な27Bまでを一気に揃える意図が見える。

ただし——ここは正直に書いておく——4モデルとも、発売日も価格もダウンロード可能なweightsも、まだ出ていない。ベンチマークも公開されていない。つまり現時点では「こういうラインナップを出す」という予告であって、性能を評価できる段階にはない。Qwenといえばオープンウェイトの積極公開でここまで存在感を高めてきただけに、weightsの扱いがどうなるかは注視したいところだ。

本命は「5〜10兆パラメータ」のその先

CEOのEddie Wu氏は、Qwen 4の先に 5兆〜10兆パラメータ 規模の後継を見据えていると語った。具体的には Qwen 4.5 と Qwen 5 のロードマップが示され、そこまでスケールを引き上げる計画だという。

数字だけ見ると景気のいい話だが、こういう超巨大モデルの構想は「言うだけ」なら誰でもできる。効いてくるのは、それを回すための計算基盤を自前で持てるかどうか。そしてAlibabaは、まさにその答えを同じ壇上で出してきた。

自社チップ「Zhenwu V900」が戦略の要

今回いちばん驚いたのが、自社製AIチップ Zhenwu V900 の発表だ。

スペックは、GPUメモリ216GB、チップ間帯域1,200GB/s。Eddie Wu氏はこれを「中国で最も強力なAIチップ」と称し、前世代M890の3倍の性能だと主張する。量産と商用リリースは2027年第1四半期の予定で、最大50万チップ規模のスーパークラスタを構成でき、そこで10兆パラメータ級のQwenを走らせる、という絵を描いている。

これが意味するところは大きい。米国の輸出規制でNVIDIA製の最先端GPU調達が難しくなるなか、Alibabaは「モデルを作る会社」から「モデルを動かすチップまで自分で作る会社」へ踏み込んだ。チップ→クラウド→モデル→エージェントという縦のラインを全部自社で握れば、外部依存を減らしつつ、各レイヤーを最適化できる。この垂直統合こそ、今回のApsaraの核心だ。

この構成が揃うと何が起きるか

フルスタックを自前で持つ強みは、単なる自給自足ではない。価格と提供スピードの主導権を握れる点にある。

たとえばQwen 3.8世代でAlibabaが見せた激しい値下げ攻勢は、外部のチップやクラウドに支払うコストが減れば、さらに加速できる。自社チップで推論コストを下げ、その分をAPI価格に反映する——このループが回り始めると、海外勢にとっては相当に厄介な価格競争相手になる。日本の開発者にとっても、「安くて高性能な中国製モデル」の選択肢がまた一段強くなる可能性がある。

エージェント端末やウェアラブルといったハード側の展開も同じ文脈で語られていた。モデルとチップを握ったうえで、出口となるデバイスまで自社で用意する。全部の階層で辻褄を合わせにきている。

現時点での見立て

構想としては非常に筋が通っている。ただ、繰り返しになるが、Qwen 4は性能未公開、Zhenwu V900は量産が2027年Q1と、まだ「約束」の段階が多い。特にチップは、発表スペックと実運用性能が乖離することがこの業界の常だ。「中国最強」の看板が実測でどう出るかは、量産品が回り始めてからでないと判断できない。

とはいえ、Alibabaがフルスタックで殴りにきた事実は、今後のAIコスト競争の地図を書き換えうる。詳細はAlibaba Cloud公式の戦略発表や、チップの技術的な読み解きはTom's Hardwareの記事が詳しい。

関連記事