背景透過PNGをAIが直接吐き出す — 無料のQwen-Image-2.1、ただし商用には落とし穴
Alibabaが9月20日にオープンウェイト画像モデルQwen-Image-2.1を公開。7Bで背景透過PNGを直接生成し、最大10枚の参照画像に対応。生成と編集を1本化した中身と、商用利用のライセンス制限を解説。
32件の記事
Alibabaが9月20日にオープンウェイト画像モデルQwen-Image-2.1を公開。7Bで背景透過PNGを直接生成し、最大10枚の参照画像に対応。生成と編集を1本化した中身と、商用利用のライセンス制限を解説。
AlibabaがApsara Conferenceで発表したQwen 4(Max/Flash/Plus/27B)、5〜10兆パラメータ構想、自社AIチップZhenwu V900を整理。フルスタックAI戦略の狙いを解説する。
Alibabaが9月公開のQwen-Audio 3.1を解説。ASR最大95%・TTS約70%の値下げ、新モデルTTS-Next/ASR-Nextの中身、ElevenLabsとの価格差と日本語での使いどころを整理する。
AlibabaのQwen3.8-Omni-Flashはテキスト・画像・音声・動画を1つの100万トークンで扱うオムニモーダルモデル。音声113言語対応、前世代比98%のコスト削減、エージェント用途に振った中身を解説。
PerplexityがMacアプリで公開したHybrid Compute。機密ファイルはオンデバイスの分類器が判定してMac内で処理し、複雑な推論だけをクラウドへ。仕組みと24GBの壁を解説する。
Alibabaがオープンウェイトの密27BモデルQwen3.8-27BをApache 2.0で公開。ローカルで動くサイズながら一部ベンチでOpus 4.6 Maxを上回る。実力と現実的な使い所を整理する。
AlibabaがQwen3.8-Flash-Nextを公開。総125BのマルチモーダルMoEでアクティブは6B、次世代Qwen4アーキを先取りするオープンウェイトの低コスト版。設計思想と日本で動かす意味を整理する。
AlibabaのフラグシップQwen3.8-Maxは2.4兆パラメータ・100万トークン文脈のMoE。Fable 5に迫るベンチ、料金、オープンウェイト回帰の意味を解説する。
Qwen3.8-27Bは24GBのGPU1枚で動くオープンウェイトのマルチモーダルモデル。Apache 2.0、262Kコンテキスト、公開初週末に300万DL。ローカルAIを塗り替える実力を検証する。
Alibabaのフラグシップ Qwen3.8-Maxは総2.4兆パラメータのMoE。ベンチ、料金、オープンウェイト、Fable 5比較の主張をどこまで信じるかを整理する。
Alibabaの画像生成AI「Qwen-Image-3.0」が一般開放。4.5Kトークンの長文プロンプト、10px級の精密なテキスト描画が売り。重み非公開に転じた理由と料金、使いどころを整理する。
Alibabaが8月3日にQwen3.8 Maxを正式リリース。プレビュー時に不在だったベンチマークがついに公開。PaperBenchでFable 5超え、一方SWE-bench Proでは及ばず。2.4兆パラメータMoEの実力を整理する。
AlibabaがQwen3.7 Flashを公開。100万トークンの文脈長、入力$0.03/出力$0.13という破格の価格、画像も扱えるビジョン言語モデルとしての立ち位置と、Qwenの「脱オープンソース」の流れを解説する。
AppleがApple Intelligenceを中国で認可。ただし言語処理はAlibabaのQwen、検索はBaiduが担う。なぜ自社モデルを使えなかったのか、規制の背景と影響を解説。
Alibabaが7月19日にフラッグシップ「Qwen3.8 Max」プレビューを公開。2.4兆パラメータ・初のマルチモーダル大型モデルで、オープンウェイト化も予告。性能の自己申告とベンチマーク不在を整理する。
中国が7月15日施行の擬人化AI規制でDoubaoやQwenのエージェント機能を停止。規制の全容、日本ユーザーへの影響、DeepSeekへの波及を整理する。
AnthropicがAlibaba/Qwen研究所による史上最大のAIモデル蒸留攻撃を米上院に告発。25,000の偽アカウントで2,880万回のClaude対話を生成。事件の全容と業界への影響を解説。
Alibaba発のQwen-Robot Suiteは世界モデル・ナビゲーション・マニピュレーションの3基盤モデルで構成。38,000時間の学習データとRoboChallenge 1位の実力を解説。
AlibabaのAIアプリQwenがサードパーティAIエージェントに開放。KFC・ラッキンコーヒー・中国東方航空が参加。3億人MAUの中国AIプラットフォーム戦略を解説。
Alibaba Qwen 3.7-Plusは画像・動画を理解するマルチモーダルAI。5つのエージェント能力、Maxとの違い、API料金を解説する。
Qwen 3.7 Maxが知能指数1位。Opus比1/10の料金で35時間自律コーディング。性能と制約を整理
AlibabaのQwenアプリが中国東方航空と連携し、チャットだけで航空券予約を完結。さらにBYDなど9社のEVにも搭載。AIエージェントが実取引を行う時代の中身を整理する。
Qwen3.6-35B-A3Bは35Bパラメータのうち3Bだけ使う超効率MoEモデル。SWE-bench 73.4%の実力をOllamaでローカル実行する方法、27B Dense版との違いを解説。
Alibaba Qwen 3.6-Max-Previewが6つのコーディングベンチマークで世界1位を獲得。初のクローズドモデルとなった背景、ベンチマーク分析、API料金、制約を解説する。
Alibaba発のQwen3.6-27Bは27Bパラメータの密モデルでClaude Opus 4.5級のコーディング性能を実現。RTX 4090で動くフロンティア級モデルの実力と限界を解説。
中国AI処理量が1日140兆トークンに到達。Doubao・DeepSeek・Qwenの実態と1人会社ブームを整理
Qwen3.6-35B-A3BとGemma 4-31Bを主要ベンチマーク・VRAM消費・ライセンスで比較。用途別の選び方を整理した。
Alibaba Qwen 3.5-Omniはテキスト・画像・音声・動画を統合処理するマルチモーダルAI。カメラ入力からのコード生成やAPI料金を解説。
Jack Dorsey率いるBlockのエンジニアが公開したOSSプロジェクトmesh-llmを解説。家のPCやMacのGPUをピアツーピアで束ね、単独では動かせない大規模モデルを分散実行する仕組みと使い所。
Jackrongが公開したQwen3.5-27B Claude-4.6-Opus-Reasoning-Distilledが、Hugging Face Trending1位に。Apache-2.0ライセンスでClaude風の<think>推論をローカル再現。v1/v2の違いとMLX/GGUF展開を整理する。
Alibaba最新のQwen 3.6 Plusは1Mコンテキスト、Claude Opus比18分の1の価格、OpenRouterで無料利用可。ベンチマーク、速度、データ収集の実態を検証する。
Alibaba Qwen 3.5の全7モデルを徹底解説。9Bが30B超えの衝撃的なパラメータ効率、Ollamaでのローカル実行手順、GPT-5.2との性能比較がわかる。