4Bしか動かないのに、15倍サイズを上回る — 学習データまで丸ごと公開されたK2 Horizon
アブダビのMBZUAI系IFMが公開したフルオープンモデル群K2 Horizon。36Bのうち4Bだけ動くMoVA構成、Apache 2.0、学習データとコードまで全公開という中身を、ローカルLLM視点で解説する。
10件の記事
アブダビのMBZUAI系IFMが公開したフルオープンモデル群K2 Horizon。36Bのうち4Bだけ動くMoVA構成、Apache 2.0、学習データとコードまで全公開という中身を、ローカルLLM視点で解説する。
Alibabaがオープンウェイトの密27BモデルQwen3.8-27BをApache 2.0で公開。ローカルで動くサイズながら一部ベンチでOpus 4.6 Maxを上回る。実力と現実的な使い所を整理する。
DeepSeekが実験版のマルチモーダルモデルV4-Flash-Vision-Expを公開。画像理解を追加してもテキスト性能と価格は据え置き。何ができるようになったのかを整理する。
xAI共同創業者Igor Babuschkinの新会社River AIが設立2ヶ月で11億ドル(約1600億円)を調達。オープンウェイトモデルを15分で微調整できるRiver APIとは何か、「個人が所有するAI」という思想を解説する。
Metaがローカルで動く300億パラメータのオープンウェイトAIモデル「Muse Glimmer」を公開。単体GPUのMac/PCでエージェントが動く意味と、ツール使用・失敗リカバリを1モデルに統合した中身を解説。
DeepSeekが格安モデルV4-Flashを再学習した「0731」ビルドを公開。アーキテクチャは据え置きのまま、エージェント性能で自社最上位のV4-Proを上回った。何が変わったのかを整理する。
Ant Groupが公開したエージェント特化の高効率MoEモデルLing-3.0-Flash。124Bで5.1Bだけ動く仕組み、自社1T旗艦に匹敵する性能、無料提供期間を解説する。
Poolsideが公開したオープンウェイトのコーディングモデルLaguna S 2.1。118Bで1.6兆パラメータ級を上回るベンチマーク、1Mコンテキスト、100万トークン10セントの料金を解説する。
JetBrainsのMellum2は12BのオープンなMoEコーディングモデル。トークンあたり2.5Bだけ動かして2倍速い推論を狙う。何が速いか、どこに使うか、ライセンスと注意点を解説する。
元OpenAI CTOミラ・ムラティのThinking Machinesが初の基盤モデルInklingを公開。975B MoEのオープンウェイト、Tinkerでのファインチューニング、料金と性能、そして「最強を狙わない」戦略を解説する。