活性パラメータ760Mで数学オリンピック91.9% — 「小さいのに賢い」AIモデルの設計思想
ZAYA1-8Bは総パラメータ8.4Bながら活性760MのMoE推論モデル。AIME 91.9%の実力、AMD学習の背景、ローカル実行の可能性を解説。
ZAYA1ZyphraAIモデルオープンソースMoEローカルLLMAMD推論モデル
5件の記事
ZAYA1-8Bは総パラメータ8.4Bながら活性760MのMoE推論モデル。AIME 91.9%の実力、AMD学習の背景、ローカル実行の可能性を解説。
Mistral Small 4は119B MoEで推論・画像・コードを統合。Apache 2.0で無料。使い所を解説。
DeepSeek V4はPro/Flashの2構成。GPT-5.5比97%安でコーディング互角。料金と使い分けを解説。
Qwen3.6-35B-A3Bは35Bパラメータのうち3Bだけ使う超効率MoEモデル。SWE-bench 73.4%の実力をOllamaでローカル実行する方法、27B Dense版との違いを解説。
Tencentが295B MoEモデル「Hy3 Preview」をオープンソース公開。SWE-bench 74.4%の実力、入力0.18ドルの価格、既存サービスへの統合状況を解説する。