DeepSeekが「格安モデル」の中身を作り直した — V4.1-Flashは新設計で自社フラッグシップ超え
DeepSeekがV4.1-Flashを公開。552BのMoEに新アーキテクチャ「Causal Encoder-Decoder」を採用し、1Mコンテキストと激安価格を両立。V4-Proを上回るとされる中身と料金を解説。
23件の記事
DeepSeekがV4.1-Flashを公開。552BのMoEに新アーキテクチャ「Causal Encoder-Decoder」を採用し、1Mコンテキストと激安価格を両立。V4-Proを上回るとされる中身と料金を解説。
上海AI研究所が744BのエージェントMoE「Atria Dawn Preview」をMITライセンスで公開。研究エージェントに特化し、Claude CodeやCodexから差し替えて使える。中身と現実的な使い所を解説。
Abacus.AIがエージェント特化のオープンウェイトモデル群Smaug(Agentic/Flash/Mini)を公開。Hugging Faceで配布、フロンティア比10〜100分の1のコストを謳う。3モデルの中身と実力の見方を解説。
DeepSeekがMITライセンスで公開したエージェント基盤「Harness(dsh)」を解説。モデルもツールもサンドボックスも差し替え可能な「すべてがプラグイン」設計の狙いと、v0.1プレビューの実力を検証する。
DeepSeekが実験版のマルチモーダルモデルV4-Flash-Vision-Expを公開。画像理解を追加してもテキスト性能と価格は据え置き。何ができるようになったのかを整理する。
DeepSeek V4 Proがプレビューを終え正式版(0813)に。エージェント系コーディングのスコアが数倍に跳ねたが第三者検証はまだない。料金・ベンチ・信頼性を整理する。
DeepSeekが格安モデルV4-Flashを再学習した「0731」ビルドを公開。アーキテクチャは据え置きのまま、エージェント性能で自社最上位のV4-Proを上回った。何が変わったのかを整理する。
DeepSeek V4が7月中旬に正式リリース。ピーク/オフピーク料金制を導入し、旧モデルは7月24日に廃止。新料金の仕組みと移行方法を整理する。
SpaceXと月額$150Mのコンピュート契約を結んだReflection AI。元DeepMind研究者が率いるオープンソースAIラボの全貌、DeepSeekとの比較、$250億評価額の背景を解説。
Rampの6月ソフトウェアベンダーランキングでDeepSeekが米国企業の新規課金成長率1位に。オープンソースの自前運用から直接課金へ移行が加速する背景とリスクを分析。
DeepSeekの$7.4B(約1.1兆円)資金調達が大筋合意。創業者梁文鋒の200億元自己投資、Tencent・CATL・国家ファンドの分担、AGI志向の戦略を整理する。
DeepSeek V4 Proの75%割引が恒久化。出力100万トークンあたり0.87ドルでClaude・GPT-5.5の数分の1に。値下げの背景と、開発者のコスト構造への影響を分析する
BaiduのERNIE 5.1は訓練コストを同規模モデルの6%に抑えつつ、Arena Search世界4位・AIME26で99.6点を達成。Once-For-All弾性学習の仕組みと中国AI競争の現在地を解説。
GLM-5.1・Kimi K2.6・DeepSeek V4・MiniMax M2.7を料金・性能で横並び比較。用途別の選び方を解説。
DeepSeek初の外部資金調達が$7.35B(約1.1兆円)に膨張、評価額$50B。テンセント・国家ファンド参加の背景とV4リリースの関係を解説。
DeepSeek V4はPro/Flashの2構成。GPT-5.5比97%安でコーディング互角。料金と使い分けを解説。
DeepSeek V4 ProとFlashが正式ローンチ。1.6TパラメータMoEでGPT-5.4・Claude Opus 4.6級の性能を、入力$0.14〜$1.74で提供。ベンチマーク・料金・実用性を整理する。
中国AI処理量が1日140兆トークンに到達。Doubao・DeepSeek・Qwenの実態と1人会社ブームを整理
DeepSeekが初の外部資金調達に踏み切り、$10B超の評価額で$300M以上を調達交渉中。なぜ今方針を転換したのか、V4との関係、中国AI業界への影響を整理する。
HuaweiのAscend 950PRが2026年4月量産開始。1.56 PFLOPS FP4性能でH20の約2.8倍、DeepSeek V4の主実行基盤、ByteDance/Alibaba/Tencentから計75万ユニットの発注。NVIDIA依存脱却の現実味を整理する。
Jack Dorsey率いるBlockのエンジニアが公開したOSSプロジェクトmesh-llmを解説。家のPCやMacのGPUをピアツーピアで束ね、単独では動かせない大規模モデルを分散実行する仕組みと使い所。
DeepSeekのFast/Expertモード導入の意味を分析。V4リリース直前に「完全無料」から階層化へ舵を切った背景と、ビジネスモデル転換の行方を考察
DeepSeek V4のスペック・価格・地政学的意味を解説。1兆パラメータMoE、Huaweiチップ上での動作、$0.30/Mトークンの価格破壊が示すAI産業の多極化