Claude Opus 5.5が来た — 40%安く、30%速く、そして「推論を盗ませない」新しい防御
フラッグシップモデルが世代交代するとき、たいていは「性能が上がって、値段も上がる」。だから今回のニュースは順序が逆で、少し面食らった。
Anthropicが9月22日(日本時間23日)に公開したClaude Opus 5.5は、前世代のOpus 5より実行コストが典型的なワークロードで40%安く、出力は30%以上速い。そのうえでベンチマークは軒並み上振れしている。安くなって速くなって賢くなった、という三拍子は、フロンティアモデルの発表としては珍しい。
数字で見る「何が変わったか」
料金からいこう。100万トークンあたりの単価はこうだ(カッコ内は1ドル150円換算のおおよその日本円)。
| 項目 | Opus 5.5 | Opus 5 |
|---|---|---|
| 入力 | $4(約600円) | $5 |
| 出力 | $20(約3,000円) | $25 |
| キャッシュ読み込み | $0.20 | $0.50 |
| キャッシュ書き込み | $5 | $6.25 |
単価そのものが2割下がっているうえ、Anthropicは「1タスクあたりのトークン消費が減った」とも言っている。つまり単価×消費量の両方で効いて、実効コストが4割減という計算だ。キャッシュ読み込みが$0.50→$0.20と6割引きになっているのも、長いコンテキストを何度も使うエージェント運用では地味に大きい。
ベンチマークも見ておく。エージェント型コーディングのTerminal-Bench 4.0で66.4%、CursorBench 4.0で57.8%(GPT-5.6 Solより11ポイント上をおよそ1/3のコストで)、FrontierCode v1.1では54.4%でGPT-6 Astraを約2割のコストで上回ったとする。派手なのは実務エピソードのほうで、あるテスターは68万行のコード移行を1日足らずで完了させたという。
正直、ベンチの数字は各社が都合よく切り取るものなので鵜呑みにはしない。ただ「同等以上の結果を数分の一のコストで」という主張が繰り返されている点は、方向性として一貫している。
本命は「preserved thinking」かもしれない
個人的にいちばん引っかかったのは性能でも料金でもなく、**preserved thinking(保持された思考)**という新しい仕掛けだ。
これは蒸留(distillation)対策の安全機構だ。ざっくり言うと、APIの利用者がClaudeの過去の思考コンテキストを書き換えて、モデルの推論プロセスそのものを大量に抽出する——つまり「Claudeの頭の中を盗んで自前のモデルに移植する」ことを防ぐ。2026年8月31日以降に作られたAPIアカウントに適用される。
なぜこれが効くのか。ここ1年、フロンティアモデルの推論トレースを吸い出して安価なモデルに蒸留する手口が問題になってきた。上位モデルの「考え方」がコピーされれば、開発元が投じた研究開発費は回収しづらくなる。Anthropicが自社IPを守りにきた、というのがストレートな読み方だ。
裏を返すと、これは利用者側の自由度を少し削る。thinkingモードを無効化できない仕様とあわせて、「モデルの内部をいじって最適化する」タイプの使い方はやりにくくなる。透明性とIP防御はトレードオフで、今回は後者に振ったということだ。ここをどう評価するかは、使う側の立場で割れると思う。
「フロンティアのペーシング」を掲げた会社の一手
Anthropicは今回のOpus 5.5を「フロンティアのペーシングを呼びかけて以来、はじめてのモデル」と位置づけている。無闇に能力を尖らせるより、安全性・整合性を担保しながら実用性を上げる——という物語だ。実際、行動監査では過去最高の整合性スコアを記録し、境界を回避しようとする挙動が85%減ったとする。サイバー系の危険タスクの多くは旧世代のOpus 4.8にルーティングして能力を抑える、という細かい制御も入っている。
この「安く・速く・安全に」という組み合わせが揃うと、何が現実になるか。効いてくるのはエージェントの経済性だと思う。自律エージェントはタスク1件のなかでモデルを何十回も呼ぶが、これまでは「賢いが高い」がボトルネックで、Opusを常用するのは割に合わない場面が多かった。コストが4割下がり、1タスクの消費トークンも減るなら、「重要な判断だけ上位モデルに任せる」から「まるごとOpusで回す」へ、採算ラインが動く可能性がある。18時間タスクに張り付き続けた(Clio社)、38プロンプト4日かかった作業が11プロンプト3時間で終わった(Quantium社)といった事例は、その方向を示している。
使いどころと、正直な評価
Opus 5.5はclaude-opus-5-5としてAPI・Claudeアプリ・Claude Codeで即日利用可能。AWS・Google Cloud・Azure経由でも使える。SonnetとHaikuの5.5は「数週間以内」に続くという。
素直にすごいのは、性能を上げながら価格を下げてきたことだ。大規模コードベースの多段変更やコードレビュー、長時間の自律作業を回す用途では、いま最初に試す価値がある。既存のClaude Opus 5からの乗り換えは、コスト面だけでも検討に値する。
一方で微妙な点もある。thinkingモードを切れないため、軽いタスクでも一定の推論コストは避けられない。preserved thinkingは正当な理由でコンテキストを操作したい上級ユーザーには制約になる。そして例によって、ベンチの優位が自分のワークロードでそのまま出るとは限らない。結局のところ、公式の数字を眺めるより、手元のタスクで旧世代と往復比較してみるのがいちばん早い。料金と性能の両方が動いた今回は、その検証をやる価値がある世代交代だ。
関連記事
中位モデルが上位モデルを追い抜いた — Claude Sonnet 5.5が値上げなしでやったこと
AnthropicがClaude Sonnet 5.5を公開。ターミナル作業のベンチで上位のOpus 5.5を上回り、Sonnet 5から値上げなしで30%以上高速化。料金・ベンチ・使いどころを整理する。
Claudeの値段は据え置き、でも請求は最大45%下がる — Fable 5.1が値下げしたのは"キャッシュ"だった
AnthropicがClaude Fable 5.1とMythos 5.1をリリース。入力$10/出力$50は据え置きのまま、キャッシュ読み取りを75%カット。なぜこれがエージェント運用のコストを最大45%下げるのかを解説する。
Claude Opus 5が来た — 価格据え置きでベンチ首位、ただし本命は「手加減できる」ことかもしれない
AnthropicがClaude Opus 5を公開。Opus 4.8と同価格でArtificial Analysis首位、low/medium/highのeffortトグルを搭載。ベンチ・料金・実務での使いどころを整理する。