- Anthropicが9月22日にClaude Opus 5.5を発表、運用コストはOpus 5比40%減
- 入力・出力の単価は20%安くキャッシュ読み込みは60%安、出力速度も向上
- Claude Codeなど高頻度・長時間のAI活用ほど恩恵が大きい価格設計
Anthropicが2026年9月22日、新しい大規模言語モデル「Claude Opus 5.5」を発表した。
新設される「Claude 5.5」ファミリーの第一弾で、公式発表によると大半の作業で「Claude Fable 5.1」と同水準の性能を保ちながら、旧モデルの「Opus 5」より運用コストを40%抑えたという。ただしこの40%という数値はAnthropic自身の分析によるもので、独立した第三者検証を経たものではない。
値下げの内訳は主に3つある。
入力トークン(AIが文章を処理する際の最小単位)は1Mトークンあたり4ドル、出力トークンは1Mトークンあたり20ドルで、いずれもOpus 5より20%安い。AIが自分で手順を判断しながら作業を進める「エージェント型」の使い方では、直前までのやり取りをAIが再利用する処理「キャッシュ読み込み」がコストの大半を占めるとされる。この単価は1Mトークンあたり0.20ドルとOpus 5より60%安く設定された。出力の生成速度も30%以上速くなっている。あわせて、より高速に応答する「Fastモード」がClaude CodeとClaude Platformで使えるようになった。最大2.5倍速で動く代わりに、単価は入力8ドル・出力40ドルとやや高い。Pro・Max・Team・シート課金制Enterpriseプランでは、5時間あたりの利用上限も引き上げられた。
読者、特にAIを仕事に組み込んでいる人にとって意味があるのは、日常的に呼び出し続けるエージェント型の作業ほど恩恵が大きい設計になっている点だ。キャッシュ読み込みの単価が最も大きく下がっているのは、同じ文脈を何度も参照しながら長時間動くコーディングエージェントのような使い方で効きやすいためで、単発の質問より継続的な業務利用のほうが恩恵が大きい。録音した音声をAIに渡して後から処理する仕組みを持つツール全般でも、モデル側の処理単価が下がる流れ自体は同じ方向に働く。メモリス(AIボイスメモ)も録音後にAIが文字起こし・要約する設計であり、こうしたモデル側のコスト構造の変化は裏側の処理コストに影響しうる領域だ。
40%という削減率がそのまま自分の請求額にも当てはまる、と捉えたくなるかもしれない。だが、この数値はトークン単価の低下とタスクあたりの消費トークン数の減少を合算したものであり、内訳は使い方によって変わる。同じ文脈をキャッシュせず単発で使うような軽い用途では、削減幅が同じになるとは限らない。しかもFastモードは単価がOpus 5世代より高い。つまり実際の値下げ幅は、どれだけ長時間・高頻度にモデルを呼び出しているかというワークロードの形に左右される。
この値下げの効きどころは、今の作業をただ安くすることより、単価に阻まれて手を出せなかった作業を回せるようにすることにある。早期テスターの1人がOpus 5.5で68万行のコード移行を1日未満で終えた(単一テスターによる個別事例)というのも、5時間あたりの利用上限そのものを引き上げた判断も、単価低下が作業量の拡大に転化していることを示している。読者が取るべき行動は、既存の使い方のままコスト削減だけを喜ぶことではない。これまで単価やレート制限を理由に見送っていた長時間・大規模なタスクを、一度試しに任せてみることだろう。
Anthropicは、ベンチマークのスコア差そのものは実運用の差を正確に示す指標としての信頼性が下がってきているとも述べている。数字の見栄えより、自分のワークロードで実際に処理時間とコストがどう動くかを確かめることのほうが、この値下げを使いこなす近道になる。
詳細はAnthropicの公式発表で確認できる。




