Claude Opus 5.5「40%安い」の中身を分解する — 値下げで何割、トークン削減で何割か
Anthropic の主張
Anthropic の Claude Opus 5.5 の発表には、こう書かれています。
「既定の設定で、一般的な作業では Opus 5 より40%安くなる」
一方で、同じ発表に載っている単価の値下げ幅は次のとおりです。
| 100万トークンあたり | Opus 5 | Opus 5.5 | 下げ幅 |
|---|---|---|---|
| 入力 | $5.00 | $4.00 | 20% |
| 出力 | $25.00 | $20.00 | 20% |
| キャッシュ書き込み(5分) | $6.25 | $5.00 | 20% |
| キャッシュ読み取り | $0.50 | $0.20 | 60% |
入力と出力は20%しか下がっていません。それなのに全体で40%安くなる理由を、Anthropic 自身は「トークンあたりの料金が安く、しかも1タスクあたりのトークン数が少ないので、差し引きで40%下がる」と説明しています。つまり40%は、値下げとトークン削減の合計です。
試算:値下げだけで何割下がるか
それぞれがどのくらい効いているのか、エージェント的な作業を想定したトークン構成で試算しました。下の構成は私が置いた仮定で、Anthropic が示した数字ではありません。
想定する1タスク
- キャッシュ読み取り:200万トークン(同じ資料やコードを何度も読む部分)
- キャッシュなしの入力:20万トークン
- キャッシュ書き込み:10万トークン
- 出力:6万トークン
同じトークン数で計算した場合
| 項目 | Opus 5 | Opus 5.5 |
|---|---|---|
| キャッシュ読み取り | $1.000 | $0.400 |
| 入力 | $1.000 | $0.800 |
| キャッシュ書き込み | $0.625 | $0.500 |
| 出力 | $1.500 | $1.200 |
| 合計 | $4.125 | $2.900 |
単価の値下げだけで約30%下がります。キャッシュ読み取りの比率が高いほど下げ幅は大きくなり、キャッシュをまったく使わない作業なら20%にとどまります。
40%に届くには
全体で40%下げるには、Opus 5.5 の請求額が $4.125 × 0.6 = 約$2.48 になる必要があります。値下げ後の $2.90 からそこまで下げるには、トークン数がおよそ15%減る必要がある計算です。
Anthropic は発表の中で、キャッシュ読み取りが「エージェント作業やコーディング作業の費用の大半を占める」と書いています。今回の値下げがキャッシュ読み取りに集中しているのは、その実態に合わせたものと読めます。
「トークンが減る」根拠として示されたもの
トークン削減の部分は、早期テスト企業の報告として次のような数字が紹介されています。いずれも各社の自己申告で、条件はそろっていません。
| 企業 | 報告内容 |
|---|---|
| Optiver | 同じ品質を約半分のターン数・時間・出力トークンで達成し、費用は40〜50%減 |
| Factory | 中程度の思考量で、Opus 5 の高い思考量と同等。出力トークンは20〜25%少ない |
| Box | トークン使用量は Opus 5 の3分の1、回答の冗長さは40%減 |
| Kiro | 呼び出し回数は約40%少なく、トークンは半分 |
ほかにも、早期テスト企業が20万行のコードの監査・修正を3時間未満で終えた(Opus 5 は20時間超かかり、トークンは2.5倍)という事例が紹介されています。
40%を当てにしてよい場面、よくない場面
当てにしやすい
- 同じコードベースや資料を何度も読ませるエージェント作業(キャッシュ読み取りの60%値下げが効く)
- 既定の思考量(中程度)のまま使う場合。発表の費用比較のいくつか(GDPval-AA など)は、「既定の思考量の Opus 5.5」と「他モデルの最大思考量」を比べたものです
当てにしにくい
- 短い質問に短く答える使い方。キャッシュが効かず、トークン削減の余地も小さいので、下げ幅は単価どおりの20%に近くなります
- 思考量を最大にして使う場合。性能は上がりますが、その分トークンも増えるので、40%の前提だった「既定の設定」から外れます
他のモデルとの位置関係
| モデル | 入力 | 出力 | キャッシュ読み取り |
|---|---|---|---|
| Claude Fable 5.1 | $10 | $50 | $0.25 |
| Claude Opus 5.5 | $4 | $20 | $0.20 |
| Claude Sonnet 5.5 | $2 | $10 | $0.10 |
Anthropic は Opus 5.5 を「ほとんどの作業で Claude Fable 5.1 と同水準」としつつ、「この性能水準ではベンチマークの差は実際の違いを示す指標として信頼しにくくなっている。社内で使った実感では、Fable 5.1 との差はスコアよりも小さい」とも書いています。Fable 5.1 の4割の単価で同水準なら、多くの用途では Opus 5.5 が合理的な選択になります。
料金以外で変わった点
- 高速モード:最大2.5倍の速度で、入力$8・出力$40(Claude Code と Claude Platform)
- 利用上限:Pro・Max・Team・席単位の Enterprise で、5時間あたりの利用上限が引き上げ
- 思考オフ不可:「thinking」を切った状態では使えなくなった
- 既存の連携への影響:2026年8月31日以降に作られた API アカウントでは、過去の思考内容を手で書き換える操作ができない(蒸留対策)
一次ソース
- Introducing Claude Opus 5.5 — Anthropic(40%の主張・料金表・テスト企業の報告)
- Pricing — Claude Platform Docs(各モデルの単価)
この記事は、本文末尾に挙げた各社の公式発表・公式ドキュメントを突き合わせて AI(Anthropic Claude)が下書きし、運営者が数値と内容を確認したうえで掲載しています。 数値は掲載時点の公式資料にもとづきます。最新の条件は各社の公式ページをご確認ください。
主な一次情報(公式発表)を開く


