📊モデルリリースAI Daily Digest

Claude Opus 5.5「40%安い」の中身を分解する — 値下げで何割、トークン削減で何割か

Anthropic の主張

Anthropic の Claude Opus 5.5 の発表には、こう書かれています。

「既定の設定で、一般的な作業では Opus 5 より40%安くなる」

一方で、同じ発表に載っている単価の値下げ幅は次のとおりです。

100万トークンあたりOpus 5Opus 5.5下げ幅
入力$5.00$4.0020%
出力$25.00$20.0020%
キャッシュ書き込み(5分)$6.25$5.0020%
キャッシュ読み取り$0.50$0.2060%

入力と出力は20%しか下がっていません。それなのに全体で40%安くなる理由を、Anthropic 自身は「トークンあたりの料金が安く、しかも1タスクあたりのトークン数が少ないので、差し引きで40%下がる」と説明しています。つまり40%は、値下げとトークン削減の合計です。

試算:値下げだけで何割下がるか

それぞれがどのくらい効いているのか、エージェント的な作業を想定したトークン構成で試算しました。下の構成は私が置いた仮定で、Anthropic が示した数字ではありません。

想定する1タスク

  • キャッシュ読み取り:200万トークン(同じ資料やコードを何度も読む部分)
  • キャッシュなしの入力:20万トークン
  • キャッシュ書き込み:10万トークン
  • 出力:6万トークン

同じトークン数で計算した場合

項目Opus 5Opus 5.5
キャッシュ読み取り$1.000$0.400
入力$1.000$0.800
キャッシュ書き込み$0.625$0.500
出力$1.500$1.200
合計$4.125$2.900

単価の値下げだけで約30%下がります。キャッシュ読み取りの比率が高いほど下げ幅は大きくなり、キャッシュをまったく使わない作業なら20%にとどまります。

40%に届くには

全体で40%下げるには、Opus 5.5 の請求額が $4.125 × 0.6 = 約$2.48 になる必要があります。値下げ後の $2.90 からそこまで下げるには、トークン数がおよそ15%減る必要がある計算です。

Anthropic は発表の中で、キャッシュ読み取りが「エージェント作業やコーディング作業の費用の大半を占める」と書いています。今回の値下げがキャッシュ読み取りに集中しているのは、その実態に合わせたものと読めます。

「トークンが減る」根拠として示されたもの

トークン削減の部分は、早期テスト企業の報告として次のような数字が紹介されています。いずれも各社の自己申告で、条件はそろっていません。

企業報告内容
Optiver同じ品質を約半分のターン数・時間・出力トークンで達成し、費用は40〜50%減
Factory中程度の思考量で、Opus 5 の高い思考量と同等。出力トークンは20〜25%少ない
Boxトークン使用量は Opus 5 の3分の1、回答の冗長さは40%減
Kiro呼び出し回数は約40%少なく、トークンは半分

ほかにも、早期テスト企業が20万行のコードの監査・修正を3時間未満で終えた(Opus 5 は20時間超かかり、トークンは2.5倍)という事例が紹介されています。

40%を当てにしてよい場面、よくない場面

当てにしやすい

  • 同じコードベースや資料を何度も読ませるエージェント作業(キャッシュ読み取りの60%値下げが効く)
  • 既定の思考量(中程度)のまま使う場合。発表の費用比較のいくつか(GDPval-AA など)は、「既定の思考量の Opus 5.5」と「他モデルの最大思考量」を比べたものです

当てにしにくい

  • 短い質問に短く答える使い方。キャッシュが効かず、トークン削減の余地も小さいので、下げ幅は単価どおりの20%に近くなります
  • 思考量を最大にして使う場合。性能は上がりますが、その分トークンも増えるので、40%の前提だった「既定の設定」から外れます

他のモデルとの位置関係

モデル入力出力キャッシュ読み取り
Claude Fable 5.1$10$50$0.25
Claude Opus 5.5$4$20$0.20
Claude Sonnet 5.5$2$10$0.10

Anthropic は Opus 5.5 を「ほとんどの作業で Claude Fable 5.1 と同水準」としつつ、「この性能水準ではベンチマークの差は実際の違いを示す指標として信頼しにくくなっている。社内で使った実感では、Fable 5.1 との差はスコアよりも小さい」とも書いています。Fable 5.1 の4割の単価で同水準なら、多くの用途では Opus 5.5 が合理的な選択になります。

料金以外で変わった点

  • 高速モード:最大2.5倍の速度で、入力$8・出力$40(Claude Code と Claude Platform)
  • 利用上限:Pro・Max・Team・席単位の Enterprise で、5時間あたりの利用上限が引き上げ
  • 思考オフ不可:「thinking」を切った状態では使えなくなった
  • 既存の連携への影響:2026年8月31日以降に作られた API アカウントでは、過去の思考内容を手で書き換える操作ができない(蒸留対策)

一次ソース

この記事は、本文末尾に挙げた各社の公式発表・公式ドキュメントを突き合わせて AI(Anthropic Claude)が下書きし、運営者が数値と内容を確認したうえで掲載しています。 数値は掲載時点の公式資料にもとづきます。最新の条件は各社の公式ページをご確認ください。

主な一次情報(公式発表)を開く

スポンサーリンク

📊関連記事