Claude Code と Opus 5.5 節約術

要約
Claude Code の Opus 5.5 はターン数とキャッシュと出力で請求が決まる。effort は medium、進まなければ high、それでも2回失敗したら Fable 5.1。検索は Haiku か Sonnet に回す
意見はこのエリアに表示されます

Opus 5.5 の請求を減らすなら、ターン数を減らし、キャッシュを切らさないこと

これが節約術をまとめたチートシートだ(雑ですまん)

画像の説明を入れてください
Opus 5.5 節約のコツ

入力コストがいちばん動くのはキャッシュ

  • ターン数を減らすこと
  • キャッシュを切らさないこと

公式の試算では、同じタスクでも入力の料金がこれだけ変わる

  • キャッシュを使えない場合 $11.20
  • 入力の9割をキャッシュから読めた場合 $1.62

X で毎日 Claude Code 情報を配信してるコムテです

X に出した節約チートシート18項目を、Anthropic 公式ブログ(2026年9月22日、Addy Osmani)の記述に沿って説明する

金額はすべて原文が API 定価で組んだ試算例(キャッシュ書き込みは含まない)。自分の数字は /usage で確認する

前提 Opus 5.5 の単価

種類100万トークンあたりOpus 5 比
入力$420%安
出力$2020%安
キャッシュ読み取り$0.2060%安
  • 出力はキャッシュ読み取りの100倍
  • thinking(回答前の思考)も出力で課金
  • 1ターンごとに会話全体を送り直す
  • Pro、Max、Team の枠は Opus 5 より約25%長持ち

effort は普段 medium、進まなければ high

場面effort
範囲がはっきりした日常作業medium
medium で進まないhigh
リネーム、パターンの横展開low
  • 原文の試算 high で thinking が20K増えると約 $0.40
  • これはリトライ10ターン分(100K の会話、出力10K込み)とほぼ同額
  • リトライを1回防げれば元が取れる。medium で終わる作業なら損
  • Opus 5.5 の既定 effort は /effort status で確認する

単純作業は low、先にテストを用意

原文の表現は「a way to check its work」。確認できれば何でもいい

  • テスト
  • ビルド
  • エンドポイントを叩くスクリプト

effort を上げる前に確認手段を渡す。テスト1回は1ターン分とその出力で済むが、effort は毎ターンの思考を増やす

ターン数による差(20K から120K まで増えるタスク、キャッシュ90%)

ターン数入力の合計入力コスト
40約2.8M約$1.62
25約1.75M約$1.02

high で2回失敗したら Fable、解決したら Opus に戻す

原文の基準は「If Opus 5.5 on high hits the same problem twice, switch」。3回目は待たない

Fable 5.1Opus 5.5 比
入力$102.5倍
出力$502.5倍
キャッシュ読み取り$0.251.25倍
  • 差が小さいのはキャッシュ中心の長い実行
  • 差が大きいのは出力が多い作業
  • /model の選択は次のセッションの既定にも保存される。戻し忘れに注意
  • 切り替え直後の1ターンは会話全体をキャッシュに書き込む。先に /compact しておくと小さく済む

検索は Sonnet・Haiku、編集は Opus のまま

作業モデル
ファイル探し、ログ・テスト出力の読み取りSonnet か Haiku
コードを書くOpus 5.5
大量ファイルの機械的な編集Opus 5.5 の low
  • サブエージェントの定義に model: haikumodel: sonnet を書く
  • 一括で変えるなら環境変数 CLAUDE_CODE_SUBAGENT_MODEL
  • どちらも無いサブエージェントはメインのモデルで動く
  • 小さいモデルが読み違えると、寄り道はメインの単価で払う

v2.1.251 以降は、定義の model が環境変数より優先。それより前のバージョンでは環境変数が優先だった

API は5分空けると割高、サブスクは1時間

キャッシュの寿命

払い方寿命
API キー、クラウド経由5分(既定)
サブスク1時間
サブスクで usage credits を使用中5分

寿命を過ぎると、次のターンで会話全体を書き込み直す

  • 120K の会話で読み取り約 0.025分書き込み約0.02、5分書き込み約 0.60
  • 書き込み1回=読み取り25回分
  • 原文の例は6分のコーヒー休憩

キャッシュ率ごとの入力コスト(2.8M)

キャッシュ率入力コスト
0%$11.20
90%$1.62
96%約$0.99

チートシートの「サブスクは1時間で枠を消費」は書き方の誤り。正しくは「1時間を超えて空けると、書き込み直しで枠を使う」

モデル・effort は区切りで、MCP は抜き差ししない

キャッシュ書き込みが起きる場面(原文)

  • 寿命より長く止まる
  • effort や thinking の設定を変える
  • MCP サーバーをつなぐ、外す
  • モデルを切り替える
  • 会話が圧縮される

原文の方針は「セッション開始時に決めて、作業中は触らない」

  • 使わない MCP は /mcp で最初に切る
  • MCP のツール定義は既定で使うときに読み込まれる

別件は /clear、区切りで /compact

コマンドコスト使う場面
/clearなし関係ない作業に移る
/compact1リクエスト分作業の区切り
  • 150K で /compact すると約 $0.25
  • 以降1ターン約 $0.025 安くなり、約10ターンで回収
  • 終わる直前の圧縮は損
  • 残す内容は指定できる。例 /compact keep the failing test names and the schema change

CLAUDE.md は200行、詳細は別ファイルへ

  • 中身は毎ターン送られる
  • 公式の目安は200行未満(costs ドキュメント)

移す先で読み込みのタイミングが変わる

移す先読み込み
スキル本文は呼ばれたとき
paths 付きのルール一致するファイルを読んだとき
@path の import起動時

「詳細は別ファイルへ」は言葉足らず。@path で import したファイルは起動時に読み込まれるので節約にならない。移す先はスキルか paths 付きのルール

/usage で実測、prompt-audit で点検

タスクの終わりに見る場所(/cost でも同じ画面)

見る場所異常のサイン
キャッシュの割合低い → 長い停止、途中の変更
入力に対する出力小さな変更で多い → effort が高すぎる
会話サイズに対する入力合計何倍もある → ループしている
  • サブスクでは表示金額は請求ではなく作業量の目安
  • 基準値は開発者1人の稼働日あたり平均約 139013、90%が 30 未満(costs ドキュメント)

prompt-audit は /claude-api prompt-audit。スキルや CLAUDE.md にある古いモデル向けの指示を点検する

原文の検証(社内サポート用ベンチマーク44チケット)

変更コスト
Opus 4.8 → Opus 5.5(low)約18%減
さらに prompt-audit移行後からさらに9%減
合計約25%減

削られた指示は、必須の6ステップ手順、2回検証するルール、互いに矛盾する指示など。原文も1件のベンチの結果として扱っている

参考

Explore More
関連記事はありません。
Trends