Opus 5.5 の請求を減らすなら、ターン数を減らし、キャッシュを切らさないこと
これが節約術をまとめたチートシートだ(雑ですまん)

入力コストがいちばん動くのはキャッシュ
- ターン数を減らすこと
- キャッシュを切らさないこと
公式の試算では、同じタスクでも入力の料金がこれだけ変わる
- キャッシュを使えない場合
$11.20 - 入力の9割をキャッシュから読めた場合
$1.62
X で毎日 Claude Code 情報を配信してるコムテです
X に出した節約チートシート18項目を、Anthropic 公式ブログ(2026年9月22日、Addy Osmani)の記述に沿って説明する
金額はすべて原文が API 定価で組んだ試算例(キャッシュ書き込みは含まない)。自分の数字は /usage で確認する
前提 Opus 5.5 の単価
| 種類 | 100万トークンあたり | Opus 5 比 |
|---|---|---|
| 入力 | $4 | 20%安 |
| 出力 | $20 | 20%安 |
| キャッシュ読み取り | $0.20 | 60%安 |
- 出力はキャッシュ読み取りの100倍
- thinking(回答前の思考)も出力で課金
- 1ターンごとに会話全体を送り直す
- Pro、Max、Team の枠は Opus 5 より約25%長持ち
effort は普段 medium、進まなければ high
| 場面 | effort |
|---|---|
| 範囲がはっきりした日常作業 | medium |
| medium で進まない | high |
| リネーム、パターンの横展開 | low |
- 原文の試算 high で thinking が20K増えると約 $0.40
- これはリトライ10ターン分(100K の会話、出力10K込み)とほぼ同額
- リトライを1回防げれば元が取れる。medium で終わる作業なら損
- Opus 5.5 の既定 effort は
/effort statusで確認する
単純作業は low、先にテストを用意
原文の表現は「a way to check its work」。確認できれば何でもいい
- テスト
- ビルド
- エンドポイントを叩くスクリプト
effort を上げる前に確認手段を渡す。テスト1回は1ターン分とその出力で済むが、effort は毎ターンの思考を増やす
ターン数による差(20K から120K まで増えるタスク、キャッシュ90%)
| ターン数 | 入力の合計 | 入力コスト |
|---|---|---|
| 40 | 約2.8M | 約$1.62 |
| 25 | 約1.75M | 約$1.02 |
high で2回失敗したら Fable、解決したら Opus に戻す
原文の基準は「If Opus 5.5 on high hits the same problem twice, switch」。3回目は待たない
| Fable 5.1 | Opus 5.5 比 | |
|---|---|---|
| 入力 | $10 | 2.5倍 |
| 出力 | $50 | 2.5倍 |
| キャッシュ読み取り | $0.25 | 1.25倍 |
- 差が小さいのはキャッシュ中心の長い実行
- 差が大きいのは出力が多い作業
/modelの選択は次のセッションの既定にも保存される。戻し忘れに注意- 切り替え直後の1ターンは会話全体をキャッシュに書き込む。先に
/compactしておくと小さく済む
検索は Sonnet・Haiku、編集は Opus のまま
| 作業 | モデル |
|---|---|
| ファイル探し、ログ・テスト出力の読み取り | Sonnet か Haiku |
| コードを書く | Opus 5.5 |
| 大量ファイルの機械的な編集 | Opus 5.5 の low |
- サブエージェントの定義に
model: haikuかmodel: sonnetを書く - 一括で変えるなら環境変数
CLAUDE_CODE_SUBAGENT_MODEL - どちらも無いサブエージェントはメインのモデルで動く
- 小さいモデルが読み違えると、寄り道はメインの単価で払う
v2.1.251 以降は、定義の model が環境変数より優先。それより前のバージョンでは環境変数が優先だった
API は5分空けると割高、サブスクは1時間
キャッシュの寿命
| 払い方 | 寿命 |
|---|---|
| API キー、クラウド経由 | 5分(既定) |
| サブスク | 1時間 |
| サブスクで usage credits を使用中 | 5分 |
寿命を過ぎると、次のターンで会話全体を書き込み直す
- 120K の会話で読み取り約 0.60
- 書き込み1回=読み取り25回分
- 原文の例は6分のコーヒー休憩
キャッシュ率ごとの入力コスト(2.8M)
| キャッシュ率 | 入力コスト |
|---|---|
| 0% | $11.20 |
| 90% | $1.62 |
| 96% | 約$0.99 |
チートシートの「サブスクは1時間で枠を消費」は書き方の誤り。正しくは「1時間を超えて空けると、書き込み直しで枠を使う」
モデル・effort は区切りで、MCP は抜き差ししない
キャッシュ書き込みが起きる場面(原文)
- 寿命より長く止まる
- effort や thinking の設定を変える
- MCP サーバーをつなぐ、外す
- モデルを切り替える
- 会話が圧縮される
原文の方針は「セッション開始時に決めて、作業中は触らない」
- 使わない MCP は
/mcpで最初に切る - MCP のツール定義は既定で使うときに読み込まれる
別件は /clear、区切りで /compact
| コマンド | コスト | 使う場面 |
|---|---|---|
/clear | なし | 関係ない作業に移る |
/compact | 1リクエスト分 | 作業の区切り |
- 150K で
/compactすると約 $0.25 - 以降1ターン約 $0.025 安くなり、約10ターンで回収
- 終わる直前の圧縮は損
- 残す内容は指定できる。例
/compact keep the failing test names and the schema change
CLAUDE.md は200行、詳細は別ファイルへ
- 中身は毎ターン送られる
- 公式の目安は200行未満(costs ドキュメント)
移す先で読み込みのタイミングが変わる
| 移す先 | 読み込み |
|---|---|
| スキル | 本文は呼ばれたとき |
paths 付きのルール | 一致するファイルを読んだとき |
@path の import | 起動時 |
「詳細は別ファイルへ」は言葉足らず。@path で import したファイルは起動時に読み込まれるので節約にならない。移す先はスキルか paths 付きのルール
/usage で実測、prompt-audit で点検
タスクの終わりに見る場所(/cost でも同じ画面)
| 見る場所 | 異常のサイン |
|---|---|
| キャッシュの割合 | 低い → 長い停止、途中の変更 |
| 入力に対する出力 | 小さな変更で多い → effort が高すぎる |
| 会話サイズに対する入力合計 | 何倍もある → ループしている |
- サブスクでは表示金額は請求ではなく作業量の目安
- 基準値は開発者1人の稼働日あたり平均約 30 未満(costs ドキュメント)
prompt-audit は /claude-api prompt-audit。スキルや CLAUDE.md にある古いモデル向けの指示を点検する
原文の検証(社内サポート用ベンチマーク44チケット)
| 変更 | コスト |
|---|---|
| Opus 4.8 → Opus 5.5(low) | 約18%減 |
| さらに prompt-audit | 移行後からさらに9%減 |
| 合計 | 約25%減 |
削られた指示は、必須の6ステップ手順、2回検証するルール、互いに矛盾する指示など。原文も1件のベンチの結果として扱っている