Mihata
AI活用2026.09.23

Claude Opus 5.5の料金|$4/$20とキャッシュ$0.20

Claude Opus 5.5 の API 料金は、入力 100万トークンあたり $4、出力 $20、キャッシュ読み $0.20、キャッシュ書き $5 です(Anthropic 公式発表・2026年9月22日)。Opus 5 と比べるとトークン単価で約20%安く、Anthropic は「デフォルト設定・典型的なワークロードでは運用コストが40%安い」と明記しています。

単価が20%しか下がっていないのに総額が40%下がるのは、Opus 5.5 が同じ仕事を少ないトークンで終わらせるからです。この記事では、単価表を写すだけでなく、自社の月間トークン数から月額を出す計算式と、条件を変えた3ケースの試算を置きます。実務では「単価表を見て安くなったと思ったら請求は思ったほど下がらなかった」という順序で失敗しがちなので、キャッシュ読みの比率まで含めて見てください。

Opus 5.5 と Opus 5 の料金比較

100万トークンあたりの単価です。4つの単価のうち、下げ幅がいちばん大きいのはキャッシュ読みの -60% です。

区分

Opus 5.5

Opus 5

入力

$4

$5

-20%

出力

$20

$25

-20%

キャッシュ読み

$0.20

$0.50

-60%

キャッシュ書き

$5

$6.25

-20%

Fast mode(入力/出力)

$8/$40

最大2.5倍速

つまり長い文脈を毎回読み直す使い方ほど、値下げの恩恵が大きい構造です。社内ドキュメントやコードベースをまるごとプロンプトに入れて回しているなら、ここが効きます。モデルの位置づけや性能面の変化はClaude Opus 5.5 で何が変わったかをまとめた記事で、旧世代の Opus 5 の料金体系はClaude Opus 5 の料金と Opus 4.1 終了後の移行先で確認できます。

なぜ単価-20%なのに総額-40%なのか

答えは「消費トークンそのものが減るから」です。Anthropic は Opus 5.5 の実例として、20万行のコードベース監査を3時間未満で完了(Opus 5 は20時間超かかり、トークンも2.5倍消費)したケースと、HAProxy の C から Rust への移植を9.5時間で終え、コストが51%減ったケースを挙げています。

料金は「単価 × 消費トークン」の掛け算なので、単価が 0.8 倍、消費トークンが 0.75 倍なら総額は 0.6 倍= -40% になります。公式が言う「40%安い」はこの合算値であって、単価表だけから出てくる数字ではありません。

ここが実務上の注意点です。消費トークンが減るかどうかはタスクの性質に依存します。長い試行錯誤を伴うエージェント的な作業では効きますが、「短い文章を1回書かせる」ような定型処理では、トークン数はほぼ変わらないので値下げ幅は単価どおりの約20%に落ち着きます。自社がどちらに近いかで、期待値を変えてください。

Fast mode $8/$40 の損益分岐

Claude Code と Claude Platform では、最大2.5倍速で動く Fast mode が使えます。単価は入力 $8・出力 $40 で、通常のちょうど2倍です。

判断軸はシンプルで、「支払いは2倍、待ち時間は最短で4割」をどう評価するかだけです。同じ仕事に月 $200 かかっていて、待ち時間が月40時間あるなら、Fast mode は +$200 で待ち時間を16時間前後まで縮める買い物になります。1時間あたり約 $8(約1,200円)で時間を買う計算です。

  • 使う価値がある:人が結果を待って手が止まっている作業(対話的なコード修正、レビュー待ち、CI のブロッキング処理)
  • 使う価値が薄い:夜間バッチ、定期実行のエージェント、結果を翌朝見ればいい処理。ここに2倍を払っても誰の時間も浮きません

なお、出力生成そのものも Opus 5 比で30%以上高速化しているため、通常モードのままでも体感は変わります。Fast mode は「それでも足りない場面だけ」に絞るのが現実的です。

月額を出す計算式と試算3ケース

月額は次の式で出ます。単位は100万トークンです。

月額(USD)= 素の入力 × $4 + キャッシュ読み × $0.20 + キャッシュ書き × $5 + 出力 × $20

以下の3ケースはトークン量がすべて仮定の数字です(公式が出しているのは単価だけで、ワークロードの内訳は各社によって違います)。自社の実績トークンを入れて計算し直してください。ここで見てほしいのは金額そのものではなく、キャッシュ読みの比率で値下げ率が変わるという一点です。

ケース1:個人開発者(月 入力30M/出力2M)

内訳をキャッシュ読み21M・キャッシュ書き3M・素の入力6M・出力2M と仮定します。

  • Opus 5.5:21×0.2 + 3×5 + 6×4 + 2×20 = $83.2/月
  • Opus 5(同じトークン量):21×0.5 + 3×6.25 + 6×5 + 2×25 = $109.25/月
  • 差:-24%

ここに「消費トークンが2割減る」効果が乗ると $66.6/月となり、$109.25 に対して-39%。公式の「40%安い」に一致します。単価だけで -40% にはならない、という構造がここで見えます。

ケース2:5人の開発チーム(月 入力300M/出力20M)

ケース1を10倍した内訳(キャッシュ読み210M・書き30M・素60M・出力20M)です。

  • Opus 5.5:$832/月 / Opus 5(同トークン):$1,092.5/月 → -24%

比率が同じなので削減率も同じです。人数を増やしても値下げ率は変わりません。変わるのは次のケースのような使い方の違いのほうです。

ケース3:社内エージェント常時稼働(月 入力1,000M/出力40M)

大きな社内ナレッジを毎回読ませるため、キャッシュ読みの比率が高い想定です。キャッシュ読み900M・書き20M・素の入力80M・出力40M とします。

  • Opus 5.5:900×0.2 + 20×5 + 80×4 + 40×20 = $1,400/月
  • Opus 5(同トークン):900×0.5 + 20×6.25 + 80×5 + 40×25 = $1,975/月
  • 差:-29%(ケース1・2の -24% より大きい)

キャッシュ読みだけ -60% なので、入力トークンに占めるキャッシュ読みの比率が高いほど値下げ率が上がります。逆に言えば、プロンプトキャッシュを設計していない構成では、この値下げの一番おいしい部分を取り逃がします。月額を下げたいなら、モデルを替える前にキャッシュの効き方を見るほうが早いことが多いです。

私たちは AI の導入や社内エージェントの運用設計をお手伝いするサービスも行っております。記事の途中で恐縮ですが、こうした月額の内訳を一緒に棚卸しするところからお受けしていますので、よろしければ合わせてご覧いただけたら嬉しいです。

Pro/Max/Team/Enterprise はどう変わったか

サブスクリプション側は価格が下がったわけではありません。Anthropic が発表したのは次の2点です。

  • Pro / Max / Team / シート課金 Enterprise の5時間あたりの利用上限を引き上げ
  • サブスク利用者にレート制限リセットを付与(保存しておいて、必要なときに使える)

つまりサブスクでの「安くなった」は、同じ月額でより多く回せるようになった、という形で効いています。API の従量課金とは効き方が違うので、社内で説明するときは分けて伝えたほうが混乱しません。

GPT-6 Sol の $2/$10 との単価差

同じ日に OpenAI が発表した GPT-6 Sol は、入力 $2・出力 $10 で、Opus 5.5 のちょうど半分の単価です(OpenAI 公式)。単価表だけを並べれば GPT-6 Sol のほうが安く見えます。

ただし、両社が公表しているベンチマークはそれぞれ自社に有利な effort 条件で測った値で、同じ AutomationBench でも OpenAI の表では Claude Opus 5(max)が26.9%、Anthropic の表では Opus 5.5 が40.0%・GPT-6 Astra が41.4%と、並べ方が食い違います。どちらが上と断定できる材料ではありません。判断するなら、自社のタスクを両方で走らせて「1件あたりの総コスト」で比べるのが確実です。詳しい料金の内訳はGPT-6 Sol の料金を整理した記事にまとめています。

なお、Anthropic 自身も「この水準ではベンチの差が実世界の差の指標として信頼性が下がる」「自分たちの使用では Opus 5.5 と Fable 5.1 の差はスコアが示すより小さい」と書いています。同価格帯の比較はOpus 5.5 と Fable 5.1 の違いを、今後出るモデルの見通しは2026年後半に来る新モデルの一覧を参照してください。

まとめ

  • 単価は入力 $4/出力 $20/キャッシュ読み $0.20/キャッシュ書き $5。キャッシュ読みだけ -60%
  • 公式の「40%安い」は単価 -20% と消費トークン減の合算。定型処理なら削減は約20%にとどまる
  • 月額 = 素の入力×$4 + キャッシュ読み×$0.20 + キャッシュ書き×$5 + 出力×$20
  • キャッシュ読みの比率が高いほど値下げ率が上がる(試算では -24% → -29%)
  • Fast mode は単価2倍・最大2.5倍速。人が待っている作業だけに限定する

自社の月間トークンを入れて計算してみて、思ったより下がらない場合はモデルではなく構成側に原因があります。そのあたりの切り分けも含めてご相談いただければお手伝いできます。

よくある質問

Claude Opus 5.5 の API 料金はいくらですか?

100万トークンあたり入力 $4、出力 $20、キャッシュ読み $0.20、キャッシュ書き $5 です。Opus 5(入力 $5/出力 $25/キャッシュ読み $0.50/キャッシュ書き $6.25)と比べ、キャッシュ読みだけが -60%、その他は -20% です。

単価は20%しか下がっていないのに、なぜ40%安いと言われるのですか?

Opus 5.5 は同じ仕事を少ないトークンで終わらせるためです。公式は20万行のコードベース監査で Opus 5 の2.5分の1のトークン量だった例や、HAProxy の C→Rust 移植でコストが51%減った例を挙げています。料金は単価×消費トークンなので、両方が下がると総額は40%前後まで下がります。逆に短い定型処理では消費トークンが変わらないため、削減は単価どおりの約20%です。

Fast mode は使ったほうが得ですか?

入力 $8・出力 $40 で通常のちょうど2倍、速度は最大2.5倍です。人が結果を待って手が止まっている作業では割に合いますが、夜間バッチや定期実行のエージェントのように結果を後で見ればいい処理では、2倍を払っても誰の時間も浮かないので通常モードで十分です。

Pro や Max のサブスクは安くなりましたか?

料金は変わっていません。Pro / Max / Team / シート課金 Enterprise の5時間あたりの利用上限が引き上げられ、サブスク利用者にはレート制限リセットが付与されました。同じ月額でより多く回せるようになった、という形の改善です。

まずはお気軽にご相談ください

AI・IT・デザインに関するお悩みやご相談、お見積りのご依頼など、
どんなことでもお気軽にお問い合わせください。

お問い合わせ