Claude Sonnet 5.5 の価格表は、Sonnet 5 とまったく同じです。入力 $2、出力 $10(100万トークンあたり)。それなのに Anthropic は「1タスクあたり最大30%安い」と言っています。値下げしていないのに安くなる——この仕組みを理解しておかないと、自社の請求額がどう変わるかを見積もれません。
価格表:Sonnet 5 から1セントも変わっていない
100万トークンあたり | Claude Sonnet 5.5 | Claude Sonnet 5 | Claude Opus 5.5 |
|---|---|---|---|
入力 | $2 | $2 | $4 |
出力 | $10 | $10 | $20 |
キャッシュ読み | $0.20 | $0.20 | $0.20 |
キャッシュ書き込み | $2.50 | $2.50 | $5 |
Batch API を使えばここからさらに50%引きになります(Sonnet 5.5 なら入力$1・出力$5)。急がない処理をまとめて投げる構成なら、ここが最初に効きます。
単価が同じなのに安くなる理由
理由は1つだけです。同じ仕事を終えるのに使うトークンが減ったからです。請求額は「単価 × トークン数」なので、単価が動かなくてもトークン数が減れば総額は下がります。
これは希望的観測ではなく、第三者の実測が出ています。Slack のエンジニアはプロンプトを一切変えずに Sonnet 5 から入れ替えただけで、社内評価のほぼすべてでスコアが上がり、手数が減り、出力トークンが約14%減ったと述べています。Anthropic 自身の計測では、モデルはツール呼び出しをまとめて出すようになっており、それが手数と費用の削減につながっているとされています。
つまり、値下げの正体は「効率の改善」です。そして効率の改善は、価格表と違って自社のワークロードによって効き方が変わります。「最大30%」も「約14%」も他社の条件での数字なので、そのまま自社に当てはめてはいけません。
試算:自社の数字に置き換える
実務では次の式で見積もります。
月額(ドル)=(月間入力トークン ÷ 100万 × 入力単価)+(月間出力トークン ÷ 100万 × 出力単価)
キャッシュを使っている場合は、入力のうちキャッシュから読まれる分を $0.20 で計算し直します。例として、社内の問い合わせ対応ボットで月間の入力2億トークン・出力2,000万トークンを使っているケースを置きます。
構成 | 入力 | 出力 | 月額 |
|---|---|---|---|
Sonnet 5(現行) | 2億 × $2 = $400 | 2,000万 × $10 = $200 | $600 |
Sonnet 5.5(トークン15%減と仮定) | 1.7億 × $2 = $340 | 1,700万 × $10 = $170 | $510 |
Sonnet 5.5 + 入力の8割をキャッシュ読みに | 3,400万 × $2 + 1.36億 × $0.20 = $95.2 | $170 | $265 |
Opus 5.5 に上げた場合(トークン同条件) | 1.7億 × $4 = $680 | 1,700万 × $20 = $340 | $1,020 |
この表から読めることは3つあります。
- モデルを替えるだけの削減は15%前後。ここは「勝手に安くなる」ぶんで、作業は要りません
- キャッシュ設計のほうが効く。入力の8割をキャッシュから読ませると、モデル変更の効果より大きく下がります。長いシステムプロンプトや社内文書を毎回まるごと投げている構成ほど効きます
- Opus に上げると2倍前後になる。日常業務まで Opus で回している組織は、ここを Sonnet 5.5 に降ろすのが最短の削減策です
なお、この試算の「トークン15%減」は仮置きの数字です。自社で測るまでは、削減効果をゼロとして予算を組むのが安全です。
effort の既定値が請求額を左右する
見落とされがちですが、5.5世代では effort(思考の深さ)が費用に直結します。深く考えるほど長く動き、トークンを使い、1タスクあたりの費用が上がります。
既定値は次のとおりです。
- Claude API(Claude Platform):high
- Claude アプリ・Claude Code:medium
API で effort を指定していない場合、いちばん費用のかかりやすい設定に近いところで走っています。公式は「低い effort でも Sonnet 5 の最高スコアを、1タスクあたり10分の1程度の費用で超える評価がある」と書いています。定型処理は low か medium に落とすだけで、請求額が目に見えて変わる可能性があります。
ここは実装を1行変えるだけなので、移行のついでに必ず見てください。
自社の数字を測る手順
- 代表的なタスクを20〜50件集める:普段いちばん多い依頼の実データを使います
- Sonnet 5 で流し、入力/出力トークンと所要時間を記録する:現行の基準線になります
- Sonnet 5.5 で同じ入力を流す:effort を揃えるのを忘れずに
- 精度・トークン・時間の3つで比べる:安くなっても品質が落ちていれば意味がありません
- effort を1段下げて再測する:ここでいちばん削減余地が見つかります
作るのに半日かかりますが、この評価セットは以後すべての世代交代で使い回せます。Mihata では、こうした評価セットの設計とコスト試算を含む AI 導入の伴走支援を行っています。記事の途中で恐縮ですが、請求額に直接効く部分ですので、よろしければご覧ください。
見積もりのときに気をつけること
- 「最大30%」は上限であって平均ではない。公式表現は "up to 30% less" です
- Batch API の値引き(50%)と混同しない。他社の比較記事では、片方のバッチ料金と片方の通常料金を並べた誤りがよく起きます
- 移行作業のコストを忘れない。Sonnet 5 から Sonnet 5.5 へは400エラーになる破壊的変更が5点あり、人手の工数が発生します
- 退役の保証期限は2027年9月28日。公式一覧に「これより早くは廃止しない」と記載があります。1年は使える前提で投資判断ができます
モデル自体の変更点はClaude Sonnet 5.5 の提供開始まとめ、上位モデルとの振り分けはSonnet 5.5 と Opus 5.5 の使い分けをご覧ください。
自社の利用状況での試算をご希望でしたら、お気軽にご相談ください。
よくある質問
Claude Sonnet 5.5 の料金はいくらですか?
100万トークンあたり入力$2・出力$10です。キャッシュ読みが$0.20、キャッシュ書き込みが$2.50。Claude Sonnet 5 と同額で、値上げも値下げもされていません。Batch API を使うと入力$1・出力$5になります。
値段が同じなら、なぜ安くなるのですか?
同じ仕事を終えるのに使うトークンが減ったためです。請求額は単価×トークン数なので、単価が同じでもトークンが減れば総額は下がります。Anthropic は1タスクあたり最大30%安いとしており、Slack はプロンプトを変えずに入れ替えただけで出力トークンが約14%減ったと報告しています。
どのくらい安くなるか事前に分かりますか?
自社で測るまでは分かりません。公表されている削減率は他社の条件での数字です。予算を組む段階では削減効果をゼロとし、移行後に代表タスク20〜50件で実測してから見直すのが安全です。
いちばん効くコスト削減策は何ですか?
多くの場合、モデルの入れ替えよりキャッシュ設計と effort の見直しのほうが効きます。入力の大半をキャッシュ読み($0.20)にできれば入力費用は10分の1になり、定型処理の effort を high から low や medium に落とすだけでも1タスクあたりの費用が下がります。
Claude Sonnet 5.5 はいつまで使えますか?
公式のモデル廃止一覧には、claude-sonnet-5-5 の提供終了は2027年9月28日より早くは行わないと記載されています。少なくとも1年は使える前提で投資判断ができます。