GPT-6 Sol から GPT-6.1 Sol への移行で、入力・出力の単価は1円も下がりません。どちらも入力 $2・出力 $10(100万トークンあたり)です。安くなるのはキャッシュ読み込みだけで、$0.20 → $0.10 の半額。したがって「請求がどれだけ下がるか」はプロンプトキャッシュのヒット率でほぼ決まります。
この記事では、自社の月間トークン数から差額を出す計算式と、ヒット率の異なる3ケースの試算を置きます。数字を入れ替えるだけで自社の見込みが出せる形にしています。
単価表(一次ソースの値)
項目 | GPT-6 Sol | GPT-6.1 Sol | 差 |
|---|---|---|---|
入力(キャッシュ未ヒット) | $2.00 | $2.00 | ±0 |
キャッシュ読み込み | $0.20(入力の10%) | $0.10(入力の5%) | -50% |
キャッシュ書き込み | $2.50 | $2.50 | ±0 |
出力 | $10.00 | $10.00 | ±0 |
知識カットオフ | 2026年4月20日 | 2026年4月30日 | 10日新しい |
すべて100万トークンあたりの標準ティア価格です。Batch と Flex は標準より50%安く、Fast モードは2倍、リージョン指定は10%割増、入力が272Kを超えるリクエストは入力・キャッシュが2倍/出力が1.5倍になります。
計算式
月額は次の式で出ます。単位は「100万トークン」で揃えてください。
- 月額 = (未ヒット入力 × 入力単価) + (ヒット入力 × キャッシュ読み単価) + (キャッシュ書き込み × $2.50) + (出力 × $10)
- 移行による差額 = ヒット入力(100万トークン単位) × $0.10
2行目がこの移行の本質です。削減額は「キャッシュから読んだ入力トークン量 × $0.10」だけで、他の項はまったく動きません。逆に言えば、キャッシュを使っていない構成では月額はまったく変わりません。
3ケースの試算
前提を「月間の入力 2億トークン(200Mトークン)・出力 2,000万トークン(20Mトークン)」で固定し、キャッシュのヒット率だけを変えます。キャッシュ書き込みは入力の5%と仮定しました。
ケース | ヒット率 | GPT-6 Sol 月額 | GPT-6.1 Sol 月額 | 差額 |
|---|---|---|---|---|
A:キャッシュ未使用 | 0% | $600 | $600 | $0(0%) |
B:会話の前半を再利用 | 50% | $445 | $435 | -$10(-2.2%) |
C:長い前置きを毎回使う | 80% | $337 | $321 | -$16(-4.7%) |
内訳(ケースC):未ヒット入力 40M × $2 = $80、ヒット入力 160M × $0.10 = $16、キャッシュ書き込み 10M × $2.50 = $25、出力 20M × $10 = $200 → 合計 $321。GPT-6 Sol ならヒット入力が 160M × $0.20 = $32 なので $337。
ここが判断の勘所です。ヒット率80%というかなり有利な条件でも、削減率は5%弱。移行の理由を「コスト削減」に置くと期待外れになります。移行の本当の理由は、GPT-6 Sol が公式の料金ページと推奨モデル枠から外れたことです(後述)。
出力が重いワークロードでは差がさらに小さい
上の例では出力が $200 で全体の6割前後を占めています。出力単価は変わらないため、生成量が多いプロダクト(記事生成・長文要約)では削減率はさらに下がり、実質ゼロに近づきます。
逆に分類・抽出・判定のように「長い指示を毎回読ませて短く答える」タイプは削減率が最大になります。自社がどちらかを、まず請求の内訳(入力/キャッシュ/出力の比率)で確認してください。
それでも移行を計画すべき理由
2026年9月30日時点で Deprecations に gpt-6-sol の停止日はありません。すぐ止まるわけではないのは事実です。一方で、次の2つは確認済みの変化です。
- 料金ページの主要モデル表が
gpt-6-astra/gpt-6.1-sol/gpt-6-lunaの3行になり、gpt-6-solはページ内に1件も出てこない。 - モデル一覧の「まず使うべき3本」も Astra / GPT-6.1 Sol / Luna に入れ替わった。
過去の OpenAI の運用を見ると、料金ページと推奨枠から外れたモデルは、その後に廃止日が告知される流れが繰り返されています。実務の落としどころは「急いで切り替える必要はないが、移行できる状態は作っておく」です。
移行の手順とつまずきどころ
- モデルIDを
gpt-6.1-solに変える(ドットの位置に注意。gpt-6-1-solは存在しません)。 reasoning.effort: "none"を使っていたら書き換える。GPT-6.1 Sol はnoneとminimalをサポートしません(GPT-6 Sol は使えました)。既定はmediumです。- ツール呼び出しを Responses API に寄せる。Chat Completions はツールなしのみ対応です。
- 出力トークン数を移行前後で測る。
noneからlowへ変えると推論トークンが増えます。単価が同じでも総額は上がりえます。ここを測らずに移行すると「安くなるはずが高くなった」になります。 - EU データ所在地なら Fast モードを外す(EU では利用不可)。
4番が最大の罠です。この移行で単価は下がらないので、推論トークンが増えた分はそのまま請求増になります。移行の可否は「キャッシュ読みの $0.10 の削減」と「推論トークン増加分 × $10」の差引で決めてください。
切り分けの詳細は GPT-6.1 Sol が使えないときの原因7つ、Astra との比較は GPT-6.1 Sol と Astra の使い分け、モデル仕様の全体は GPT-6.1 Sol の料金・性能まとめにあります。キャッシュの効かせ方は GPT-6 のプロンプトキャッシュで入力代を削る方法もあわせてどうぞ。
私たちは中小企業向けに、API 利用料の内訳の可視化から運用設計までお手伝いしております。請求の内訳が読めないまま「高い」と感じている段階でしたら、そこから整えるのが早いことが多いです。よろしければご相談ください。
よくある質問
GPT-6 Sol から GPT-6.1 Sol に変えると安くなりますか?
入力$2・出力$10の単価は同額なので、安くなるのはキャッシュ読み込み($0.20→$0.10)の分だけです。キャッシュを使っていない構成では月額は変わりません。
どれくらい安くなりますか?
キャッシュのヒット率80%という有利な条件でも削減率は5%弱です。出力量が多いワークロードではさらに小さくなります。削減額はおおむね「キャッシュから読んだ入力トークン(100万単位)×$0.10」です。
GPT-6 Sol はいつ停止しますか?
2026年9月30日時点で公式のDeprecationsに停止日の行はありません。ただし料金ページと推奨モデル枠から外れているため、移行できる状態は作っておくのが安全です。
移行で気をつけることは何ですか?
reasoning.effortのnoneとminimalが非対応になる点、ツール呼び出しはResponses APIに寄せる点、そしてnoneからlowへ変えると推論トークンが増えて総額が上がりうる点です。
272Kを超えるプロンプトの料金はどうなりますか?
入力が272Kトークンを超えるリクエストは、そのリクエスト全体で入力とキャッシュが2倍、出力が1.5倍になります。GPT-6.1 Solでは入力$4・キャッシュ読み$0.20・出力$15です。