Grok 4.7 の API 料金は、入力 $2.00 / キャッシュ入力 $0.50 / 出力 $6.00(いずれも100万トークンあたり)です。ただしこれはプロンプトが20万トークン未満のときの値で、20万トークンを超えると入力 $4.00 / キャッシュ $1.00 / 出力 $12.00に切り替わります。Grok 4.6 から単価は据え置きです。
単価表を眺めるだけでは社内の稟議は通りません。この記事では「自社の月間トークン数を入れれば月額が出る式」と、業務別の3ケースの試算、そして見積もりを外す5つの落とし穴を書きます。数字はすべて xAI(SpaceXAI)の公式ドキュメントで確認したものです。
公式の単価表(2026年9月21日時点)
区分 | 入力 | キャッシュ入力 | 出力 |
|---|---|---|---|
短コンテキスト(プロンプト20万トークン未満) | $2.00 | $0.50 | $6.00 |
長コンテキスト(20万トークン以上) | $4.00 | $1.00 | $12.00 |
いずれも100万トークンあたり・米ドルです。コンテキスト長の上限は50万トークンです。参考までに、Grok Build 専用の軽量モデル grok-build-0.1 は入力 $1.00 / 出力 $2.00(20万トークン未満)で、こちらはコンテキスト25.6万トークンです。用途が単純な処理なら、こちらに寄せるだけで半分以下になります。
他社の最新モデルとの単価比較
Grok 4.7 の公式ブログが自ら並べている比較です。同じ土俵で見ると、単価の桁が違います。
モデル | 入力(100万トークン) | 出力(100万トークン) |
|---|---|---|
Grok 4.7 | $2 | $6 |
Grok 4.6 | $2 | $6 |
GPT-5.6 Sol Max | $4 | $20 |
Fable 5.1 Max | $10 | $50 |
出力側で見ると、Grok 4.7 は GPT-5.6 Sol Max の約3分の1、Fable 5.1 Max の約12分の1です。ただし安いモデルで何度もやり直すと、高いモデルで一発で通すより高くつくことがあります。単価だけでは判断できないので、次の試算式で「自社の実際の使い方」に落としてください。
月額を出す計算式
使う数字は3つだけです。月間の入力トークン数、そのうちキャッシュから読めた割合、月間の出力トークン数です。
月額(ドル)=
(月間入力トークン ÷ 1,000,000)×(1 − キャッシュ率)× 2
+(月間入力トークン ÷ 1,000,000)× キャッシュ率 × 0.5
+(月間出力トークン ÷ 1,000,000)× 6
プロンプトが20万トークンを超える処理が混じる場合は、その分だけ単価を2倍にして別に計算し、足してください(後述の落とし穴①)。
トークン数の当たりの付け方
「自社の月間トークン数なんて分からない」という段階なら、次の換算で十分に見積もれます。日本語はモデルによって差がありますが、社内の見積もりを作る目的では以下で足ります。
- 日本語1文字 ≒ 1トークン(多少多めに出る前提で、1.2倍しておくと安全)
- A4の文書1枚 ≒ 1,500トークン(日本語1,200字程度)
- 1時間の会議の文字起こし ≒ 15,000〜20,000トークン
- チャット1往復(質問+回答)≒ 入力800トークン・出力600トークン(社内FAQ用途の目安)
業務別の試算3ケース
以下はすべて「短コンテキスト(20万トークン未満)」の単価で計算しています。円換算は為替で動くので、ここでは1ドル=150円と置いた場合の目安を併記します。実際の稟議では経理の基準レートを当ててください。
ケース1:社内問い合わせチャット(従業員50人・1人1日2往復)
項目 | 計算 |
|---|---|
月間の往復数 | 50人 × 2往復 × 20営業日 = 2,000往復 |
入力トークン | 2,000 × 800 = 160万トークン |
出力トークン | 2,000 × 600 = 120万トークン |
入力の費用(キャッシュ率0%) | 1.6 × $2 = $3.20 |
出力の費用 | 1.2 × $6 = $7.20 |
月額合計 | $10.40(約1,560円) |
この規模なら、API 料金は実質的に誤差です。社内チャットの導入を止める理由がコストであることは、まずありません。止まるのはたいてい「どの資料を読ませるか」「誰が運用するか」のほうです。
ケース2:議事録の要約(週10本・1本1時間)
項目 | 計算 |
|---|---|
月間の本数 | 週10本 × 4.3週 = 約43本 |
入力トークン | 43 × 18,000 = 約77万トークン |
出力トークン | 43 × 2,000 = 約9万トークン |
入力の費用 | 0.77 × $2 = $1.54 |
出力の費用 | 0.09 × $6 = $0.54 |
月額合計 | $2.08(約310円) |
1時間の会議1本あたり約7円です。文字起こしそのものの費用は別に見る必要があります。xAI の音声認識(Speech to Text)は $0.10/時(REST)・$0.20/時(ストリーミング)なので、43本なら $4.30〜$8.60 が上乗せになります。つまりこの用途では要約より文字起こしのほうが高いという逆転が起きます。
ケース3:コーディングエージェントを常用(開発者3人)
ここだけは桁が変わります。エージェント型の使い方は、1タスクのなかで何十回もモデルを呼び、そのたびに履歴を丸ごと送り直すためです。
項目 | 計算 |
|---|---|
1人1日の入力トークン(履歴の再送込み) | 約800万トークン |
1人1日の出力トークン | 約20万トークン |
月間(3人 × 20営業日) | 入力 4.8億トークン/出力 1,200万トークン |
入力の費用(キャッシュ率0%の場合) | 480 × $2 = $960 |
入力の費用(キャッシュ率80%の場合) | 480 ×0.2× $2 + 480 ×0.8× $0.5 = $384 |
出力の費用 | 12 × $6 = $72 |
月額合計 | $456〜$1,032(約6.8万〜15.5万円) |
注目していただきたいのは、キャッシュが効くかどうかで金額が2倍以上変わる点です。キャッシュ入力の単価は $0.50 で、通常入力の4分の1。エージェント用途では入力トークンが費用の9割以上を占めるので、キャッシュヒット率が実質的な請求額を決めます。次章の落とし穴②がここに直結します。
見積もりを外す5つの落とし穴
① 20万トークンを超えると、全トークンが倍の単価になる
公式ドキュメントは「長コンテキスト価格が適用されるモデルでは、プロンプトがモデルの長コンテキスト閾値に達した時点で、そのリクエストのすべてのトークンが長コンテキスト料金で課金される」と明記しています。「20万トークンを超えた分だけ高い」のではなく、「超えたリクエストは丸ごと2倍」です。19.9万トークンと20.1万トークンでは請求が倍違います。長い資料を丸ごと投げる設計にしているなら、ここが最大の変動要因です。
② prompt_cache_key を設定しないとキャッシュが効かない
公式は「prompt_cache_key を設定することを強く推奨する」(Chat Completions では x-grok-conv-id ヘッダ)としたうえで、「設定しないと、キャッシュが冷えたサーバーに振られて入力の全額を払うことがよくある」と書いています。ケース3で見たとおり、ここが効くかどうかで月額が2倍以上変わります。実装時に1行入れるだけの話なので、見積もりの前に必ず確認してください。
③ US リージョンを使うと10%高い
米国内で推論を完結させる US リージョンエンドポイント(us.api.x.ai)は、トークン課金がグローバル料金の1.1倍です。データの所在地要件があって選ぶケースがありますが、見積もりに1.1を掛け忘れがちです。
④ 検索ツールを有効にすると、トークン代とは別に課金される
Grok 4.7 の知識カットオフは2026年5月で、公式も「検索ツールを有効にしない限りリアルタイムの出来事にはアクセスできない」としています。最新情報を扱うために Web Search / X Search を有効にすると、トークン課金とは別に、ツール呼び出しの課金が乗ります。しかもX Search は2026年9月21日(米国太平洋時間12:00)から課金方式が変わり、「1,000コールあたり$5」から「取得した投稿1,000件あたり$5・ユーザープロフィール1,000件あたり$10」になりました。1回の検索で何十件も返るので、コール単位で見積もっていた方は必ず計算し直してください。
⑤ Grok 4.7 Fast は2倍の単価で、しかも公開APIでは使えない
高速版の Grok 4.7 Fast は、同じモデルを速いインフラで提供するもので標準の2倍の単価です。そして提供は Cursor と Grok Build に限られ、公開の xAI API では使えません(Grok Build の無料枠にも含まれません)。Grok 4.6 の高速版を API で使っていたチームは、この前提が変わっています。
コストの見積もりまでは自力で作れても、「どの業務から入れると回収できるか」は社内だけだと決めにくい部分です。Mihata では中小企業のAI導入を月1回のミーティングで伴走する形の支援もしています。記事の途中で恐縮ですが、よろしければあわせてご覧いただけたら嬉しいです。
請求額を下げる打ち手(効く順)
- prompt_cache_key を必ず設定する。エージェント用途なら、これだけで入力費用が半分以下になり得ます
- 1リクエストを20万トークン未満に保つ設計にする。長い資料は分割するか、検索で必要な部分だけ渡す形に変える。閾値を1トークンでも超えたら全体が倍です
- 長いエージェントループにはコンテキスト圧縮を使う。公式も長いループでの context compaction を勧めています
- 単純な処理は grok-build-0.1 に落とす。入力$1/出力$2 なので、分類・抽出のような定型処理は半額以下になります
- 推論の強さを下げる。low / medium / high / xhigh の4段階があり、既定は high。出力の質が変わらない処理なら medium に落とすだけで出力トークンが減ります
まとめ
- Grok 4.7 の単価は入力 $2 / キャッシュ $0.50 / 出力 $6(20万トークン未満)。20万トークン以上はすべて倍
- Grok 4.6 から据え置き。モデルIDを差し替えてもコストは変わらない
- 社内チャットや議事録要約の規模なら月額は数ドル。コストが導入の障害になることはまずない
- コーディングエージェント用途は月数百〜千ドル規模になり、キャッシュヒット率で金額が2倍以上動く
- 見積もりを外す主因は20万トークンの閾値・キャッシュキー未設定・検索ツールの呼び出し課金の3つ
関連記事として、Grok 4.7 と Grok 4.6 をベンチ7項目で比べた記事、Grok 4.7 が使えないときに確認する7点、Grok 5 の現在地と 4.x のリリース間隔もあわせてご覧ください。ひとつ前の世代の料金体系はGrok 4.6 の料金と50万トークンの解説にあります。
自社の使い方に当てはめた試算や、どの業務から着手するかのご相談は、下記からお気軽にどうぞ。
よくある質問
Grok 4.7のAPI料金はいくらですか?
プロンプトが20万トークン未満なら、100万トークンあたり入力2ドル・キャッシュ入力0.5ドル・出力6ドルです。20万トークン以上になると入力4ドル・キャッシュ1ドル・出力12ドルに切り替わります。Grok 4.6から単価は据え置きです。
20万トークンを超えると超えた分だけ高くなるのですか?
いいえ、リクエスト全体が高い単価になります。公式ドキュメントは、プロンプトが長コンテキストの閾値に達した時点でそのリクエストのすべてのトークンが長コンテキスト料金で課金されると明記しています。19.9万トークンと20.1万トークンでは請求が倍違います。
社内チャットに使うと月いくらぐらいですか?
従業員50人が1人1日2往復する規模(1往復あたり入力800トークン・出力600トークン、月20営業日)で計算すると、入力160万トークン・出力120万トークンとなり月額は約10.4ドルです。1ドル150円換算で約1,560円で、コストが導入の障害になることはまずありません。
コーディングエージェントで使うといくらかかりますか?
開発者3人が常用する想定(1人1日あたり入力800万トークン・出力20万トークン、月20営業日)で、キャッシュが効かなければ月約1,032ドル、キャッシュヒット率80%なら月約456ドルです。キャッシュ入力の単価が0.5ドルと通常の4分の1なので、prompt_cache_keyを設定しているかで金額が2倍以上変わります。
Grok 4.7 Fastは公開APIで使えますか?
使えません。Grok 4.7 Fastは同じモデルを速いインフラで提供するもので標準の2倍の単価ですが、提供はCursorとGrok Buildに限られ、公開のxAI APIでは提供されていません。Grok Buildの無料枠にも含まれません。
検索ツールを使うと追加費用がかかりますか?
かかります。トークン課金とは別にツール呼び出しの課金が乗ります。X Searchは2026年9月21日(米国太平洋時間12時)から課金方式が変わり、1,000コールあたり5ドルから、取得した投稿1,000件あたり5ドル・ユーザープロフィール1,000件あたり10ドルになりました。