料金(2026年9月21日公開時点)
docs.x.ai のAPI料金表で確認。全額USD/1Mトークン。標準料金はGrok 4.6と同額で据え置き。「キャッシュ入力」は同じプロンプトを再送したときにキャッシュから読み出す分の割安単価です(プロンプトキャッシュの解説)。
| ティア | 入力 | キャッシュ入力 | 出力 | 備考 |
|---|---|---|---|---|
| Standard(ショート <200K) | $2.00 | $0.50 | $6.00 | デフォルト料金。Grok 4.6と同額 |
| Long context(200K超) | $4.00 | $1.00 | $12.00 | 200K超でリクエスト全体に適用 |
高速版 Grok 4.7 Fast(Cursor / Grok Build 限定。同じGrok 4.7を高速インフラで提供するもので、標準の2倍のトークン単価)
| プロンプト長 | 入力 | キャッシュ入力 | 出力 |
|---|---|---|---|
| 200K未満 | $4.00 | $1.00 | $12.00 |
| 200K超 | $6.00 | $1.50 | $18.00 |
※ 区切りは公式表記(below 200k / above 200k)に従い「200K未満 / 200K超」と表記しています。ちょうど200Kトークンの扱いは docs.x.ai の料金表をご確認ください。
一次情報: docs.x.ai/developers/pricing(Last updated: September 21, 2026)· docs.x.ai Grok 4.7 · x.ai/news/grok-4-7(2026-09-23確認)
コスト計算例(標準ティア・USD)
入力単価 × 入力トークン数 + 出力単価 × 出力トークン数。長文条件(200K超)に入るとリクエスト全体の単価が切り替わります。
| ケース | 入力トークン | 出力トークン | 想定コスト(USD) |
|---|---|---|---|
| 短文のやり取り | 100,000 | 10,000 | $0.26 |
| 同じ入力の8割をキャッシュ | 100,000(うち80,000がcache hit) | 10,000 | $0.14 |
| 200Kちょうど(境界) | 200,000 | 20,000 | $0.52 → 長文適用なら $1.04 |
| 長文コンテキスト(200K超) | 250,000 | 20,000 | $1.24 |
※ いずれもキャッシュ書込料金・サーバーサイドツール・リージョン係数(米国は1.1倍)を含まない素の計算です。実トークン数での試算はトークン計算機をご利用ください。
モデル仕様
出典: docs.x.ai Grok 4.7 · xAI公式発表。xAIは「ベースモデルをGrok 4.6より大型化し、自己検証と長いコンテキストの扱いが向上した」と説明しています。なお x.ai / docs.x.ai のサイト表示は2026-09-23時点で「SpaceXAI」となっています(社名変更の一次確認は未了のため、本ページでは提供元をxAIと表記)。
性能 — 公式ベンチマーク7項目すべてでGrok 4.6を上回る
xAI公式発表のベンチマーク表より。数値はGrok 4.7・Grok 4.6・GPT-5.6 Sol・Fable 5.1(Anthropic)の4モデル。各社公表値であり、テスト条件が同一とは限りません。
| ベンチマーク(領域) | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol | Fable 5.1 | ひとこと |
|---|---|---|---|---|---|
| CursorBench 4.0(SWE) | 46.3% | 40.4% | 41.7% | 51.8% | 前世代から+5.9pt |
| DeepSWE v1.1(長時間SWE) | 71.0%* | 65.2% | 72.7% | 70.0% | 4モデル中2位(*はhigh effort) |
| EEBench(電気工学) | 64.0% | 53.0% | 39.4% | 56.4% | 4モデル中トップ |
| AA Briefcase v1.1(長時間オフィス作業・Elo) | 1,657 | 1,546 | 1,487 | 1,678 | Fable 5.1がわずかに上 |
| Terminal-Bench 4.0(ターミナル作業) | 37.6% | 20.3% | 37.3% | 57.9% | 前世代比 約1.9倍 |
| Harvey Legal Agent Benchmark(法務) | 19.6% | 15.8% | 2.5% | 6.7% | 4モデル中トップ(GPT-5.6 Solの約7.8倍) |
| HealthBench Professional(臨床推論) | 56.7% | 48.5% | 60.5% | 62.1% | 4モデル中3位 |
※ 太字=4モデル中トップ。「winner」表示は各ベンチマークの最高値。DeepSWE v1.1はDatacurve運営の長時間ソフトウェアエンジニアリング・ベンチマーク(113タスク / 5言語)です。
- GDPval(Elo): Grok 4.7 (xhigh) 1,695 — Fable 5.1 (max) 1,735、Grok 4.6 (high) 1,605、GPT-6 Astra (max) 1,542。前世代から+90で、文書・プレゼン作成が改善(xAI公式の比較図より)。
- 価格は据え置き: 入力$2 / 出力$6(xHigh)で、比較表上はGrok 4.6(High)と同額。GPT-5.6 Sol Maxは$4/$20、Fable 5.1 Maxは$10/$50(xAI掲載の比較表)。
- まとめ: 「前世代から全項目改善、価格は同じ」が公式の主張。ただし4モデル比較ではFable 5.1が7項目中3項目、GPT-5.6 Solが1項目で上回り、首位とは言い切れません。
出典: xAI: Introducing Grok 4.7(ベンチマーク表・GDPval図)
第三者評価 — 「安いが、フロンティア最前線ではない」
xAIの主張と第三者計測のズレも、判断材料として併記します。
- 総合知能指数では中位: 人工分析(Artificial Analysis)の Intelligence Index で Grok 4.7 は46。Claude Fable 5.1 と GPT-6 がそれぞれ53で、差があるとの報道(the-decoder, 2026-09-21)。エージェント型コーディングでは差がさらに広がるとされます。
- トークン消費が総コストを膨らませる可能性: VentureBeat は「トークン単価が安くても、同じ仕事を終えるのに推論トークンを大幅に多く消費するなら、完成ワークロードのコストはむしろ高くなる」と指摘(2026-09-21)。単価だけでなく実測トークン量での比較が必要です。
- 配布チャネルは広い: 2026-09-21からGitHub Copilotでも順次利用可能(VS Code / JetBrains / Xcode等)。API・Cursor・Grok Build・サードパーティのコーディングハーネス・モデルルーター・クラウド経由で提供。
出典: the-decoder · VentureBeat · GitHub Changelog(いずれも2026-09-23確認)。第三者の数値は各社の測定条件に依存します。
前世代・競合との比較
xAI掲載の比較表より。推論エフォート設定がモデルごとに異なるため、単純な同条件比較ではない点に留意してください。
| モデル | 設定 | 入力 | 出力 | Grok 4.7より |
|---|---|---|---|---|
| Grok 4.7 | xHigh | $2.00 | $6.00 | —(基準) |
| Grok 4.6 | High | $2.00 | $6.00 | 同額 |
| GPT-5.6 Sol | Max | $4.00 | $20.00 | Grok安(入力半額・出力70%安) |
| Claude Fable 5.1 | Max | $10.00 | $50.00 | Grok安(入力1/5・出力約1/8) |
※ 上表はxAI公式発表の比較図に基づく料金です。最高推論エフォート同士の比較であり、当サイトが各社公式ページで独自に確認した標準料金とは設定が異なる場合があります。全モデルの標準料金は料金比較ページをご参照ください。
出典: xAI: Introducing Grok 4.7 · 各社公式料金は料金比較(2026-09-23時点)
ベンチマーク上で強みが出ている用途
コーディング・エージェント・専門ドメインを中心に。
コーディング・コードレビュー
CursorBench 4.0で46.3%(前世代比+5.9pt)。Cursor本体とGrok Buildで公開当日から利用可能。
長時間ターミナル作業
Terminal-Bench 4.0が20.3%→37.6%(約1.9倍)へ大幅上昇。多段シェル操作の自動化。
法務・専門ドメイン
Harvey Legal Agent Benchmark 19.6%で比較4モデル中トップ。専門領域のエージェント業務。
電気工学・ハードウェア寄り設計
EEBench 64.0%で比較4モデル中トップ。
文書・プレゼン作成
AA Briefcase 1,657、GDPval Elo 1,695。専門職の成果物作成タスク。
長文コンテキスト処理
500Kコンテキスト。ただし200K超で単価が倍になるため、長さとコストのトレードオフ管理が前提。
Grok 4.7が向いている場面 / 向いていない場面
- 単価重視のフロンティア帯なら有力: 入力$2 / 出力$6は、GPT-5.6 SolやFable 5.1(最高エフォート)と比べて明確に安価。xAIは「同種モデルの2倍速く半額」と主張しています。
- 総コストは実測トークンで判断: 推論を多く使う設定(既定high〜xhigh)では出力トークンが増え、単価差が縮まります。
reasoning_effortをタスク難易度に合わせて下げるのが基本。 - 200Kの壁に注意: 長文コンテキストを使うなら$4/$12(Fast時は$6/$1.50/$18)。キャッシュ入力($0.50)の活用が実質コスト削減の要。
- Batch 20%割引は対象外: 大量バッチ処理が目的ならGrok 4.6も同様に対象外で、対象はgrok-4.3 / grok-4.20系のみです。
- 最高性能が必要なら: 掲載した Artificial Analysis Intelligence Index では Claude Fable 5.1 と GPT-6(いずれも53)が Grok 4.7(46)を上回ります。精度が最優先なら上位モデルとの使い分けを。
⚠️ 免責事項
- 料金はdocs.x.ai公式ページを2026-09-23に確認したものです。予告なく変動します。契約前に必ず公式ページをご確認ください。
- 本サイトは情報提供目的であり、特定プロバイダーの推薦・代理ではありません。
- ベンチマーク数値はxAIの公表値であり、実際の使用感を保証するものではありません。第三者の数値は各社の測定条件に依存します。