🚀 2026年9月21日公開 — 標準 $2/$6 据え置き・Fastは2倍

Grok 4.7

xAI(x.ai)の最新フラッグシップ。ベースモデルを大型化しつつ、料金は前世代Grok 4.6と同額の$2/$6を維持。xAI公式ベンチマーク7項目すべてでGrok 4.6を上回り、EEBenchとHarvey Legal Agent Benchmarkでは比較4モデル中トップ。

$2.00
入力 / 1M tokens
$6.00
出力 / 1M tokens
500K
コンテキストウィンドウ
Text+Image
入力モダリティ
●最終更新: | 出典: x.ai公式発表 · docs.x.ai モデル仕様 · docs.x.ai 料金表 | 料金比較 · 計算機 · Grok 4.6

料金(2026年9月21日公開時点)

docs.x.ai のAPI料金表で確認。全額USD/1Mトークン。標準料金はGrok 4.6と同額で据え置き。「キャッシュ入力」は同じプロンプトを再送したときにキャッシュから読み出す分の割安単価です(プロンプトキャッシュの解説)。

ティア入力キャッシュ入力出力備考
Standard(ショート <200K)$2.00$0.50$6.00デフォルト料金。Grok 4.6と同額
Long context(200K超)$4.00$1.00$12.00200K超でリクエスト全体に適用

高速版 Grok 4.7 Fast(Cursor / Grok Build 限定。同じGrok 4.7を高速インフラで提供するもので、標準の2倍のトークン単価)

プロンプト長入力キャッシュ入力出力
200K未満$4.00$1.00$12.00
200K超$6.00$1.50$18.00

※ 区切りは公式表記(below 200k / above 200k)に従い「200K未満 / 200K超」と表記しています。ちょうど200Kトークンの扱いは docs.x.ai の料金表をご確認ください。

⚠️ 200Kトークンの長文境界: プロンプトが200Kトークンに達すると、そのリクエストの全トークンに長文料金($4/$12)が適用されます(docs.x.ai に明記)。エージェントループでツール出力が積み重なるワークロードは、この境界を越えると請求が急増するため注意。
💡 実質コストを左右する3点: ①キャッシュ入力は$0.50(標準入力の75%割引)で、同じシステムプロンプト・リポジトリ文脈を再送する構成では請求額を大きく左右します。②Batch API割引(20%)はgrok-4.3 / grok-4.20系のみが対象で、grok-4.7は対象外(docs.x.ai の Batch discount 表で確認)。大量のバッチ処理が目的なら対象モデルとの比較を。③米国リージョナルエンドポイント(us.api.x.ai)は全トークン単価が1.1倍で、grok-4.7では200K未満 $2.20/$0.55/$6.60、200K超 $4.40/$1.10/$13.20。
🧩 サーバーサイドツールは別課金(docs.x.ai 料金表): web_search $5 / 1k calls、x_search $5 / 1k posts・$10 / 1k profiles、code_execution $5 / 1k calls、attachment_search $10 / 1k calls、collections_search(file_search)$2.50 / 1k calls。ファイル保管 $0.025/GiB/日、コレクション保管 $0.10/GiB/日、ダウンロード $0.20/GiB。

一次情報: docs.x.ai/developers/pricing(Last updated: September 21, 2026)· docs.x.ai Grok 4.7 · x.ai/news/grok-4-7(2026-09-23確認)

コスト計算例(標準ティア・USD)

入力単価 × 入力トークン数 + 出力単価 × 出力トークン数。長文条件(200K超)に入るとリクエスト全体の単価が切り替わります。

ケース入力トークン出力トークン想定コスト(USD)
短文のやり取り100,00010,000$0.26
同じ入力の8割をキャッシュ100,000(うち80,000がcache hit)10,000$0.14
200Kちょうど(境界)200,00020,000$0.52 → 長文適用なら $1.04
長文コンテキスト(200K超)250,00020,000$1.24

※ いずれもキャッシュ書込料金・サーバーサイドツール・リージョン係数(米国は1.1倍)を含まない素の計算です。実トークン数での試算はトークン計算機をご利用ください。

モデル仕様

GA公開
2026-09-21
知識カットオフ
2026年5月
コンテキスト
500,000 tokens
長文料金の境界
200,000 tokens
入力モダリティ
テキスト + 画像
出力モダリティ
テキスト
推論エフォート
low / medium / high / xhigh(xhighが最も深く思考)
既定のエフォート
high
ツール呼び出し
Function Calling ✓
構造化出力
対応
リージョン
us-east-1(+米国リージョナル)
モデルID
grok-4.7

出典: docs.x.ai Grok 4.7 · xAI公式発表。xAIは「ベースモデルをGrok 4.6より大型化し、自己検証と長いコンテキストの扱いが向上した」と説明しています。なお x.ai / docs.x.ai のサイト表示は2026-09-23時点で「SpaceXAI」となっています(社名変更の一次確認は未了のため、本ページでは提供元をxAIと表記)。

性能 — 公式ベンチマーク7項目すべてでGrok 4.6を上回る

xAI公式発表のベンチマーク表より。数値はGrok 4.7・Grok 4.6・GPT-5.6 Sol・Fable 5.1(Anthropic)の4モデル。各社公表値であり、テスト条件が同一とは限りません。

ベンチマーク(領域)Grok 4.7Grok 4.6GPT-5.6 SolFable 5.1ひとこと
CursorBench 4.0(SWE)46.3%40.4%41.7%51.8%前世代から+5.9pt
DeepSWE v1.1(長時間SWE)71.0%*65.2%72.7%70.0%4モデル中2位(*はhigh effort)
EEBench(電気工学)64.0%53.0%39.4%56.4%4モデル中トップ
AA Briefcase v1.1(長時間オフィス作業・Elo)1,6571,5461,4871,678Fable 5.1がわずかに上
Terminal-Bench 4.0(ターミナル作業)37.6%20.3%37.3%57.9%前世代比 約1.9倍
Harvey Legal Agent Benchmark(法務)19.6%15.8%2.5%6.7%4モデル中トップ(GPT-5.6 Solの約7.8倍)
HealthBench Professional(臨床推論)56.7%48.5%60.5%62.1%4モデル中3位

※ 太字=4モデル中トップ。「winner」表示は各ベンチマークの最高値。DeepSWE v1.1はDatacurve運営の長時間ソフトウェアエンジニアリング・ベンチマーク(113タスク / 5言語)です。

  • GDPval(Elo): Grok 4.7 (xhigh) 1,695 — Fable 5.1 (max) 1,735、Grok 4.6 (high) 1,605、GPT-6 Astra (max) 1,542。前世代から+90で、文書・プレゼン作成が改善(xAI公式の比較図より)。
  • 価格は据え置き: 入力$2 / 出力$6(xHigh)で、比較表上はGrok 4.6(High)と同額。GPT-5.6 Sol Maxは$4/$20、Fable 5.1 Maxは$10/$50(xAI掲載の比較表)。
  • まとめ: 「前世代から全項目改善、価格は同じ」が公式の主張。ただし4モデル比較ではFable 5.1が7項目中3項目、GPT-5.6 Solが1項目で上回り、首位とは言い切れません。

出典: xAI: Introducing Grok 4.7(ベンチマーク表・GDPval図)

第三者評価 — 「安いが、フロンティア最前線ではない」

xAIの主張と第三者計測のズレも、判断材料として併記します。

  • 総合知能指数では中位: 人工分析(Artificial Analysis)の Intelligence Index で Grok 4.7 は46。Claude Fable 5.1 と GPT-6 がそれぞれ53で、差があるとの報道(the-decoder, 2026-09-21)。エージェント型コーディングでは差がさらに広がるとされます。
  • トークン消費が総コストを膨らませる可能性: VentureBeat は「トークン単価が安くても、同じ仕事を終えるのに推論トークンを大幅に多く消費するなら、完成ワークロードのコストはむしろ高くなる」と指摘(2026-09-21)。単価だけでなく実測トークン量での比較が必要です。
  • 配布チャネルは広い: 2026-09-21からGitHub Copilotでも順次利用可能(VS Code / JetBrains / Xcode等)。API・Cursor・Grok Build・サードパーティのコーディングハーネス・モデルルーター・クラウド経由で提供。

出典: the-decoder · VentureBeat · GitHub Changelog(いずれも2026-09-23確認)。第三者の数値は各社の測定条件に依存します。

前世代・競合との比較

xAI掲載の比較表より。推論エフォート設定がモデルごとに異なるため、単純な同条件比較ではない点に留意してください。

モデル設定入力出力Grok 4.7より
Grok 4.7xHigh$2.00$6.00—(基準)
Grok 4.6High$2.00$6.00同額
GPT-5.6 SolMax$4.00$20.00Grok安(入力半額・出力70%安)
Claude Fable 5.1Max$10.00$50.00Grok安(入力1/5・出力約1/8)

※ 上表はxAI公式発表の比較図に基づく料金です。最高推論エフォート同士の比較であり、当サイトが各社公式ページで独自に確認した標準料金とは設定が異なる場合があります。全モデルの標準料金は料金比較ページをご参照ください。

出典: xAI: Introducing Grok 4.7 · 各社公式料金は料金比較(2026-09-23時点)

ベンチマーク上で強みが出ている用途

コーディング・エージェント・専門ドメインを中心に。

💻

コーディング・コードレビュー

CursorBench 4.0で46.3%(前世代比+5.9pt)。Cursor本体とGrok Buildで公開当日から利用可能。

🖥️

長時間ターミナル作業

Terminal-Bench 4.0が20.3%→37.6%(約1.9倍)へ大幅上昇。多段シェル操作の自動化。

⚖️

法務・専門ドメイン

Harvey Legal Agent Benchmark 19.6%で比較4モデル中トップ。専門領域のエージェント業務。

🔌

電気工学・ハードウェア寄り設計

EEBench 64.0%で比較4モデル中トップ。

📊

文書・プレゼン作成

AA Briefcase 1,657、GDPval Elo 1,695。専門職の成果物作成タスク。

🧠

長文コンテキスト処理

500Kコンテキスト。ただし200K超で単価が倍になるため、長さとコストのトレードオフ管理が前提。

Grok 4.7が向いている場面 / 向いていない場面

  • 単価重視のフロンティア帯なら有力: 入力$2 / 出力$6は、GPT-5.6 SolやFable 5.1(最高エフォート)と比べて明確に安価。xAIは「同種モデルの2倍速く半額」と主張しています。
  • 総コストは実測トークンで判断: 推論を多く使う設定(既定high〜xhigh)では出力トークンが増え、単価差が縮まります。reasoning_effortをタスク難易度に合わせて下げるのが基本。
  • 200Kの壁に注意: 長文コンテキストを使うなら$4/$12(Fast時は$6/$1.50/$18)。キャッシュ入力($0.50)の活用が実質コスト削減の要。
  • Batch 20%割引は対象外: 大量バッチ処理が目的ならGrok 4.6も同様に対象外で、対象はgrok-4.3 / grok-4.20系のみです。
  • 最高性能が必要なら: 掲載した Artificial Analysis Intelligence Index では Claude Fable 5.1 と GPT-6(いずれも53)が Grok 4.7(46)を上回ります。精度が最優先なら上位モデルとの使い分けを。

実際のコストを試算する

Grok 4.7を含む全モデルのトークンコストを一括計算。入力・出力トークン数を入れるだけ。

🧮 トークン計算機で試算する →

📊 全モデル料金比較 · 🤖 Grok 4.6と比較 · 🗓️ リリース年表 · 🔗 xAI公式料金ページ

⚠️ 免責事項

  • 料金はdocs.x.ai公式ページを2026-09-23に確認したものです。予告なく変動します。契約前に必ず公式ページをご確認ください。
  • 本サイトは情報提供目的であり、特定プロバイダーの推薦・代理ではありません。
  • ベンチマーク数値はxAIの公表値であり、実際の使用感を保証するものではありません。第三者の数値は各社の測定条件に依存します。