Grok 4.7は、SpaceXAI(旧xAI)が2026年9月21日に公開したコーディング・エージェント作業・知識作業向けのフロンティアモデルです。APIのモデルIDは grok-4.7 で、コンテキストは500,000トークン、単価は前版のgrok-4.6と同じ入力2ドル/出力6ドル(100万トークンあたり)に据え置かれました。本記事では、4.6との仕様差、公式ベンチマークの読み方、Responses APIでの呼び出し方と推論深度の指定、Cursor・Grok Build・GitHub Copilotでの提供条件を順に確認し、4.6から切り替えるべき案件と見送る案件を条件付きで判断します。
Grok 4から4.6までの系譜や旧モデルIDの転送ルールは、姉妹記事のGrok 4とは?特徴・Heavyとの違い・料金とGrok 4.6までの系譜で扱っています。ここでは4.7で何が変わり、実装側で何を直せばよいかに絞ります。
まとめ|Grok 4.7の変更点と4.6から切り替えるかの結論
結論から書きます。単価・コンテキスト長・推論深度の選択肢は4.6と同じで、変わったのは中身の性能と知識カットオフです。モデルIDを差し替えるだけで移行できるため、エージェント型のコーディング用途なら切り替えない理由はほとんどありません。
| 観点 | Grok 4.7の要点(時点2026年9月) |
|---|---|
| モデルID | grok-4.7 |
| コンテキスト | 500,000トークン(4.6と同じ) |
| 知識カットオフ | 2026年5月(4.6は2026年2月1日) |
| API単価 | 入力2ドル/キャッシュ0.5ドル/出力6ドル |
| 推論深度 | low・medium・high(既定)・xhigh |
| 性能の伸び(CursorBench 4.0) | 40.4%→46.3% |
| 移行の手間 | モデルIDの差し替えが中心 |
注意すべきは課金の境界です。プロンプトが200Kトークンを超えるとリクエスト全体が倍額になる規則は4.6から引き継がれており、長文を丸ごと投げる処理ではコストが一気に跳ねます。長文入力が主体なら、コンテキスト100万トークンで単価の安いgrok-4.3を残す判断もありえます。
Grok 4.7の仕様をgrok-4.6と並べた版差の一覧と読み方
公式のGrok 4.7のモデルページとモデル一覧をもとに、4.6と並べて差分を確認します。
| 項目 | grok-4.7 | grok-4.6 |
|---|---|---|
| コンテキスト | 500K | 500K |
| 入力/出力単価 | 2ドル/6ドル | 2ドル/6ドル |
| キャッシュ入力 | 0.5ドル | 0.5ドル |
| 推論深度 | 4段階・既定high | 4段階・既定high |
| 知識カットオフ | 2026年5月 | 2026年2月1日 |
| 入出力の種類 | テキスト・画像入力 | テキスト・画像入力 |
表で見ると同じ行が並びます。仕様表だけで比べると違いが見えないのが4.7の特徴で、差は後述のベンチマークと応答の返し方(暗号化推論の常時返却)に出ています。
コンテキスト500Kトークンと知識カットオフ2026年5月の意味
コンテキスト長は500,000トークンで、4.6と同じ上限です。出力の上限は設けられておらず、入力はテキストと画像、出力はテキストのみという構成も変わっていません。対応ツールは関数呼び出し、Web検索、X検索、コード実行の4種類がモデルページに記載されています。
実務上の変化は知識カットオフです。2026年5月まで学習データに入ったため、2026年春に出たライブラリの新版やAPI仕様を検索ツールなしでもある程度知っています。ただし、それ以降の変更はツールを有効にしない限り知りません。版番号を答えさせる用途では、Web検索ツールを併用する前提で組むのが安全です。
なお、パラメータ数は公式発表とドキュメントのどちらにも記載がありません。二次情報で出回っている具体的なパラメータ数は、裏付けが取れるまで設計判断の材料にしないでください。
旧版から据え置きのAPI単価と200K境界で倍額になる課金規則
リリースノートには、プロンプトが200Kトークン以下なら入力2ドル・キャッシュ入力0.5ドル・出力6ドル、200Kを超えると4ドル・1ドル・12ドルと書かれています。モデル一覧の注記によれば、境界を超えたリクエストは超過分だけでなくリクエスト内のすべてのトークンが高い単価で課金されます。
もう1つの割増が地域指定です。処理を米国内に固定する https://us.api.x.ai/v1 のエンドポイントは、通常単価に10%が上乗せされます。データ所在の要件がない限り、既定の api.x.ai を使えば足ります。
境界をまたぐとどれだけ変わるかは、次の試算で確かめられます。単価はリリースノートの値をそのまま入れています。
def estimate_usd(prompt_tokens, cached_tokens, output_tokens):
# grok-4.7 の1リクエストあたりの概算(USD)。200K超はリクエスト全体が高単価
if prompt_tokens > 200_000:
inp, cache, out = 4.0, 1.0, 12.0
else:
inp, cache, out = 2.0, 0.5, 6.0
uncached = prompt_tokens - cached_tokens
return (uncached * inp + cached_tokens * cache + output_tokens * out) / 1_000_000
print(estimate_usd(190_000, 0, 10_000)) # 0.44
print(estimate_usd(210_000, 0, 10_000)) # 0.96
入力を2万トークン増やしただけで、1リクエストの費用は0.44ドルから0.96ドルへ2倍強になります。RAGで検索結果を詰め込む処理や、リポジトリ全体を渡すコードレビューでは、プロンプトを200K未満に収める前処理を入れるだけで請求額が半分近くまで下がります。
公式ベンチマーク7種で見る4.6からの性能の伸び幅と他社モデルとの差
SpaceXAIの発表ページは、7種類のベンチマークで4.6と他社モデルを並べています。数値はいずれも発表時点の自社計測です。
| ベンチマーク | Grok 4.7 | Grok 4.6 | 比較対象 |
|---|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% | GPT-5.6 Sol 41.7% |
| DeepSWE v1.1 | 71.0% | 65.2% | Fable 5.1 70.0% |
| EEBench | 64.0% | 53.0% | GPT-5.6 Sol 39.4% |
| AA Briefcase v1.1 | 1,657 | 1,546 | GPT-5.6 Sol 1,487 |
| Terminal-Bench 4.0 | 37.6% | 20.3% | Fable 5.1 57.9% |
| Harvey Legal Agent | 19.6% | 15.8% | GPT-5.6 Sol 2.5% |
| HealthBench Professional | 56.7% | 48.5% | GPT-5.6 Sol 60.5% |
7種すべてで4.6を上回っていますが、他社の最上位モデルに勝っている項目と負けている項目が混在しています。
CursorBench 4.0とDeepSWE v1.1で見るコーディング性能の伸び
IDE内のエージェント作業を測るCursorBench 4.0では、4.6の40.4%から46.3%へ5.9ポイント伸び、比較対象のGPT-5.6 Solの41.7%を上回りました。リポジトリ単位の修正を測るDeepSWE v1.1でも71.0%で、Fable 5.1の70.0%とほぼ並びます。
この2つは「既存コードを読み、複数ファイルを直す」作業に近い指標です。Cursorやコーディングエージェント経由で使う場面では、4.6から乗り換える根拠として十分な伸び幅といえます。
Terminal-Bench 4.0の37.6%に残るFable 5.1との差
一方、シェル操作を伴うタスクを測るTerminal-Bench 4.0は37.6%です。4.6の20.3%からは大きく伸びましたが、Fable 5.1の57.9%とは20ポイント以上の開きがあります。医療知識を問うHealthBench ProfessionalもGPT-5.6 Solの60.5%に届いていません。
ビルド・デプロイ・障害調査のようにコマンドを連続で打つエージェントを組む場合、4.7を第一候補にする根拠はこの数値からは出てきません。用途がターミナル主体なら、他社モデルと同じタスクで比較してから決めるべきです。
grok-4.7をcurlとPythonから呼び出すリクエスト例と推論設定
APIキーの発行やコンソールの操作はGrok API(xAI)とは?料金・モデル・使い方とAPIキー取得にまとめています。ここではキー取得済みの前提で、4.7固有の指定だけを示します。
Responses APIのcurl例とreasoning.effortの4段階指定
推論の深さは reasoning.effort で指定します。推論のドキュメントによると、grok-4.7が受け付ける値は low・medium・high(既定)・xhigh の4つです。grok-4.5は3段階で xhigh を受け付けないため、4.5から移る場合は選択肢が1つ増えます。
export XAI_API_KEY="xai-..."
curl https://api.x.ai/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $XAI_API_KEY" \
-d '{
"model": "grok-4.7",
"reasoning": {"effort": "medium"},
"input": [
{"role": "system", "content": "あなたはPythonのコードレビュアーです。"},
{"role": "user", "content": "次の関数の不具合を指摘してください: def avg(xs): return sum(xs)/len(xs)"}
]
}'
既定の high は推論トークンを多く使います。定型的な分類や短い要約なら low か medium に下げ、公式ベンチマークと同じ条件で難しい修正をさせたいときだけ xhigh を使う、という段階分けで出力トークンの費用を抑えられます。
OpenAI SDK互換で既存コードのモデルIDだけ差し替える手順
xAIのAPIはOpenAI SDKから base_url を変えるだけで呼べます。4.6で動いているコードなら、変更点はモデルIDの1行です。
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["XAI_API_KEY"],
base_url="https://api.x.ai/v1",
)
response = client.responses.create(
model="grok-4.7", # grok-4.6 から差し替え
reasoning={"effort": "high"},
prompt_cache_key="code-review-bot", # 同じ系統の依頼でキャッシュを効かせる
input=[
{"role": "system", "content": "あなたは社内規約に沿ってレビューするアシスタントです。"},
{"role": "user", "content": "このdiffの問題点を3行で挙げてください。"},
],
)
print(response.output_text)
モデル一覧には、grok-4.7 のような名前だけの指定は最新の安定版を、日付付きの名前は特定のリリースを指すというエイリアス規則が書かれています。回帰テストで結果を固定したい本番系は日付付きのIDで固定し、開発環境だけ名前指定で追随させると、挙動が変わったときの切り分けが楽になります。
暗号化推論の常時返却とprompt_cache_keyの設定の注意点
4.7で挙動が変わったのが推論内容の返し方です。Responses APIでは、include に reasoning.encrypted_content を書いたかどうかに関係なく、すべての応答に暗号化された推論内容が付きます。Chat Completions APIの挙動は変わりません。
影響が出るのは、応答をそのままログ基盤やデータベースに保存している実装です。応答サイズが増えるため、保存前に必要なフィールドだけを抜き出す処理を入れておくと、ストレージの増え方を抑えられます。会話を継続する場合は、この暗号化内容を次のリクエストに渡すと推論の文脈を引き継げます。
キャッシュについては、モデルページがResponses APIでは prompt_cache_key、Chat Completionsでは x-grok-conv-id ヘッダーの設定を勧めています。キャッシュ入力は0.5ドルで通常入力の4分の1なので、同じシステムプロンプトを繰り返す業務ボットでは設定の有無が請求額に直結します。
Cursor・Grok Build・GitHub Copilotの提供条件と課金の違い
APIのほかに、4.7はコーディングツール経由でも使えます。経路ごとにコンテキスト長と課金の考え方が異なるため、表で整理します。
| 経路 | 提供条件(時点2026年9月) |
|---|---|
| xAI API | 従量課金・200K超で倍額 |
| Cursor | 全プラン・標準256K/最大500K |
| Grok Build | 既定モデルとして搭載 |
| GitHub Copilot | Pro以上・使用量課金 |
| ゲートウェイ | 外部サービス経由で提供 |
ゲートウェイ経由ではOpenRouter・Vercel・Cloudflareで使えます。同じモデルでも、Cursorの標準コンテキストは256Kで、APIの500Kとは入口の設定が違います。長い入力を前提に検証するなら、どの経路で測った結果かを必ず記録してください。
CursorとGrok Buildに限られるGrok 4.7 Fastの倍額課金
Grok 4.7 Fastは、出力速度を2倍にする代わりに単価も2倍になる高速版です。モデルページによれば提供はCursorとGrok Buildだけで、xAI APIからは指定できません。CursorのGrok 4.7のページでは、Fastの単価は入力4ドル・キャッシュ入力1ドル・出力12ドルで、Pro以上のプランでは既定の速度になっていると説明されています。また256Kを超える入力には割増(標準2倍、Fastは3倍)が掛かる旨の記載があります。
Cursorで何も設定を変えずに使うとFastで課金されうる点が落とし穴です。応答速度が作業のボトルネックでないなら、標準速度に切り替えるだけで単価は半分になります。Cursorの独自モデルとの比較はComposer 2とは?Cursor独自モデルの性能・料金・競合比較が参考になります。
Grok Buildでは4.7が既定モデルになりました。エージェントの仕組みや並列サブエージェントについてはGrok Buildとは?xAIの自律型コーディングエージェントの仕組み・料金・導入判断で解説しています。
GitHub Copilotのモデル選択と使用量課金の対象プラン
GitHubの変更履歴によると、4.7はCopilot Pro・Pro+・Max・Business・Enterpriseで順次選べるようになっています。VS Code、Visual Studio、JetBrains、Xcode、Eclipse、Copilot CLI、クラウドエージェントのモデル選択画面から指定でき、料金は提供元の定価に基づく使用量課金です。
BusinessとEnterpriseでは、管理者がモデルポリシーで有効にしない限り利用者の画面に出ません。社内で試したい開発者がいる場合は、先に管理者側でポリシーを開放し、利用量の上限を決めてから案内するのが順序です。
grok-4.6から4.7へ移行すべき案件と見送るべき案件の判断基準
単価が同じで、呼び出し方もモデルIDの差し替えで済むため、判断の軸は「どの作業に使うか」と「入力の長さ」の2つに絞れます。ここは条件付きで言い切ります。
移行する条件はエージェント型の長時間タスクと本番環境での版固定の運用
複数ファイルにまたがる改修やコードレビューをエージェントに任せている案件は、4.7へ移行すべきです。CursorBench 4.0とDeepSWE v1.1の伸び幅が根拠で、単価が変わらない以上、移行コストは回帰テストの1回分だけです。知識カットオフが2026年5月まで進んだため、2026年前半に出たフレームワークの新版を扱うプロジェクトでも誤答が減る見込みがあります。
移行時は、本番系を日付付きのモデルIDで固定し、同じ入力セットで4.6と4.7の出力を比較してから切り替えてください。応答に暗号化推論が常に付く点は、ログ保存の実装を先に確認しておく必要があります。
移行を見送る条件は200K超の長文入力とターミナル主体の自動化
プロンプトが恒常的に200Kトークンを超える処理は、4.7に移しても単価の倍額規則から逃れられません。長い契約書や議事録を丸ごと要約させる用途は、コンテキスト100万トークン・出力2.5ドルのgrok-4.3を使い続けるほうが安く済みます。性能より費用の上限が厳しいバッチ処理も同じ判断です。
シェル操作を連続で行う自動化も、Terminal-Bench 4.0の37.6%という数値を見る限り、4.7を選ぶ理由は弱いという判断です。このようにモデルを用途ごとに使い分ける構成は、評価用の入力セット作りや費用の監視まで含めて設計すると運用が安定します。当社では生成AIを業務システムへ組み込む際のモデル選定から検証・本番運用までを支援しており、進め方の相談は生成AI導入支援のページで受け付けています。
よくある質問
Grok 4.7について、導入前によく確認される点をまとめます。
Grok 4.7はいつ公開されましたか?
2026年9月21日です。同日にxAI APIでの提供が始まり、Cursor・Grok Buildでも使えるようになりました。GitHub Copilotでも同じ日に順次提供が始まっています。前版のGrok 4.6は2026年8月の公開で、APIのモデル一覧には4.6も引き続き掲載されています(時点2026年9月24日)。
Grok 4.7の料金は4.6から上がりましたか?
上がっていません。100万トークンあたり入力2ドル・キャッシュ入力0.5ドル・出力6ドルで、4.6と同じです。プロンプトが200Kトークンを超えるとリクエスト全体が入力4ドル・出力12ドルになる規則も同じで、米国内処理のエンドポイントを使うと10%が上乗せされます。
Grok 4.7 FastはAPIから使えますか?
使えません。Grok 4.7 FastはCursorとGrok Buildに限った高速版で、出力速度が2倍、単価も2倍です。APIで速度を上げたい場合は、reasoning.effort を low や medium に下げて推論トークンを減らす方法が現実的です。
Grok 4.7のコンテキストは何トークンですか?
xAI APIでは500,000トークンです。Cursorでは標準256K、最大500Kという扱いで、経路によって既定値が異なります。100万トークン級の入力が必要なら、grok-4.3やgrok-4.20系の1,000,000トークンのモデルが候補になります。
Grok 4.7は無料で使えますか?
APIは従量課金で、無料枠の記載はモデルページにありません。Cursorは全プランで選択でき、GitHub CopilotはPro以上のプランが対象です。消費者向けのGrokアプリでの提供状況は、公式発表に明記されていません(時点2026年9月24日)。
関連記事
- Grok 4とは?特徴・Heavyとの違い・料金とGrok 4.6までの系譜:4.7に至るまでのモデル系譜と旧IDの転送ルール
- Grok Buildとは?xAIの自律型コーディングエージェントの仕組み・料金・導入判断:4.7を既定モデルにしたエージェントの仕組み
- Grok API(xAI)とは?料金・モデル・使い方とAPIキー取得を徹底解説:APIキー取得から最初のリクエストまで
- Grok 4.5とは?V9基盤の特徴・性能と公開状況をわかりやすく解説:推論3段階だった4.5の特徴
- Composer 2とは?Cursor独自モデルの性能・料金・競合比較:Cursor内でGrok 4.7と比べる対象