Grok 4.7とは?仕様を先に確認
公式ドキュメントによると、APIのモデル名はgrok-4.7。テキストと画像を入力でき、出力はテキストである。知識カットオフは2026年5月、推論強度はlow、medium、high、xhighの4段階で、既定値はhighだ。
| 項目 | Grok 4.7の仕様 |
|---|---|
| 主な用途 | コーディング、エージェント処理、知識労働 |
| コンテキスト | 500,000トークン |
| 入出力 | テキスト・画像入力、テキスト出力 |
| 推論強度 | low / medium / high / xhigh |
| 対応API | Responses API / Chat Completions |
| 主なツール | Function calling、Web検索、X検索、コード実行 |
長い会話では、Responses APIが暗号化された推論内容を返す。次のリクエストへ変更せず渡すことで、複数ターンの推論を継続できる。公式はprompt_cache_keyの設定も推奨している。指定しないとキャッシュが効かず、同じ会話でも入力料金が増える可能性があるためだ。
Grok 4.6と何が違う?
SpaceXAIの発表は、4.7で基盤モデルを大型化し、数時間かかる問題を多く含む強化学習を長く実施したと説明する。自己検証と長いコンテキストの管理を強め、Grok Botの実行環境も学習対象に含めたという。
公表された主な比較は次の通りだ。数値はSpaceXAIによる自己報告であり、TechCreateが同じ条件で再現した結果ではない。さらに、CursorBenchでは4.7がxhigh、4.6がhighで測られており、推論強度がそろっていない点にも注意が要る。
| ベンチマーク | Grok 4.7 | Grok 4.6 | 読み方 |
|---|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% | 長時間のコーディング課題。推論強度が異なる |
| DeepSWE v1.1 | 71.0% | 65.2% | 4.7はhighで測定 |
| Terminal-Bench 4.0 | 38.0% | 20.3% | 4.7はxhigh、Grok Build上の結果 |
| AA Briefcase v1.1 | 1,657 | 1,546 | 複数時間のオフィス業務を評価 |
この差から「すべての開発作業で4.7が速く安い」とは言えない。長いタスクで成功率が上がっても、xhighで出力トークンや処理時間が増えれば、1回あたりの費用は上がる。4.6からの移行では、同じ推論強度、同じ入力、同じツール構成で完了率と総トークンを測る必要がある。
料金は4.6と同じ。ただし20万トークンが境目
公式料金表では、Grok 4.7と4.6の単価は同じである。料金は米ドル建てで、プロンプトが20万トークン以上になると、そのリクエストのすべてのトークンへ長文料金が適用される。
| 100万トークンあたり | 20万未満 | 20万以上 |
|---|---|---|
| 入力 | 2ドル | 4ドル |
| キャッシュ入力 | 0.50ドル | 1ドル |
| 出力 | 6ドル | 12ドル |
高速版のGrok 4.7 Fastは、標準版と同じモデルを速い基盤で提供する。利用できるのはCursorとGrok Buildだけで、公開xAI APIにはない。20万トークン未満では入力4ドル、キャッシュ入力1ドル、出力12ドル。20万を超えると入力6ドル、キャッシュ入力1.50ドル、出力18ドルになる。
米国内で推論処理を行うUS regional endpointも選べるが、トークン料金は標準の1.1倍だ。企業がデータ処理地域を条件にする場合は、通常エンドポイントとの差額を見積もる必要がある。Web検索やコード実行など、SpaceXAI側のツール呼び出しには別料金も加わる。
どこで使える?API、Copilot、AI Gatewayの違い
Grok 4.7は発表時点から複数の経路で使える。ただし、料金の請求元や提供速度は同じではない。
| 提供経路 | 状態 | 確認したい条件 |
|---|---|---|
| xAI API | 利用可能 | API単価、20万トークン境界、ツール料金 |
| Grok Build | 既定モデル | 無料枠にFastは含まれない |
| Cursor | 全プランで利用可能と公式記載 | プラン内利用量とFastの請求 |
| GitHub Copilot | 対象プランへ段階提供 | 管理者のモデルポリシー、従量課金 |
| Vercel AI Gateway | 利用可能 | 9月27日まで40%割引、ログ・予算管理 |
GitHubの発表では、Copilot Pro、Pro+、Max、Business、Enterpriseが対象で、VS Code、Copilot CLI、cloud agentなどから選べる。段階展開のため、契約対象でもモデル一覧にすぐ表示されるとは限らない。
Vercel AI Gatewayではspacexai/grok-4.7として提供され、2026年9月27日まで40%割引が適用される。これは期間限定の販売条件であり、長期のコスト比較には通常料金を使うべきだ。
関連して、常駐型エージェントの権限やX連携を知りたい場合は、TechCreateの「Grok Botとは」を参照してほしい。Cursor側のエージェント運用は「Cursor Projectsとは」で整理している。
どんなチームが切り替えを検討すべき?
4.7の価値を確かめやすいのは、単発の補完より、長い作業を途中で崩さず完了できるかが重要なチームだ。
- 複数ファイルの改修、長時間の調査、資料作成など、途中状態を保つ必要がある
- 4.6で自己検証不足や後半の指示忘れが失敗原因になっている
- 20万トークンを超える入力があり、キャッシュ設計を含めて費用を測れる
- GitHub CopilotやCursorですぐ試し、既存の権限管理を大きく変えずに比較できる
一方、短い要約や単純なコード補完が中心なら、公式ベンチマークの伸びがそのまま業務価値になるとは限らない。Grok 4.6と同じリクエストを少数ずつ走らせ、次の4項目を記録すると判断しやすい。
- 人の修正なしで完了した割合
- 入力・キャッシュ・出力を合計した1件あたり費用
- 完了までの時間と再試行回数
- 誤ったツール実行や見落としの件数
未確認の点と導入時の注意
公開資料だけでは、すべての実務条件を確定できない。SpaceXAIは安全性や長時間タスクの改善を示すが、ベンチマークは主に同社の測定である。TechCreateは実機で4.6と4.7を比較していない。
| 未確認・変動する点 | 導入側での確認方法 |
|---|---|
| 自社リポジトリでの成功率 | 同一課題・同一推論強度で4.6と比較 |
| xhigh時の総トークンと待ち時間 | APIログでタスク単位に計測 |
| Cursor・Copilot内の実効料金 | 各契約の管理画面と請求明細を確認 |
| 日本からの遅延とデータ処理条件 | 通常・US endpoint、ゲートウェイ経由を比較 |
| 第三者による再現結果 | 独立ベンチマークや利用事例の公開を待つ |
モデル名を置き換えるだけで本番エージェントへ全面投入せず、読み取り専用の仕事から始め、ツール権限と人の承認点を維持するのが現実的だ。価格と提供面は確認できたが、長期運用の失敗率や業務成果はこれから確かめる段階にある。
まとめ
- Grok 4.7は、Grok 4.6と同じ基本料金・50万トークンの枠を保ちながら、長時間タスクと自己検証を強化したモデルである。
- 20万トークン以上では全トークンの単価が倍になるため、モデル単価よりキャッシュとタスク全体の完了費用が重要になる。
- ベンチマークは自己報告が中心である。4.6からの移行判断は、同じ推論強度と実務タスクで完了率、再試行、総コストを測って行うべきだ。




