Grok 4.7 が 2 つの開発環境に同時に来ました

GitHub は 2026 年 9 月 21 日、Grok 4.7 を GitHub Copilot で提供開始する と発表しました。同じ日、x.ai も Grok 4.7 の発表 で「本日から Cursor と Grok Build で利用できる」と書いています。本記事は 9 月 22 日時点の公式資料を軸に、第三者測定はそうと分かる形で添えてまとめたものです。

新しいモデルが出たとき、先に確認したくなるのはベンチマークですが、社内で使うなら順番が逆です。対応プラン・管理者の操作・課金の単位 を先に押さえないと、有効になったあとで請求の話をすることになります。特に Copilot の Grok 系は、これまで多くのモデルで使われてきたプレミアムリクエストの倍率ではなく、トークン従量で請求されます。

モデルの廃止と期日の管理は 10 月 19 日に 6 モデルが廃止される件 にまとめてあります。本記事は逆に、追加されたモデルを採用するかどうかと、その費用の付き方を扱います。

どこで使えるのか

GitHub Copilot の対象プランとクライアント

公式 changelog が挙げている対象は、Copilot Pro・Pro+・Max・Business・Enterprise です。Free と Student は告知に挙がっていません。対象外と書かれているわけではないので、利用可否は自分の環境で確認してください。

対応クライアントは次の 8 種です。

区分対応クライアント
エディタVisual Studio Code・Visual Studio・JetBrains・Xcode・Eclipse
ターミナル・WebCopilot CLI・GitHub Copilot cloud agent・GitHub Copilot アプリ

展開は順次行われると明記されています。対象プランでもモデル選択画面に出ないことがあるため、設定を疑う前に少し待ってください。

Cursor は Cursor Models プールの一員

Cursor Docs の Grok 4.7 のページ によると、モデル ID は grok-4.7 で、個人プランとチームプランの Cursor Models プールに含まれます。同じプールには Grok 4.6・Grok 4.5・Composer 2.5 が入っています。Provider の表記は Cursor で、説明文も「Cursor と SpaceXAI によるフロンティアモデル」となっています。

なお 9 月 22 日時点で、Cursor の changelog に Grok 4.7 のエントリはありません。最新の掲載は 9 月 10 日の Cursor Projects です。Cursor 側の一次情報は、いまのところ Docs のモデルページだけです。

課金の単位が、これまでのモデルと違います

Copilot の changelog は「This model is billed at provider list pricing under usage-based billing」と書いています。提供元の定価に基づくトークン従量課金です。実際、GitHub Docs の料金ページ にあるプレミアムリクエストの倍率表に Grok の行はありません。「1 リクエスト = 1 回」という数え方は、このモデルには当てはまりません。

請求は AI クレジットに換算され、1 単位が 0.01 ドルです。倍率ではなく入力と出力のトークン量で決まるため、MAI-Code-1.1-Flash の追加時 のようにプレミアムリクエスト換算で見積もる方法は使えません。

GitHub Copilot の単価

100 万トークンあたりの単価です。

ティア入力長入力キャッシュ入力出力
既定200K 以下2.00 ドル0.50 ドル6.00 ドル
長文脈200K 超4.00 ドル1.00 ドル12.00 ドル

出典は GitHub Docs の料金ページにある xAI の表です。同じ表で Grok 4.6・Grok 4.5 も同額・同閾値になっています。上表は公式ページの表示額で、日本の消費税の扱いは契約時に確認してください。

Cursor の単価

Cursor は速度ティアと長文脈が別々の行になっています。

区分入力キャッシュ入力出力
標準2.00 ドル0.50 ドル6.00 ドル
Fast4.00 ドル1.00 ドル12.00 ドル
標準 (入力 256K 超)4.00 ドル1.00 ドル12.00 ドル
Fast (入力 256K 超)6.00 ドル1.50 ドル18.00 ドル

出典は Cursor Docs にある Grok 4.7 の Pricing 節です。入力が 256K トークンを超えると標準は 2 倍、Fast は標準の 3 倍で請求され、上限は 500K のコンテキストウィンドウです。長文脈の判定に使うのは入力の長さだけと明記されています。

閾値がプラットフォームで違います

同じ Grok 4.7 でも、単価が上がる入力長の境界は Copilot が入力 200K 超、Cursor が入力 256K 超 です。Copilot で長文脈ティアに入る入力長でも、Cursor では標準のままという範囲が存在します。社内の費用試算を 1 つの数字で済ませると、閾値の差が抜け落ちます。

注意

Cursor で Fast を使っている場合、入力 256K 超では標準比 3 倍になります。速度ティアと長文脈は別々の行に分かれているので、掛け算で出さず、表の該当行をそのまま見てください。

単価が据え置きでも、費用が据え置きとは限りません

x.ai は Grok 4.7 を 4.6 と同じ価格・同じ速度で提供すると書いています。単価だけを見ると、乗り換えても費用は変わらないように読めます。

ここに 1 つ注意点があります。第三者測定の Artificial Analysis による Grok 4.7 の計測 は、性能の向上がトークン消費の増加を伴うと指摘し、Intelligence Index のタスクあたり出力トークンを約 81k と報告しています。従量課金では、消費したトークン量がそのまま請求に乗ります。単価が同じでも、1 タスクで使う量が増えれば月の支払いは変わります。

なお、これは提供元の測定ではなく第三者のベンチマークでの値です。自社の作業にそのまま当てはまる数字ではないので、目安として扱い、実際の使用量は自分たちの環境で確認してください。

FIXITFIXIT

単価が 4.6 と同じなら、切り替えても請求は変わらないってこと?

HayateHayate

そこは分けて考えてください。単価は同じでも、1 タスクで使う量が増えれば請求は増えます。

FIXITFIXIT

じゃあ、何を見ればいいの?

HayateHayate

同じ依頼を両方で流して、使用量を並べるのが早いです。単価表だけでは決まりません。

管理者が今日確認すること

Copilot の changelog によると、既定の有効化を使っているなら、新しいモデルは自動で有効になります。例外は、管理者がグローバル既定をオフにしている場合と、このモデルを明示的に無効化している場合です。

以下は公式の作業一覧ではなく、本記事が提案する確認の順番です。

現在の設定管理者の操作完了の判断
グローバル既定が有効自動で有効になる範囲を確認する利用者のモデル選択画面に表示される
グローバル既定をオフにしているモデルポリシーで Grok 4.7 を手動で有効にするか決める有効・無効のどちらにしたかを記録した
Grok 4.7 を個別に無効化している無効化の理由を確認し、方針を決める方針と決定者が社内に残っている
従量課金の上限や予算アラートを設定している今回の追加で前提が変わらないか確認する追加後の使用量を見る担当と頻度が決まっている

従量課金の上限や予算アラートの行が今回の要点です。トークン従量である以上、「有効にしておいて使わなければ費用は出ない」は成り立ちますが、誰かが使い始めたときに気づける仕組みがあるかは別の話です。金額の目安は、AI クレジットの各プランの割当量を確認できていないため本記事では扱いません。契約中のプランの請求ページで確認してください。

Grok 4.6 と何が違うのか

提供元 (x.ai) の説明

x.ai は、4.6 と比べて大きいベースモデルを使い、強化学習を長く回し、数時間かかる難しいタスクに重みを置いた構成にし、自己検証と長文脈の扱いを改善したと説明しています。価格と速度は 4.6 と同じです。

公表されているベンチマークのうち、Grok 4.7 (xHigh) と Grok 4.6 (High) の値を並べます。

ベンチマークGrok 4.7 (xHigh)Grok 4.6 (High)
CursorBench 4.046.3%40.4%
Terminal-Bench 4.038.0%20.3%
EEBench64.0%53.0%
AA Briefcase v1.11,6571,546
DeepSWE v1.171.0%65.2%
HealthBench Professional56.7%48.5%
Harvey Legal Agent Benchmark19.6%15.8%

上表はいずれも提供元である x.ai の発表値です。DeepSWE v1.1 だけは、4.7 の値が他の行と違って high effort での測定と注記されています。

第三者測定との違い

Artificial Analysis の計測では、Intelligence Index が 46、AA-Briefcase が 1,657 Elo (Grok 4.6 の high 比で +111)、ハルシネーション率が 29% (Grok 4.6 は 34%)、長いプロンプトでの出力速度が約 188 トークン/秒と報告されています。AA-Briefcase の値は x.ai の発表と一致しており、相互に裏が取れます。

ハルシネーション率のように提供元が出していない指標もあり、そのぶん測定条件も提供元の発表とは異なります。どちらの測定かを分けたまま読み、優劣の断定には使わないでください。FIXIT としても再測定はしていないため、本記事ではモデルの序列を付けません。判断は自分たちの作業で比べてから行うほうが確実です。

effort と speed の指定は、Cursor 側で公式に確認できます

Cursor Docs は、Grok 4.7 に xhigh・high (既定)・medium・low の 4 段階の effort レベルがあると書いています。加えて、Pro 以上のプランでは Fast が既定の速度ティアです。Fast の単価は標準の 2 倍です。速度ティアを変えないまま使う場合、標準単価にはならない点に注意してください。Start プラン (インド限定) では medium の effort と標準速度に固定されます。

GitHub Copilot 側は、公式ドキュメントで同等の制御を確認できませんでした。サポート対象モデルの一覧 には Grok 4.5・4.6・4.7 が GA として載っていますが、クライアント別の詳細表に Grok の行は見当たりません。制御が存在しないという意味ではなく、公式資料では確認できなかったという状態です。実際の選択肢は、使っているクライアントのモデル設定で確認してください。

項目GitHub CopilotCursor
標準の入力単価2.00 ドル2.00 ドル
長文脈の閾値入力 200K 超入力 256K 超
effort の指定公式資料で未確認xhigh・high (既定)・medium・low
速度ティア公式資料で未確認Fast が Pro 以上で既定、単価は 2 倍
課金の単位AI クレジットCursor Models プールの従量

単価は 100 万トークンあたりです。表の値は GitHub Docs と Cursor Docs を 9 月 22 日に確認したものです。

公式資料で確認できないスペック

発表直後は、二次情報の数値が先に広まります。社内資料に貼る前に、次の 2 点を押さえてください。

パラメータ数は、x.ai・GitHub・Cursor のいずれの公式ページにも記載がありません。 x.ai の記述は「4.6 と比べて大きい新しいベースモデル」までで、数値は出ていません。出典を示せない数値は、社内資料に載せないほうが安全です。

コンテキスト長は、一律の 1 つの数字ではありません。 Cursor Docs は標準 256K・上限 500K という段階で示し、Copilot の料金表は課金の閾値として 200K を示しています。Copilot 側のコンテキスト上限は、サポート対象モデルの詳細表に Grok の行が無いため確認できていません。どのプラットフォームの、何の値なのかを添えずに「500K」とだけ書くと、読んだ人が別の意味で受け取ります。

数値を社内に配るときは、出典 URL と確認日をセットで残してください。モデルの仕様は更新されるので、日付の無い数値は時間が経つほど使えなくなります。

10 月 19 日の Grok 4.5 廃止と、どうつなぐか

Copilot では 2026 年 10 月 19 日に Grok 4.5 を含む 6 モデルが廃止されます。9 月 18 日の廃止告知に書かれた Grok 4.5 の推奨代替は Grok 4.6 で、9 月 21 日の Grok 4.7 追加の告知に 4.5 の移行先としての記載はありません。公式の案内は 4.6 のままです。

4.7 へ直行するかどうかは、自分たちの判断になります。判断材料として置けるのは次の 3 点です。

  1. 単価は 4.6 と 4.7 で同額で、乗り換えても標準単価は変わりません
  2. 課金はどちらもトークン従量で、プレミアムリクエストの倍率ではありません
  3. 4.7 はトークン消費が増えるという第三者の指摘があります

移行作業を 1 回で終えたいなら 4.7 を候補にし、公式の案内どおりに進めたいなら 4.6 を選ぶ形です。どちらを選んでも、期日と担当者の管理は 10 月 19 日の廃止対応 と同じ進め方になります。

Cursor 側では、OpenAI モデルの提供停止が別に進んでいます。Grok 4.7 を代替として検討する場合も、移行方針そのものは Cursor の OpenAI モデル提供停止と 4 つの判断 を先に読んでください。本記事で扱うのは、Grok 4.7 の提供条件と費用の付き方までです。

FIXITFIXIT

4.6 に移す作業を始めたところなんだけど、無駄になる?

HayateHayate

無駄にはなりません。単価は同じですし、公式の推奨代替は 4.6 のままです。

試すときの進め方

比較になる形で試してください。手順は 4 つです。

  1. 同じリポジトリ・同じ依頼文・同じ対象ファイルで、Grok 4.6 と Grok 4.7 を流す
  2. テストの成否と、人が直した内容を記録する
  3. 試行の前後で使用量を確認し、同じ作業にかかったトークン量を並べる
  4. Cursor で試すなら、effort と速度ティアの設定を揃えてから比べる

2 番目までは他のモデルの比較と同じですが、3 番目が今回の要点です。従量課金なので、結果の良し悪しと同じ重さで消費量を見る必要があります。4 番目を飛ばすと、差が出た原因がモデルなのか effort なのか分からなくなります。

ツール単位でどう使い分けるかは Claude Code・Cursor・GitHub Copilot の比較 にまとめています。本記事はモデル単位の話なので、ツールの選定から検討している場合はそちらが先です。

設定と予算の確認から始めてください

Grok 4.7 について、9 月 22 日時点の公式資料で確認できるのは、対象プランとクライアント、トークン従量という課金の単位、そしてプラットフォームで異なる長文脈の閾値です。性能の比較は、この 3 点を押さえたあとで自分たちの作業に当てて判断してください。

まず今日やることを 1 つに絞るなら、Copilot 管理者としてモデルポリシーの現在の状態を確認する ところからです。既定の有効化を使っているなら、すでに選べる状態になっている可能性があります。

AI 駆動開発のクリエイティブスタジオである FIXIT の AI 開発ツール定着支援 では、モデルポリシーと従量課金の運用ルールづくりをご相談いただけます。組織で使う前提の設計を整えたい方は、お問い合わせ から現在の利用環境をお聞かせください。