Grok 4.7のベンチマークと料金|試すか併用か見送るか

Grok / xAI
ページの位置未計測

GROK 4.7 · MODEL GUIDE

数字から、
使いどころを決める。

読了時間の目安

しっかり読む
約27分
要点を読む
約17分

文字量と図表からの目安です。操作・実践の時間は含みません。

Grok 4.7は、コード作業や文書・調査業務で、用途に合う評価と利用条件がそろえば試す候補です。ベンチマークの順位だけで乗り換えを決めず、比較条件と支払い先まで合わせて選びます。

この記事では、公表値の読み方から、使える入口、開始前に止まって確認する条件までを整理します。特に、次のような人に向いています。

  • Grok 4.6や既存のAIから切り替える根拠を知りたい人
  • API・Cursor・Buildのどこで試すか迷っている人
  • 無料・月額・API課金を混同せず判断したい人

先に結論

まずは自分の用途を一つ選び、対象モデル・費用・データ条件がそろう経路で試す判断です。日本語品質の保証や、特定プランでの4.7利用が前提なら、その条件を確認するまで契約・全面移行を保留します。これは公表資料に基づく筆者の判断です。

Grokはサービス、Grok 4.7はそのモデル、Grok Buildはコーディングエージェントです。開発元の現行表記はSpaceXAIで、個人向け規約の契約主体は米国のSpaceXAI LLCです。4.7のモデル仕様はテキスト・画像入力とテキスト出力を扱います。Grok 4.7の公式仕様Grok Buildの公式案内個人向け利用規約

記事の版
更新版:2026年9月22日
一次情報の最終確認
2026年9月22日(日本時間)

本記事は公式一次情報をもとに構成しています。変わりやすい情報には確認日を付記しています。公式事実と筆者の判断を分け、非推奨条件まで示します。

公表資料を整理した記事であり、Grok 4.7の実機テストや実務性能の測定は行っていません。

主な確認先:Grok 4.7の公式発表公式API料金API・Buildのデータ条件

Grok 4.7は自分の用途で試すべきか

Grok 4.7を試すかは、出力を確認できるか、必要な品質を満たす根拠があるか、利用条件が合うかの3点で判断します。次の表で、自分に当てはまる行を一つ選んでください。

Grok 4.7 用途別の試用・併用・見送り判断表 (2026年9月22日確認)
公表資料をもとにした筆者の判断基準です。「試す候補」は全面採用の推奨ではありません。試用へ進む前に、入力許可・対象モデル・課金条件を確認します。条件の根拠:API料金データ条件
用途・重視する条件判断対応する公表評価分からないこと・止める条件利用先と次の確認
コード作業の候補を増やしたい。出力を確認できる試す候補コード系3指標。推論設定と実行環境の差を含む。開発元の評価自分のコードの品質・総費用は未確認。差分をレビューできず、既存テストなどで結果を確かめる手段もないなら保留対象モデルと課金を確認し、「既存テストを通る」「差分の理由を説明できる」など、自分の合格条件を先に決める
文書・調査などの知識業務で選択肢を増やしたい試す候補AA-Briefcase。同じ推論設定のEloを比較。評価の原典日本語品質・自分の仕事の完了率は不明。元資料と照合できない場合や、データ条件が未確認の場合は入力を保留入力してよい資料を選び、「原文と内容が一致する」「必要な根拠が残る」など、自分の合格条件を先に決める
ChatGPT・Claude等で既存業務が回っている併用を検討用途ごとの評価を追加候補の根拠にするモデルの得点だけで、サービス全体の置き換えは判断できない今の経路を残し、追加する用途を一つに絞る
日本語の自然さ・専門実務の品質保証を最優先する乗り換え判断は保留今回確認した評価だけでは根拠不足必要な品質が確認できない。「不得意」と断定する意味ではない何を満たせば使うかを先に決める
特定の一般チャットプラン・恒久無料・定額内の利用が前提契約判断は保留提供先・料金・無料条件の確認を優先4.7の一般チャット対応と具体的な無料枠は一括断定できない自分のアカウントで対象モデル・利用枠・支払い対象を確認する

必要に応じて表を横にスクロールできます。

判断の根拠:Grok 4.7の公式発表AA-Briefcaseの評価原典公式API料金API・Buildのデータ条件。比較条件と未確認の点を含めて読むための表です。(2026年9月22日確認)

  • 評価条件:評価元・推論設定・実行環境が違う結果を、同じ条件の成績として混ぜない。
  • 費用:トークン単価と仕事全体の費用は別。長い入力や生成量も確認する。
  • データ:保存・学習条件が不明な経路には、機密情報や入力許可のない資料を渡さない。

開発元は、Grok 4.6と同じ価格・提供速度での改善を発表しています。用途別の判断では、この訴求を出発点に、以下の公表評価と利用条件を照合します。

Grok 4.7のベンチマークで何が分かるか

Grok 4.7のベンチマークは、評価対象・推論設定・実行環境ごとに読み分ける必要があり、企業の順位や一部門の得点から全用途の品質は判断できません。ベンチマークとは、定められた課題と採点方法による比較評価です。

コーディング3指標は推論設定も読む

コード系の公表値は、同じ指標の中で数値と推論設定を一緒に読むと、候補を絞る材料になります。推論設定とは、モデルが回答を考える際の設定で、ここではHigh・xHigh・Maxなどの原典表記を残しています。

開発元の比較表は、原則として4.7がxHigh、4.6がHigh、SolとFableがMaxです。DeepSWEでは4.7もHighなので、他の指標の条件をそのまま当てはめないでください。設定名が同じでも、異なるモデルの計算予算まで同一とは限りません。(2026年9月22日確認) Grok 4.7の公式発表

BENCHMARK / 01

CursorBench 4.0

ソフトウェア開発 · 開発元公表値 · 0〜100%

46.3%Grok 4.7 / xHigh

+5.9 ポイント4.7 − 4.6の公表値差
4.7:xHigh / 4.6:High

Grok 4.7はxHigh、4.6はHighで設定が異なります。 破線は4.6の公表値。公表値の比較で、動きは表示演出です。(2026年9月22日確認) Grok 4.7の公式発表
BENCHMARK / 02

DeepSWE v1.1

ソフトウェア開発 · 開発元公表値 · 0〜100%

71.0%Grok 4.7 / High

+5.8 ポイント4.7 − 4.6の公表値差
4.7・4.6:ともにHigh

Grok 4.7はこの指標のみHigh。 破線は4.6の公表値。公表値の比較で、動きは表示演出です。(2026年9月22日確認) Grok 4.7の公式発表
BENCHMARK / 03

Terminal-Bench 4.0

長時間の端末作業 · 開発元公表値 · 0〜100%

38.0%Grok 4.7 / xHigh

+17.7 ポイント4.7 − 4.6の公表値差
4.7:xHigh / 4.6:High

Grok 4.7はxHigh、4.6はHighで設定が異なります。 破線は4.6の公表値。公表値の比較で、動きは表示演出です。(2026年9月22日確認) Grok 4.7の公式発表
コード系3指標の数値と推論設定 (2026年9月22日確認)
評価指標Grok 4.7Grok 4.6GPT-5.6 SolFable 5.1
CursorBench 4.046.3%
xHigh
40.4%
High
41.7%
Max
51.8%
Max
DeepSWE v1.171.0%
High
65.2%
High
72.7%
Max
70.0%
Max
Terminal-Bench 4.038.0%
xHigh
20.3%
High
37.3%
Max
57.9%
Max

この3指標では、4.7が4.6を上回る値が公表されています。ただし比較設定に差があり、すべての競合モデルを上回る結果でもありません。これを自分のコードの修正成功率や、完了までの時間へ置き換えることはできません。(2026年9月22日確認) Grok 4.7の公式発表

開発元は、難しい課題に長く取り組み、成果をより慎重に確認するようになったとも説明しています。公表値の背景にある改善方針として読めますが、利用者のレビューやテストが不要になるという意味ではありません。

知識業務は同じ推論設定で世代を比べる

文書・調査などの知識業務では、AA-Briefcaseの同じ推論設定の組を比較すると、設定差を一つ切り分けて読めます。Eloとは比較結果を相対的な評価値で表す尺度で、正答率や作業の完了率ではありません。

ここではxhigh同士とhigh同士を別々に示します。95%信頼区間は推定値の統計的な不確かさを表す区間であり、業務の95%が成功するという意味ではありません。評価方法を含めて読む必要があります。AA-Briefcaseの評価原典Artificial Analysisの評価方法

BENCHMARK / 04

AA-Briefcase v1.1

知識業務 · 同じ推論設定で世代を比較
Elo / 1500〜1750の拡大軸 / 帯は95%信頼区間

単位はElo。軸は1500〜1750で、ゼロ起点ではありません。白抜きの帯は4.6、薄い橙の帯は4.7の95%信頼区間で、縦線は中心値です。+102・+98は同じ推論設定同士のElo差です。線の長さは性能倍率を表しません。(2026年9月22日確認) AA-Briefcaseの評価原典
AA-Briefcase v1.1のEloと95%信頼区間 (2026年9月22日確認)
モデル推論設定Elo95%信頼区間
Grok 4.7xhigh16571648〜1666
Grok 4.6xhigh15551546〜1565
Grok 4.7high16441635〜1653
Grok 4.6high15461537〜1555

両設定の公表値で4.7が4.6を上回っていますが、その差から日本語の自然さや専門実務での適合まで保証することはできません。文書用途で試すなら、求める品質と入力できる資料の条件を先に決めるのが筆者の判断です。(2026年9月22日確認) AA-Briefcaseの評価原典

Artificial Analysisの発表も、知識業務とコーディングの改善を報告しています。一方、評価設定はxhighで、出力トークン量の増加も挙げています。

投稿中の「+111 Elo」は、4.7(xhigh)と4.6(high)の比較です。上の図は同じ推論設定を比べるため、xhigh同士では+102、high同士では+98になります。どの設定の組を比較しているかで差は変わります。AA-Briefcaseの評価原典

「企業3位」と「モデル4位」の対象を分ける

Artificial Analysisの発表では、Grok 4.7(xhigh)のIntelligence Indexは46で、SpaceXAIを「上位4社」に位置づけています。一方、Grok 4.7とGrok Buildを組み合わせたCoding Agent Indexは56で、各モデルを専用の実行環境(native harness)で比較したモデル順位は4位です。指標と比較対象をそろえて読んでください。(2026年9月22日確認) Artificial Analysisの発表

Musk氏の「企業3位」は、エージェント型コーディングでの開発元の位置づけを述べたものです。モデル順位では上位にAnthropicの2モデルが含まれるため、モデルの数と開発元の数は一致しません。全用途でGrok 4.7が総合3位だという意味には広げられません。

速度や低コストへの言及も、1件の作業の完了時間や総費用を保証するものではありません。Artificial Analysisは出力トークン量の増加を報告しているため、実務の費用は単価と使用量を合わせて見る必要があります。評価設定とトークン使用量の説明

また、AAのTerminal評価で使う実行環境と、開発元の比較表・native Grok Buildの評価は区別が必要です。順位を導入判断に使う前に、「どの指標・設定・環境の順位か」を確認してください。AAのTerminal評価条件

Grok 4.7の利用先はどこを選ぶか

Grok 4.7の利用先は、選択可能なモデルと課金方式で選ぶ必要があり、2026年9月22日の確認ではAPIとCursorで長文料金の適用境界が異なります。先に利用経路を決め、その経路の条件で費用を読んでください。公式API料金CursorのGrok 4.7仕様

既存の開発環境とAPIから入口を選ぶ

すでに使っている開発環境があるなら、まずそこで4.7を選べるか確認するのが入口になります。自作アプリから呼び出す場合はAPI、コード作業をエージェントへ依頼する場合はBuildなど、目的を分けます。

Grok 4.7の利用経路と確認先 (2026年9月22日確認)
経路対象・入口課金の読み方開始前に確認すること
xAI APIモデルIDはgrok-4.7APIのトークン従量課金認証、対象モデル、チームの制限。Grok 4.7の公式仕様
Grok Buildコーディングエージェント。4.7が既定モデルと案内無料試用の案内と、有料利用を区別選択モデル・無料対象・認証方法。Grok Buildの公式案内
CursorCursor経由で対象モデルを利用Cursor側の契約とモデル料金を確認対象アカウントと長文の適用境界。CursorのGrok 4.7仕様
GitHub CopilotPro/Pro+/Max/Business/Enterpriseへ段階展開との発表Copilot側の対象プラン・管理設定を確認展開・有効化・モデル表示。全員への完了とは断定しない。GitHub Copilotの公式提供案内
一般向けGrokチャット4.7を選べるプランの全体像は未確認月額プランの存在だけでは4.7対応を判断できない自分のアカウントのモデル表示。一般向けGrokの公式料金

BuildにはmacOS・Linux・WSL・Windows PowerShellの導入案内があります。一方、GrokサービスのWeb・iOS・Android対応は、それぞれの一般チャットで4.7を選べると確認した意味ではありません。(2026年9月22日確認) Grok Buildの公式案内個人向けの公式データ・利用FAQ

モデルとサービス全体の入口を整理したい場合は、Grok全体の使い方と基本設定も参考になります。

通常・長文・Fastの料金条件を分ける

API料金は、通常の単価だけでなく、入力長による区分とFastの提供条件を確認して読む必要があります。トークンとはモデルが文章などを処理する単位で、文字数やメッセージ数と同じではありません。

キャッシュ入力は、料金表で通常入力と区別されたキャッシュ対象の入力です。すべての入力がその単価になるとは限らないため、通常入力・キャッシュ入力・出力の3欄を分けて示します。公式API料金

公表トークン料金|米ドル/100万トークン (2026年9月22日確認)
FastはCursor・Build向けで、公開APIとBuild無料枠は対象外です。xAI料金表のFastで200,000トークンちょうどの扱いは未確認です。
区分・提供元入力長の条件入力キャッシュ入力出力
通常版・xAI API200,000未満$2$0.50$6
通常版・xAI API200,000以上$4$1$12
Fast・xAI料金表200,000未満$4$1$12
Fast・xAI料金表200,000超$6$1.50$18
通常版・Cursor長文欄256,000超$4$1$12
Fast・Cursor長文欄256,000超$6$1.50$18

出典:公式API料金CursorのGrok 4.7仕様。上表はモデルのトークン単価であり、一般向け月額契約や仕事全体の費用を示す表ではありません。(2026年9月22日確認)

境界に注意:xAI APIの通常版は入力200,000トークン以上で、長文単価がリクエスト全体へ適用されます。Cursor側は256,000トークン超という記載です。FastのxAI料金表は「未満/超」の表記で、200,000ちょうどの扱いを確認できていません。(2026年9月22日確認) 公式API料金CursorのGrok 4.7仕様

Fastは同じモデルを高速な基盤で提供する区分として案内され、確認時点ではCursor・Build向けで、公開APIとBuildの無料枠は対象外です。また、料金表の長文欄と倍率の説明が一致しないため、「常に通常版の2倍」とはまとめません。(2026年9月22日確認) Grok 4.7の公式仕様公式API料金

無料試用と有料契約の範囲を確認する

無料で試せる案内と、一般向け月額プランで4.7を使える条件は別々に確認します。Buildの無料試用とConsoleの無料Playgroundには案内がありますが、API通信が無料になるわけではありません。具体的な枠や終了日は今回確認した資料から特定できていません。(2026年9月22日確認) Grok 4.7の公式発表公式API・Playground案内

一般向けWeb料金ページはFreeが月額0米ドル、SuperGrokが30米ドル、SuperGrok Plusが100米ドルと表示しています。ただし、確認時のモデル表記には4.6があり、この金額だけで4.7の利用可否は判断できません。年額・日本円・購入経路別の総額も本記事では未確認です。(2026年9月22日確認) 一般向けGrokの公式料金

そのため、4.7のために契約するなら、対象アカウントでモデル表示と利用枠を先に確かめてください。個人向け契約全体を見直す時は、個人向けGrokの料金プランを比較するという別の確認も役立ちます。

Grok 4.7を使う前に何を確認するか

Grok 4.7の導入判断は、対象モデル・利用枠・入力データの扱いの確認を前提とし、API・個人チャット・Buildの条件を区別して行う必要があります。次の3項目で、不明なまま進めない条件を決めます。

  1. 自分のアカウントで対象モデルを確認する

    最初に確認するのは、使う経路にGrok 4.7が表示され、自分のアカウントで利用対象になっているかです。APIのモデルIDはgrok-4.7ですが、一般チャットやIDEの表示・管理条件を一律に同じとは扱いません。地域・アカウント差とCopilotの段階展開も留保します。(2026年9月22日確認) Grok 4.7の公式仕様公式API料金GitHub Copilotの公式提供案内

    表示されない場合は、すぐに不具合と決めつけず、提供先の案内と管理設定を確認してください。

  2. 入力する情報に合うデータ条件を確認する

    業務データを入れる前に、利用経路ごとの学習利用・保存・例外を確認します。APIの説明では、明示的な許可なく入出力を学習利用せず、標準の監査保存は30日です。ZDRは保存を抑えるための別条件で、機能制限や規約上の例外も読む必要があります。(2026年9月22日確認) API・Buildのデータ条件開発者・事業者向け利用規約

    個人向けチャットは、学習利用の可能性と除外設定があり、APIと同じ条件ではありません。Private Chatには学習対象外・30日以内の削除というFAQ説明がありますが、フィードバックなどの例外を含めて確認します。設定手順が必要なら、個人向けGrokのプライベートチャット設定へ進めます。(2026年9月22日確認) 個人向けの公式データ・利用FAQ

    Buildも、CLIの設定とWeb・モバイルのBuildモードを分けます。後者はセッションの保存・学習設定に従い、Private Chat非対応との説明があるため、名称だけで同じ保護条件だと判断しません。(2026年9月22日確認) API・Buildのデータ条件

    英語ヘルプの設定名としてImprove the Modelなどは確認していますが、現在の日本語UIの表記は未確認です。条件を確認できなければ、機密情報・個人情報を含む資料の入力を止め、公開資料など入力してよい情報に限ります。(2026年9月22日確認) 個人向けの公式データ・利用FAQ

  3. 利用枠と費用の確認先を決める

    使い始める前に、利用枠と支払いをどこで確認するか決めておくと、無料と有料の境界を見失いにくくなります。有料GrokのFAQは製品横断の週次利用枠を説明し、確認先を英語表記でSettings → Usageと案内しています。固定のメッセージ回数を本記事で補完しません。(2026年9月22日確認) Grokの公式FAQ

    API側の制限はチーム・モデル・利用階層ごとで、1秒あたりのリクエスト数を表すRPSや、1分あたりのトークン数を表すTPMなどで管理されます。チャットの会話回数とは別の制限です。追加利用や長文の課金条件が不明なら、範囲を確認するまで大量の入力・継続実行を保留してください。(2026年9月22日確認) 公式APIレート制限

Grok 4.7の仕様で混同しやすい点は?

Grok 4.7の仕様は、コンテキスト容量・検索による最新情報の取得・出力の商用利用を別々に読む必要があり、一つの仕様から他の利用条件を判断することはできません。最後に、使う前に取り違えやすい3点を確認します。

コンテキスト50万は出力50万の意味?

Grok 4.7の50万トークンというコンテキスト仕様は、出力を50万トークン生成できるという意味ではなく、会話で扱う情報量の条件です。コンテキストとは、モデルが処理時に参照する情報の範囲を指します。

公式の出力欄はNo text output limitと表記していますが、課金・利用枠が無制限になるという意味には広げられません。コンテキスト容量、出力の扱い、利用経路の制限を分けて確認してください。(2026年9月22日確認) Grok 4.7の公式仕様

Grok 4.7のモデル知識と検索ツールによる情報取得は別であり、モデルを選ぶだけで最新のX投稿を常に把握しているとは判断できません。最新情報が必要な質問では、利用経路の検索機能と、回答が示す出典・日付を確認します。

情報が新しいかどうかと、その内容が正しいかどうかも別の確認です。検索結果が付いていても、元の投稿や公式ページまで戻って採用する情報を選んでください。モデルと検索ツールの公式説明

出力を商用利用する時の条件は?

Grokの出力は適用規約の範囲で商用利用できますが、利用経路ごとの契約条件や第三者の権利を確認する必要があります。個人向けFAQの許可だけで、API・法人契約の全条件まで同一とは判断しません。

生成物を仕事に使う時は、適用される規約と帰属表示の条件を読み、内容や権利を確認してください。商用利用の許可は、出力に誤りや権利侵害がない保証ではありません。(2026年9月22日確認) 個人向けの公式データ・利用FAQ個人向け利用規約開発者・事業者向け利用規約公式の名称・帰属表示ガイド

まとめ|Grok 4.7の判断をいつ見直すか

Grok 4.7の選定は、使う用途・提供先・料金・データ条件が変わった時に見直す判断であり、現時点で不足する条件があれば、その確認を次の行動にします。公表評価だけで全面移行を決めず、条件のそろう用途から候補に入れるのが本記事の結論です。

今取る行動は、判断表から自分に当てはまる行を一つ選び、未解決の条件を一つ確認することです。それが解消すれば試す範囲を決められ、解消しなければ契約や情報入力を保留できます。

利用するモデルや提供先、料金・利用枠、データの扱いが変わった時は、この判断表の条件を確認し直してください。

引用元・参考情報

ブログをメールで購読

学べるブログの更新・重要アップデート(Grok/Gemini など)を、メールで受け取れます。無料。いつでも解除できます。更新時(週1〜2回目安)

Grok / xAI

コメント

学べるブログをもっと見る

今すぐ購読し、続きを読んで、すべてのアーカイブにアクセスしましょう。

続きを読む

学べるブログをもっと見る

今すぐ購読し、続きを読んで、すべてのアーカイブにアクセスしましょう。

続きを読む