室谷代表取締役Grok 4.7は、xAIが2026年9月21日に発表したコーディングとナレッジワーク向けの最先端モデルで、長時間の難タスクに取り組みながら自己検証と長い文脈の管理を強化したのが特徴なんですよね。発表と同時にMicrosoft Foundryでも使えるようになった、というのが今回の速報です。
テキトー教師DotAI 認定講師単に新モデルが出たという話じゃないんですよ。xAIの公式発表では「SpaceXAI's most powerful model for coding and knowledge work」と位置づけられていて、Grok 4.6と同じ価格・同じ速度で提供しながら性能を上げてきた、というのがポイントなんです。
室谷代表取締役そこが実務者としては一番気になるところで。安く速くなったというより、価格と速度を据え置いて中身を強化した、という整理ですよね。
テキトー教師DotAI 認定講師まず前提をそろえておくと、Grok 4.7を提供しているのはxAIです。今回xAIが発表したのは、そのGrok 4.7がMicrosoft Foundry上でも利用可能になったという提供範囲の拡大です。
Microsoft FoundryはAzure上で各種AIモデルをAPI経由でデプロイ・利用できるMicrosoftのプラットフォームで、Azure OpenAIのモデルに加えて他社製モデルも並んでいます。
Microsoft FoundryはAzure上で各種AIモデルをAPI経由でデプロイ・利用できるMicrosoftのプラットフォームで、Azure OpenAIのモデルに加えて他社製モデルも並んでいます。
室谷代表取締役ここ、発表元と提供元を混同しやすいところなんですよね。モデルを作っているのはxAI、Foundryはそのモデルを載せるMicrosoft側の基盤です。
MYUUUでも複数のモデルをルーター経由で使い分ける構成をよく組むんですが、Foundryのようにモデル一覧が一箇所にまとまっている場所に新しいモデルが入るのは、乗り換えや併用のハードルが下がるという意味で大きいんですよ。
MYUUUでも複数のモデルをルーター経由で使い分ける構成をよく組むんですが、Foundryのようにモデル一覧が一箇所にまとまっている場所に新しいモデルが入るのは、乗り換えや併用のハードルが下がるという意味で大きいんですよ。
Grok 4.7とは?xAIがMicrosoft Foundryで提供開始した最新モデル
Grok 4.7の主な特徴
より大きなベースモデル
Grok 4.6より大きなベースモデルを採用
長時間タスク重視の強化学習
何時間もかかる難しいタスクを重視した長めの強化学習で訓練
自己検証の精度向上
自己検証の精度が向上
長いコンテキストの管理向上
長いコンテキストの管理が向上
Grok Botのハーネスをネイティブ理解
会話的なタスクや一般的なナレッジワークが得意に
新しいセーフガード群
拒否とジェイルブレイク耐性のテストでxAIが試した中で最も強いモデル
テキトー教師DotAI 認定講師公式ページによると、Grok 4.7はGrok 4.6より大きなベースモデルを採用していて、何時間もかかるような難しいタスクを重視した長めの強化学習で訓練されたと説明されています。自己検証の精度と、長いコンテキストの管理が向上しているのが柱です。
室谷代表取締役長時間タスクを重視した、というのが今回の一番の変化点なんですよね。短い質問に答える能力より、何十ステップもかかる作業を最後までやり切る能力に振ってきている。
これはエージェント的に使う前提の設計だと読めます。
これはエージェント的に使う前提の設計だと読めます。
テキトー教師DotAI 認定講師もう一つ見落とせないのが、Grok Botのハーネスをネイティブに理解するように訓練されている点です。会話的なタスクや一般的なナレッジワークが得意になったと公式に書かれています。
室谷代表取締役ハーネス側をモデルが理解する、というのは地味に効くんですよ。ツールの呼び出し方や作業の進め方をモデルが最初から分かっている前提だと、プロンプトで毎回細かく指示しなくて済む。
講座でもエージェント構築のつまずきはだいたいこの辺りなので、そこが標準で押さえられているのは受講生さんにも説明しやすい変化です。
講座でもエージェント構築のつまずきはだいたいこの辺りなので、そこが標準で押さえられているのは受講生さんにも説明しやすい変化です。
テキトー教師DotAI 認定講師安全性についても触れておきましょう。Grok 4.7はまったく新しいセーフガード群で構築されていて、拒否とジェイルブレイク耐性のテストでxAIが試した中で最も強いモデルだとしています。
室谷代表取締役拒否しすぎて仕事にならない、というのは実務では本当に困るんですよね。そのバランスの話は後のセクションで数字を見ながらやりましょう。
Grok 4.7でできること――コーディング・ナレッジワーク・専門業務での実力
Grok 4.7のベンチマーク比較(Grok 4.6 / GPT-5.6 Sol / Fable 5.1との対比)
| ベンチマーク | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol | Fable 5.1 |
|---|---|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% | 41.7% | 51.8% |
| DeepSWE v1.1 | 71.0% | 65.2% | 72.7% | 70.0% |
| EEBench | 64.0% | 53.0% | 39.4% | 56.4% |
| Harvey Legal Agent | 19.6% | 15.8% | 2.5% | 6.7% |
| AA Briefcase v1.1 | 1,657 | 1,546 | 1,487 | 1,678 |
| Terminal-Bench 4.0 | 37.6% | 20.3% | 37.3% | 57.9% |
| HealthBench Professional | 56.7% | 48.5% | 60.5% | 62.1% |
| GDPval Elo | 1,695 | 1,605 | 1,542 | 1,735 |
テキトー教師DotAI 認定講師公式が挙げている用途を整理すると、コーディング、ナレッジワーク、文書やプレゼンの作成、法務・医療といった専門業務です。ベンチマークもその領域に合わせて並んでいます。
室谷代表取締役具体的な数字を見ていくと、まずCursorBench 4.0がGrok 4.7で46.3%です。これは長時間走るコーディングタスクを評価するベンチマークで、Grok 4.6 Highが40.4%、GPT-5.6 Sol Maxが41.7%、Fable 5.1 Maxが51.8%という並びになっています。
テキトー教師DotAI 認定講師ソフトウェアエンジニアリングではDeepSWE v1.1もあって、Grok 4.7が71.0%(high effort時)、Grok 4.6が65.2%、GPT-5.6 Solが72.7%、Fable 5.1が70.0%です。
室谷代表取締役ここで注目したいのは、CursorBenchでGrok 4.7がGrok 4.6を上回っていることと、価格との組み合わせなんですよね。単体のスコアだけ見れば上にいるモデルもありますが、公式は「frontier in price-performance」と表現していて、コストあたりで見たときに前に出ると主張している。
テキトー教師DotAI 認定講師専門業務の数字も見ておきましょう。電気工学のEEBenchはGrok 4.7が64.0%で、Grok 4.6が53.0%、GPT-5.6 Solが39.4%、Fable 5.1が56.4%です。
室谷代表取締役ここは差がはっきり出ていますよね。あと面白いのが法務で、Harvey Legal Agent BenchmarkがGrok 4.7で19.6%、Grok 4.6が15.8%、GPT-5.6 Solが2.5%、Fable 5.1が6.7%です。
テキトー教師DotAI 認定講師数時間単位のオフィスワークを見るAA Briefcase v1.1はGrok 4.7が1,657、Grok 4.6が1,546、GPT-5.6 Solが1,487、Fable 5.1が1,678です。ターミナル作業のTerminal-Bench 4.0はGrok 4.7が37.6%、Grok 4.6が20.3%、GPT-5.6 Solが37.3%、Fable 5.1が57.9%となっています。
室谷代表取締役臨床推論のHealthBench ProfessionalはGrok 4.7が56.7%、Grok 4.6が48.5%、GPT-5.6 Solが60.5%、Fable 5.1が62.1%です。
テキトー教師DotAI 認定講師全部を並べると、Grok 4.6からは軒並み改善している一方で、項目によっては他モデルが上にいる、というのが正確なところです。公式もGDPvalやAA Briefcaseについて「他最先端モデルと同等」と表現していて、全項目でトップとは言っていません。
室谷代表取締役そこは正直に伝えたほうがいいですよね。GDPvalのEloスコアはFable 5.1 maxが1,735、Grok 4.7 xhighが1,695、Grok 4.6 highが1,605、GPT-6 Astra maxが1,542という並びです。
テキトー教師DotAI 認定講師講座で受講生さんによく言うのは、ベンチマークは自分のタスクで測り直すのが前提だということです。今回の数字はコーディングと専門業務に寄っているので、そのまま日本語の事務作業の実力だと思わないほうがいいんですよ。
室谷代表取締役そうそう。ただ、長時間タスクと自己検証に振っている方向性は、エージェントに仕事を任せる使い方と素直に噛み合います。
xAIの動画生成まわりについてはxAI、画像-to-動画「Grok Imagine Video 1.5」公開でも整理していますが、Grokシリーズ全体で用途が広がっている流れの中の一本だと見ると分かりやすいです。
xAIの動画生成まわりについてはxAI、画像-to-動画「Grok Imagine Video 1.5」公開でも整理していますが、Grokシリーズ全体で用途が広がっている流れの中の一本だと見ると分かりやすいです。
Grok 4.7の料金と提供範囲――日本で使える?いつから?
Grok 4.7の料金プランと提供範囲
料金
- 入力: 100万トークンあたり2ドルから
- 出力: 100万トークンあたり6ドルから
- Grok 4.6と同価格
- 高速版(出力速度2倍)は価格も2倍
提供チャネル
- Cursor
- Grok Build
- Grok API
- サードパーティのコーディングハーネス
- モデルルーター
- クラウドプラットフォーム(Microsoft Foundryなど)
テキトー教師DotAI 認定講師料金は公式ページに明記されていて、入力100万トークンあたり2ドル、出力100万トークンあたり6ドルからです。Grok 4.6と同価格です。
室谷代表取締役さらに、出力速度が2倍の高速版が価格も2倍で用意されている、と書かれています。速度に金を払う選択肢が公式で用意されているのは実務では助かりますよね。
テキトー教師DotAI 認定講師提供範囲は、CursorとGrok Buildでその日から利用可能、加えてGrok API、サードパーティのコーディングハーネス、モデルルーターやクラウドプラットフォーム経由でも使えるとされています。
室谷代表取締役ここが今回の速報の核心で、そのクラウドプラットフォームの一つがMicrosoft Foundryなんですよ。つまりxAIの公式発表では提供チャネルが複数挙げられていて、そのうちのFoundryでの提供開始が今回のニュース、という構造です。
テキトー教師DotAI 認定講師日本からの利用可否についてですが、MicrosoftのドキュメントではGrok 4.7 version 1がFoundry Models sold by Azureの一覧に載っていて、Global StandardとData Zone Standard(US)の両方で提供されています。
室谷代表取締役デプロイ種別ごとの違いも押さえておきたいですよね。Global Standardは同じモデル・同じバージョンのデプロイが全リージョンで1つのクォータプールを共有し、Data Zone Standardはデータゾーンごとにプールを共有する、という管理になっています。
テキトー教師DotAI 認定講師クォータはサブスクリプション単位の管理で、ティアごとにTPMとRPMが決まっています。Free TierはTPM 0、RPM 0です。
室谷代表取締役無料枠では使えない、というのは最初に知っておかないとハマるポイントですよね。Tier 1で80,000 TPM/80 RPM、Tier 2で315,000 TPM/315 RPM、Tier 3で1,000,000 TPM/1,000 RPM、Tier 4で2,000,000 TPM/2,000 RPM、Tier 5で10,000,000 TPM/10,000 RPM、Tier 6で15,000,000 TPM/15,000 RPMという並びです。
テキトー教師DotAI 認定講師デプロイ容量1単位あたり1,000 TPMと1 RPMが提供される、という説明も公式にあります。
室谷代表取締役日本のリージョンで使えるかどうかについては、提供されているデプロイ種別の一覧に日本リージョンの記載はなく、現時点で日本国内リージョンでの提供が明らかにされているわけではありません。ただしGlobal Standardはデプロイされた任意のAzureリージョンで推論が処理されうる種別なので、日本から使えないという意味ではない、という整理になります。
テキトー教師DotAI 認定講師この辺はデータの扱いの話なので、業務で使うなら自社の要件と突き合わせて確認が必要です。Data Zone Standard(US)はUSデータゾーン内で処理される、という違いがあります。
室谷代表取締役あとFoundry側の運用として、クォータは2026年5月7日以降、サブスクリプション単位の管理に移行しつつあるとMicrosoftが説明しています。既存の承認済みクォータはそのままサブスクリプション単位で適用される、とされています。
テキトー教師DotAI 認定講師モデルがアップグレードされたときのクォータ上限は、適用されるティア上限と、そのスコープ内の既存デプロイに割り当てられた合計クォータの大きいほうが設定される、というルールも書かれています。
Grok 4.7の使い方・始め方――Microsoft Foundryでのアクセス方法
テキトー教師DotAI 認定講師使い方は大きく2つです。xAI側から直接使うルートと、Microsoft Foundry経由でデプロイして使うルートです。
室谷代表取締役xAI側のルートは、公式ページにコード例が載っていましたよね。Pythonのxai_sdk、TypeScriptの@ai-sdk/xai、OpenAI SDK互換、cURLの4パターンが示されていて、モデル名はgrok-4.7、ベースURLはapi.x.ai/v1です。
テキトー教師DotAI 認定講師整理するとこうです。
- xAIのAPI: モデル名 grok-4.7、エンドポイント https://api.x.ai/v1 、APIキーはAPI Consoleで発行
- Grok Build: 無料で試せる。公式ページにインストール用のコマンドが掲載
- Cursor: 発表当日から利用可能
- Microsoft Foundry: Azure上でモデルをデプロイしてAPI経由で利用。デプロイ種別はGlobal StandardまたはData Zone Standard(US)
室谷代表取締役OpenAI SDK互換で書けるのは大きいですよね。既存のコードのベースURLとモデル名を差し替えるだけで試せるので、検証コストがかなり低い。
テキトー教師DotAI 認定講師Foundry経由の場合は、モデルのデプロイとクォータの割り当てが必要です。Free TierはTPM 0なので、まずティアを上げるか、既存デプロイからクォータを移す必要があります。
室谷代表取締役クォータが足りないときは増枠リクエストを出すことになりますが、Microsoftのドキュメントでは需要が高いため個別に評価されると書かれています。パートナーやコミュニティ由来のモデルは増枠リクエストに対応していない、という記載もあるので、そこは注意です。
テキトー教師DotAI 認定講師レート制限に当たったときはHTTP 429が返るので、Retry-Afterヘッダーを使って指数バックオフで再試行する、というのが公式の推奨です。
室谷代表取締役タイムアウトの目安も書いてありましたね。推論モデルは最大29分、非推論モデルはストリーミングで最大60秒、非ストリーミングで最大29分です。
長時間タスクを走らせる前提なら、クライアント側のタイムアウトを明示的に設定しておくのが必須です。
長時間タスクを走らせる前提なら、クライアント側のタイムアウトを明示的に設定しておくのが必須です。
テキトー教師DotAI 認定講師
室谷代表取締役あとGrok Build側の拡張だと、xAI、Grok BuildにFirecrawlプラグイン追加――Webクロール機能を拡張という動きもありました。Grok 4.7がGrok Botのハーネスをネイティブに理解するよう訓練されている話と合わせると、xAIが自前の実行環境とモデルをセットで強くしていく方向が見えます。
Grok 4.6からの変更点とベンチマーク――何がどこまで進化したか
テキトー教師DotAI 認定講師Grok 4.6からの変更点を公式の説明から整理すると、ベースモデルの大型化、長時間かかる難タスクを重視した長めの強化学習、自己検証能力の向上、長いコンテキスト管理の改善、Grok Botハーネスのネイティブ理解、新しいセーフガード群の搭載です。
室谷代表取締役価格と速度は据え置きなので、そこは変わっていないという点もセットで覚えておきたいですよね。
テキトー教師DotAI 認定講師ベンチマークの差分を表にするとこうなります。
| ベンチマーク | Grok 4.7 | Grok 4.6 |
|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% |
| DeepSWE v1.1 | 71.0%(high effort) | 65.2% |
| EEBench | 64.0% | 53.0% |
| AA Briefcase v1.1 | 1,657 | 1,546 |
| Terminal-Bench 4.0 | 37.6% | 20.3% |
| Harvey Legal Agent Benchmark | 19.6% | 15.8% |
| HealthBench Professional | 56.7% | 48.5% |
室谷代表取締役Terminal-Bench 4.0が20.3%から37.6%に伸びているのが目を引きますよね。数時間単位のターミナル作業というのは、まさにエージェントに任せたい領域です。
テキトー教師DotAI 認定講師一方で、CursorBench 4.0は40.4%から46.3%で、伸び幅としては5.9ポイントです。公式はこのベンチマークで価格性能比の frontier にいると主張しています。
室谷代表取締役安全性の数字も見ておきましょう。公式によると、Grok 4.7はサイバーセキュリティや生物分野のようなデュアルユース領域で、良性タスクの実用性と危険な要求への安全な拒否の両方でリードしているとされ、LatchBioのバイオセーフティベンチマークで62.4%を記録しています。
テキトー教師DotAI 認定講師サイバー側ではHackerBench v0.3で最も高い安全性を示し、リスクのあるデュアルユースのプロンプトのうち通したのは3.3%のみ、かつ正当なセキュリティ業務をブロックすることはほとんどなかったと説明されています。
室谷代表取締役拒否率が低いのに危険なものは通さない、という両立を数字で示しているわけですね。あと、選定されたサイバーセキュリティパートナーにGrok 4.7のレッドチーム能力への招待制アクセスを始めた、という記述もありました。
テキトー教師DotAI 認定講師ここは防御研究向けの取り組みとして書かれているので、一般ユーザーが使える機能ではない点は区別しておきましょう。
Grok 4.7と他モデルの比較――価格性能比と立ち位置
テキトー教師DotAI 認定講師公式ページにはGrok 4.7、Grok 4.6、GPT-5.6 Sol、Fable 5.1のトークン価格が並んでいます。入力100万トークンあたりでGrok 4.7が2ドル、Grok 4.6が2ドル、GPT-5.6 Solが4ドル、Fable 5.1が10ドルです。
室谷代表取締役出力はGrok 4.7が6ドル、Grok 4.6が6ドル、GPT-5.6 Solが20ドル、Fable 5.1が50ドルです。入力・出力ともにGrok 4.7はGrok 4.6と同じで、他2モデルより低い水準に置かれています。
テキトー教師DotAI 認定講師性能と価格を並べると、CursorBench 4.0ではFable 5.1 Maxが51.8%でGrok 4.7が46.3%、GPT-5.6 Sol Maxが41.7%です。単体スコアではFable 5.1が上ですが、価格は入力10ドル・出力50ドルです。
室谷代表取締役だから公式が「Twice as fast, at half the price of comparable models」と表現しているわけですね。ここはxAIの主張であることを明確にした上で紹介するのが正確です。
テキトー教師DotAI 認定講師ベンチマークごとに順位が入れ替わる点も整理しておきましょう。EEBenchとHarvey Legal Agent BenchmarkではGrok 4.7が4モデル中で最も高い数値です。
一方、HealthBench ProfessionalではFable 5.1が62.1%、GPT-5.6 Solが60.5%でGrok 4.7の56.7%より上です。
一方、HealthBench ProfessionalではFable 5.1が62.1%、GPT-5.6 Solが60.5%でGrok 4.7の56.7%より上です。
室谷代表取締役Terminal-Bench 4.0もFable 5.1が57.9%でGrok 4.7の37.6%より上です。全部で勝っているわけではない、というのはきちんと書いておきたいですよね。
テキトー教師DotAI 認定講師平均コスト・トークン数・ステップ数で見た散布図も公式ページには掲載されていて、Grok 4.7が価格性能比の frontier にいると説明されています。
室谷代表取締役モデル選びの実務感覚で言うと、単体スコアの1位を追うより、タスクあたりのコストで見て十分な性能が出るモデルを選ぶほうが効くんですよね。そういう意味でこの価格帯でこのスコア、という見方は現場の判断と相性がいい。
テキトー教師DotAI 認定講師モデル全体の比較の考え方については、ChatGPTとClaudeを徹底比較【2026年最新】:料金・性能・プログラミング・使い分けを完全解説でも整理しています。料金体系の変遷を追いたい場合はChatGPTはいつから?リリースの歴史・モデル進化・料金プラン・最新動向を完全解説【2026年最新】も参考になります。
室谷代表取締役なお、コンテキストウィンドウの具体的なトークン数やパラメータ数については、今回の公式発表および背景資料では明らかにされていません。ここは憶測で埋めずに、続報を待つしかないですね。
テキトー教師DotAI 認定講師同様に、Grok 4.7の日本語性能に特化した評価も現時点では示されていません。
Grok 4.7に関するよくある質問
テキトー教師DotAI 認定講師ここまでの内容を、よく聞かれる形で整理しておきます。
室谷代表取締役まず「Grok 4.7はいつから使えるのか」ですが、xAIの発表は2026年9月21日で、CursorとGrok Buildではその日から、Grok APIやサードパーティのハーネス、モデルルーター、クラウドプラットフォーム経由でも利用可能とされています。Microsoft Foundryでも提供が始まっています。
テキトー教師DotAI 認定講師「料金はいくらか」は、入力100万トークンあたり2ドル、出力100万トークンあたり6ドルからです。出力速度2倍の高速版は価格も2倍です。
Grok 4.6と同価格です。
Grok 4.6と同価格です。
室谷代表取締役「日本から使えるのか」については、xAIのAPIやGrok Build、Cursorといったルートは日本から利用できます。Microsoft Foundry経由の場合は、Grok 4.7 version 1がGlobal StandardとData Zone Standard(US)で提供されており、日本国内リージョンでの提供は現時点で明らかにされていません。
テキトー教師DotAI 認定講師「無料で使えるのか」は、Grok Buildで無料で試せると公式に案内があります。一方、Microsoft FoundryのFree TierはTPM 0、RPM 0なので、Foundry経由では有料ティアが必要です。
室谷代表取締役「Grok 4.6と何が違うのか」は、ベースモデルの大型化、長時間の難タスクを重視した強化学習、自己検証と長い文脈管理の改善、Grok Botハーネスのネイティブ理解、新しいセーフガード群の搭載です。価格と速度はGrok 4.6と同じです。
テキトー教師DotAI 認定講師「コンテキストウィンドウやパラメータ数は」という質問については、今回の発表では明らかにされていません。
室谷代表取締役「他モデルと比べてどうなのか」は、CursorBench 4.0やEEBench、Harvey Legal Agent BenchmarkではGrok 4.7が優位、HealthBench ProfessionalやTerminal-Bench 4.0では他モデルが上、というようにベンチマークごとに結果が分かれます。価格は入力2ドル・出力6ドルで、比較対象として公式が挙げているモデルより低く設定されています。
テキトー教師DotAI 認定講師最後に、講座で受講生さんによく言うのは、発表直後のベンチマークは公式の主張であることが多いので、自分のタスクで小さく試してから本番導入を決めるのが安全だということです。Grok 4.7はOpenAI SDK互換で呼べるので、その検証は今日から始められますよ。
室谷代表取締役そうですね。長時間タスクと自己検証に振ったモデルが、この価格で複数のプラットフォームから使えるようになった、というのが今回のニュースの本質です。
まずはGrok BuildかAPIで触ってみて、業務で回すならFoundryのクォータ設計とセットで考える、という順番が現実的だと思います。
まずはGrok BuildかAPIで触ってみて、業務で回すならFoundryのクォータ設計とセットで考える、という順番が現実的だと思います。
