SpaceXAIは、コーディングおよび知識集約型の業務において最も強力な選択肢となるよう設計された新しいAIモデル、Grok 4.7 をリリースしたと21月に発表しました。このモデルは、前身であるGrok 4.6 よりも大きなベースモデルを利用しており、複雑で長期間にわたるタスクに焦点を当てた拡張的な強化学習が行われています。これらのアップデートにより、モデルの自己検証能力と、より長いコンテキストの管理能力が向上したと報告されています。
ベンチマークテストにおいて、Grok 4.7 は特定の領域で大幅な性能向上を示しました。長期間のコーディングタスクを対象としたCursorBench 4.0 ベンチマークでは、Grok 4.7 は 46.3% のスコアを記録し、Grok 4.6 (40.4%) および OpenAIのGPT-5.6 Sol (41.7%) を上回りましたが、AnthropicのClaude Fable 5.1 (51.8%) には及びませんでした。また、EEBench (64.0%) や、法務タスク向けのHarvey Legal Agent Benchmark (19.6%) においても、テストされたモデルの中で最高位を記録しました。
このモデルは、拒絶(refusal)およびジェイルブレイクに対する耐性を向上させるために、完全に再設計されたセーフガード・スタックを特徴としています。悪意のあるサイバータスクを対象としたHackerBench v0.3 ベンチマークでは、リスクのあるデュアルユース(軍民両用)のプロンプトの通過をわずか 3.3 %に抑える一方で、正当なセキュリティ業務におけるブロックは最小限に抑えていると報告されています。
Grok 4.7 は、Cursor、Grok Build、およびGrok APIを通じて直ちに利用可能です。APIの価格は、入力トークンが $2 per 百万トークン、出力トークンが $6 per 百万トークンからとなっています。また、同社は、コストは2倍になるものの、出力速度が2倍になる高速バリアントも提供しています。
出典
- SpaceXAI、「Grok 4.7」発表 コーディングと知識労働向けで同社最高性能、価格は据え置き (ITmedia AI+, 2026-09-22)
- 公式ブログ