Grok 4.7発表、コーディングと知識業務を強化—安全対策も刷新のアイキャッチ画像

AI Grok SpaceX 新情報・新機能

Grok 4.7発表、コーディングと知識業務を強化—安全対策も刷新

※本記事は広告が含まれる場合があります。

出典:X(@SpaceXAI)

SpaceXAIは2026年9月21日、コーディングと知識業務に向けた新モデル「Grok 4.7」を発表しました。Grok 4.6より大きな基盤モデルを採用し、長時間に及ぶ難しいタスクへの対応や自己検証、長いコンテキストの管理を強化しています。

みつた

こんにちは。SpaceXAIが、コーディングや知識業務、長時間タスクへの対応力を高め、安全対策も刷新した「Grok 4.7」を発表しました。

この記事のチェックポイント

  • Grok 4.6より大きな基盤モデルを採用し、長時間のタスクへの対応や自己検証能力を強化
  • CursorBench 4.0では46.3%、EEBenchでは64.0%を記録
  • 拒否判断や脱獄耐性を含む安全対策を刷新
  • 料金は入力100万トークンあたり2ドル、出力100万トークンあたり6ドルから
  • Cursor、Grok Build、Grok APIなどで提供

Grok 4.7とは

SpaceXAIが発表したGrok 4.7は、コーディングと知識業務に重点を置いたモデルです。難しいタスクにより長く取り組み、自らの作業をより慎重に確認できるよう設計されています。

提供価格と速度はGrok 4.6と同じです。SpaceXAIは、長時間のコーディングタスクを扱うCursorBench 4.0において、Grok 4.7が価格性能の面で最前線に位置すると説明しています。

Grok 4.6からの主な改善点

Grok 4.7は、Grok 4.6より大きな新しい基盤モデルを使用しています。強化学習をより長く実施するとともに、完了まで何時間もかかる問題を重視した、より難しいタスク構成でトレーニングされました。

主な改善点は次の通りです。

  • 自らの作業を検証する能力の向上
  • 長いコンテキストを管理する能力の強化
  • 長時間に及ぶ難しいタスクへの対応
  • Grok Botのハーネスをネイティブに理解
  • 会話型タスクと一般的な知識業務への対応強化

ベンチマーク結果

公開された比較では、Grok 4.7 xHighとGrok 4.6 Highのスコアは以下の通りです。

分野 ベンチマーク Grok 4.7 Grok 4.6
ソフトウェアエンジニアリング CursorBench 4.0 46.3% 40.4%
ソフトウェアエンジニアリング DeepSWE v1.1 71.0%(高労力設定) 65.2%
電気工学 EEBench 64.0% 53.0%
長時間のオフィス業務 AA Briefcase v1.1 1,657 1,546
長時間のターミナル作業 Terminal-Bench 4.0 38.0% 20.3%
法務業務 Harvey Legal Agent Benchmark 19.6% 15.8%
臨床推論 HealthBench Professional 56.7% 48.5%

Grok 4.7は、文書やプレゼンテーションの作成能力も改善しています。弁護士、看護師、金融アナリストなどの専門職が行うタスクを扱うGDPvalとAA Briefcaseでは、いずれもGrok 4.6を上回りました。

GDPvalのEloスコアは、Grok 4.7 xHighが1,695、Grok 4.6 Highが1,605です。比較対象ではFable 5.1 maxが1,735、GPT-6 Astra maxが1,542とされています。

安全対策とサイバーセキュリティ

Grok 4.7では、安全対策の仕組みが全面的に刷新されました。SpaceXAIによると、同社がテストしたモデルの中で、拒否判断と脱獄耐性が最も強いモデルです。

サイバーセキュリティや生物学のようなデュアルユース領域では、無害なタスクへの有用性と危険な要求への安全な拒否の両面で優れていると説明されています。LatchBioのバイオセーフティーベンチマークでは62.4%を記録しました。

危険または悪意のあるサイバータスクを評価するHackerBench v0.3では、リスクのあるデュアルユースの指示を通過させた割合が3.3%でした。一方で、正当なセキュリティ業務を拒否するケースは少ないと説明されています。

また、一部のサイバーセキュリティパートナーを対象に、防御研究向けのレッドチーム機能を招待制で提供し始めています。

価格と高速版

Grok 4.7の料金は、以下の価格から設定されています。

  • 入力:100万トークンあたり2ドル
  • 出力:100万トークンあたり6ドル

Grok 4.6と同じ価格です。さらに、出力速度を2倍にした高速版も用意され、料金は通常版の2倍となります。

提供先

Grok 4.7は、2026年9月21日時点で以下のサービスや環境から利用できます。

  • Cursor
  • Grok Build
  • Grok API
  • サードパーティー製のコーディングハーネス
  • モデルルーター
  • クラウドプラットフォーム

Grok Buildでは無料で試すこともできます。

まとめ

Grok 4.7は、Grok 4.6と同じ価格・速度を維持しながら、コーディング、専門的な知識業務、長時間タスクへの対応を強化したモデルです。新しい基盤モデルと従来より長い強化学習に加え、安全対策も刷新されています。CursorやGrok Build、APIなど複数の環境で提供されており、通常版に加えて出力速度を高めた高速版も選択できます。

情報元・出典:

-AI, Grok, SpaceX, 新情報・新機能