SpaceXAI、Grok 4.7公開 Grok 4.6と同価格で性能向上

SpaceXAI(xAI)は2026年9月21日、コーディングと知識労働向けの最上位モデル「Grok 4.7」を公開しました。価格と速度はGrok 4.6と同じで、入力100万トークンあたり2ドル、出力100万トークンあたり6ドルです。SpaceXAIは、同クラスの他社モデルの半額で2倍の速さだとしています。Cursor、Grok Build、Grok APIのほか、サードパーティのコーディングハーネス、モデルルーター、クラウドプラットフォームから当日から利用できます。

ベンチマーク: Grok 4.6から全項目で改善

SpaceXAIが公開した比較表は次のとおりです。Grok 4.7はxHigh、Grok 4.6はHigh、GPT-5.6 SolとClaude Fable 5.1はMaxの設定です。

項目 Grok 4.7 xHigh Grok 4.6 High GPT-5.6 Sol Max Fable 5.1 Max
入力トークン価格(100万あたり) $2 $2 $4 $10
出力トークン価格(100万あたり) $6 $6 $20 $50
CursorBench 4.0(ソフトウェア工学) 46.3% 40.4% 41.7% 51.8%
DeepSWE v1.1(ソフトウェア工学) 71.0%(high effort) 65.2% 72.7% 70.0%
EEBench(電気工学) 64.0% 53.0% 39.4% 56.4%
AA Briefcase v1.1(数時間のオフィス作業) 1,657 1,546 1,487 1,678
Terminal-Bench 4.0(数時間のターミナル作業) 37.6% 20.3% 37.3% 57.9%
Harvey Legal Agent Benchmark(法務) 19.6% 15.8% 2.5% 6.7%
HealthBench Professional(臨床推論) 56.7% 48.5% 60.5% 62.1%

長時間のコーディング作業を測るCursorBench 4.0では、価格対性能でフロンティアに位置するとSpaceXAIは説明しています。文書やプレゼンテーションの作成も改善し、弁護士、看護師、金融アナリストなどの専門職の作業を課すGDPvalとAA BriefcaseでGrok 4.6を上回り、他のフロンティアモデルと同等の成績だとしています。

モデルの改良

Grok 4.7はGrok 4.6より大きな新しいベースモデルを使い、完了に何時間もかかる問題に重みを置いた、より難しいタスクの組み合わせで、より長い強化学習を行っています。自分の作業の検証と長いコンテキストの管理が改善しました。あわせて、Grok Botのハーネスをネイティブに理解するよう学習させ、会話タスクと一般的な知識労働の性能を上げています。

安全性とサイバーセキュリティ

Grok 4.7は完全に新しいセーフガードのスタックで構築され、SpaceXAIがテストした中で拒否とジェイルブレイク耐性が最も強いモデルだとしています。サイバーセキュリティや生物学のようなデュアルユース領域では、正当なタスクへの有用性と危険なタスクの安全な拒否の両方で先頭に立ち、LatchBioのバイオセーフティベンチマークで62.4%と首位です。

サイバー分野では、危険で悪意のあるタスクを測る自社ベンチマークHackerBench v0.3で最も高い安全性を示し、危険なデュアルユースのプロンプトの通過を3.3%に抑えつつ、正当なセキュリティ作業をほとんどブロックしないとしています。一部のサイバーセキュリティパートナーには、防御研究向けにGrok 4.7のレッドチーム機能への招待制アクセスを始めています。

価格と提供形態

項目 内容
価格 入力100万トークンあたり2ドルから、出力100万トークンあたり6ドルから
高速版 出力速度2倍のバリアントを2倍の価格で提供
提供先 Cursor、Grok Build、Grok API、サードパーティのコーディングハーネス、モデルルーター、クラウドプラットフォーム
提供開始 公開当日

Grok Buildは無料で試せます。CLIのインストールコマンドは次のとおりです。

$ curl -fsSL https://x.ai/cli/install.sh | bash

この記事の固有名詞

ソース元: xAI

コメント (0)

まだコメントはありません。

コメントを書く

2000文字以内