Grok 4 はxAIが2025年7月10日にリリースした推論モデルです。テキストと画像の入力に対応し、テキスト出力を生成できます。コンテキストウィンドウは256Kトークンで、推論と多言語サポートが主な能力です。
パラメータ
非公開
コンテキスト長
ライセンス
プロプライエタリ
リリース日
2025-07-10
API料金
入力料金(1Mトークンあたり)
$3
出力料金(1Mトークンあたり)
$
課金モード: standard
強み
- •多言語対応
- •256Kの広いコンテキストウィンドウ
- •高度な推論能力
弱み
- •閉源ライセンスで柔軟性が低い
- •出力がテキストのみに限定
- •新モデルで実績が未確立
活用例
- •多言語テキストの推論
- •画像データの分析
- •API連携アプリ開発
深度分析
Intelligence Index
73
Artificial Analysis指数;推論・コーディング最前線級
GPQA Diamond
87.5%
大学院級科学QA;ローンチ時トップ級
SWE-bench Verified
72.5%
人間検証済みの実GitHub issue解決
AIME 2025
91.7%
競技数学
入力価格
$3/100万
出力$15/100万;プロンプトキャッシュ$0.75/100万(25%オフ);128K超は2倍
コンテキストウィンドウ
256Kトークン
Text+画像入力;知識カットオフ2024年12月31日
強み
- ・最前線級の推論:GPQA Diamond 87.5%・AIME 2025 91.7%で2025年中盤の最強級
- ・最前線モデルとして高コスパ:$3/$15 per 100万でClaude Opus 4($15/$75)を大きく下回り、プロンプトキャッシュで重複前缀が$0.75/100万(25%オフ)
- ・画像入力とX(Grok)リアルタイム統合、強い多言語対応で研究・生データ系に有用
弱み
- ・256KコンテキストはGemini 2.5 Proの100万窓に劣り、超長文書・動画書き起こし・大コードベースに制限
- ・スループット(約44–75 tok/s)と遅延がOpenAI o3やClaudeに劣り、対話型・低遅延チャットには不向き
- ・オープンウェイトなし;$300/月のSuperGrok Heavyが最も高い一般消費者サブスクで、知識カットオフは2024年12月
競合比較
| Model | Arena | SWE | GPQA | Price |
|---|---|---|---|---|
| Claude Opus 4 (Anthropic) | N/A | SWE-bench Verified 72.5% | 79.6% | $15/$75 |
| Gemini 2.5 Pro (Google) | N/A | SWE-bench Verified ~72% | 86.5% | $1.25/$10 |
| GPT-5 (OpenAI) | N/A | SWE-bench Verified ~72% | ~85% | $1.25/$10 |
Grok 4はxAIのフラグシップ推論モデルで、2025年7月9–10日にリリース。256Kトークンのコンテキスト(Text+画像)と最前線級のベンチ——GPQA Diamond 87.5%、AIME 2025 91.7%、SWE-bench Verified 72.5%——を、比較的低い$3/$15 per 100万で実現する。xAIはXプラットフォームへのリアルタイムアクセス、強い多言語、そして最难クエリ向けのマルチエージェント「Heavy」モードを持つ汎用推論エンジンとして位置づける。価格と多くの推論ベンチでClaude Opus 4を下回るが、文脈長とスループットはGoogleやOpenAIの最上位に劣る。
分析生成日: 2026-09-11