xAIプロプライエタリ

Grok 4

このモデルを比較

Grok 4 はxAIが2025年7月10日にリリースした推論モデルです。テキストと画像の入力に対応し、テキスト出力を生成できます。コンテキストウィンドウは256Kトークンで、推論と多言語サポートが主な能力です。

シェア:XはてブLINE

パラメータ

非公開

コンテキスト長

ライセンス

プロプライエタリ

リリース日

2025-07-10

API料金

入力料金(1Mトークンあたり)

$3

出力料金(1Mトークンあたり)

$

課金モード: standard

強み

  • 多言語対応
  • 256Kの広いコンテキストウィンドウ
  • 高度な推論能力

弱み

  • 閉源ライセンスで柔軟性が低い
  • 出力がテキストのみに限定
  • 新モデルで実績が未確立

活用例

  • 多言語テキストの推論
  • 画像データの分析
  • API連携アプリ開発

深度分析

Intelligence Index

73

Artificial Analysis指数;推論・コーディング最前線級

GPQA Diamond

87.5%

大学院級科学QA;ローンチ時トップ級

SWE-bench Verified

72.5%

人間検証済みの実GitHub issue解決

AIME 2025

91.7%

競技数学

入力価格

$3/100万

出力$15/100万;プロンプトキャッシュ$0.75/100万(25%オフ);128K超は2倍

コンテキストウィンドウ

256Kトークン

Text+画像入力;知識カットオフ2024年12月31日

強み

  • 最前線級の推論:GPQA Diamond 87.5%・AIME 2025 91.7%で2025年中盤の最強級
  • 最前線モデルとして高コスパ:$3/$15 per 100万でClaude Opus 4($15/$75)を大きく下回り、プロンプトキャッシュで重複前缀が$0.75/100万(25%オフ)
  • 画像入力とX(Grok)リアルタイム統合、強い多言語対応で研究・生データ系に有用

弱み

  • 256KコンテキストはGemini 2.5 Proの100万窓に劣り、超長文書・動画書き起こし・大コードベースに制限
  • スループット(約44–75 tok/s)と遅延がOpenAI o3やClaudeに劣り、対話型・低遅延チャットには不向き
  • オープンウェイトなし;$300/月のSuperGrok Heavyが最も高い一般消費者サブスクで、知識カットオフは2024年12月

競合比較

ModelArenaSWEGPQAPrice
Claude Opus 4 (Anthropic)N/ASWE-bench Verified 72.5%79.6%$15/$75
Gemini 2.5 Pro (Google)N/ASWE-bench Verified ~72%86.5%$1.25/$10
GPT-5 (OpenAI)N/ASWE-bench Verified ~72%~85%$1.25/$10

Grok 4はxAIのフラグシップ推論モデルで、2025年7月9–10日にリリース。256Kトークンのコンテキスト(Text+画像)と最前線級のベンチ——GPQA Diamond 87.5%、AIME 2025 91.7%、SWE-bench Verified 72.5%——を、比較的低い$3/$15 per 100万で実現する。xAIはXプラットフォームへのリアルタイムアクセス、強い多言語、そして最难クエリ向けのマルチエージェント「Heavy」モードを持つ汎用推論エンジンとして位置づける。価格と多くの推論ベンチでClaude Opus 4を下回るが、文脈長とスループットはGoogleやOpenAIの最上位に劣る。

分析生成日: 2026-09-11