Grok 4.7リリースには、知能・性能・料金の特性が異なる3個のモデルがあります。以下では、この3個のモデルの主要指標を比較します。
- 知能が最も高いGrok 4.7のモデルはGrok 4.7 (Xhigh)(46)です。
- 出力速度が最も速いモデルはGrok 4.7 (Xhigh)(81トークン/秒)です。
- 最初の回答トークンまでの時間が最も短いモデルはGrok 4.7 (Low)(5.48秒)です。
- タスクあたりの費用が最も低いモデルはGrok 4.7 (Low)($1.25)です。モデル間の料金差は最大3倍です。
| 推論 | はい このページでは、このモデルの推論版を表示しています。 非推論版も存在する可能性があります。 |
|---|---|
| 入力モダリティ | 対応:テキスト、画像 |
| 出力モダリティ | 対応:テキスト |
| コンテキストウィンドウ | 500k Arial 12ポイントのA4用紙約750ページ分 |
各指標は同じクラスのモデルと比較します。
- 非推論モデル → 他の非推論モデルとのみ比較
- 推論モデル → 推論モデルと非推論モデルの両方と比較
- オープンウェイトモデル → 同じ規模クラスの他のオープンウェイトモデルとのみ比較:
- 極小:パラメーター数≤4B
- 小:パラメーター数4B~40B
- 中:パラメーター数40B~150B
- 大:パラメーター数>150B
- 独自モデル → 入力/出力のブレンド料金を3:1として、同じ料金帯の独自モデルとオープンウェイトモデルを比較:
- 100万トークンあたり<$0.15
- 100万トークンあたり$0.15~$1
- 100万トークンあたり>$1
知能
Artificial Analysis Intelligence Index
Intelligence Index とタスクあたりのコスト
費用
Intelligence Index タスクあたりのコスト
速度と遅延
出力速度
能力スコア
能力指数
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: GDPval-AA v2.1, AA-Briefcase v1.1, AA-Omniscience, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Intelligence Evaluations
Agentic knowledge work, (Elo-500)/2000
Agentic real-world work tasks, (Elo-500)/2000
Agentic SaaS workflows
Agentic coding & terminal use
Coding
Reasoning & knowledge
Professional document reasoning, All-pass
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Legal agentic work, Hallucination-Gated All-Pass Rate
Kubernetes incident root-cause analysis
Visual reasoning
Medical long context reasoning
詳細
ウェイト | プロバイダーのベンチマーク | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| Grok 4.7 (Xhigh) | 46 | - | 500k | $1.4 | 81 | 利用不可 | |||
| Grok 4.7 (High) | 46 | - | 500k | $1.4 | 73 | 利用不可 | |||
| Grok 4.7 (Low) | 42 | - | 500k | $1.4 | 72 | 利用不可 |