Grok 4.7 vs. Hermes 4 - Llama-3.1 70B:リリース比較
Grok 4.7とHermes 4 - Llama-3.1 70Bのリリース比較:それぞれ3個と2個のモデルがあり、知能・性能・料金の特性が異なります。以下では、全5個のモデルの主要指標を比較します。
- 知能が最も高いのはGrok 4.7です。Grok 4.7 (Xhigh)(46)に対し、Hermes 4 - Llama-3.1 70BはHermes 4 - Llama-3.1 70B (Reasoning)(8)です。
| Grok 4.7 (xhigh) | Grok 4.7 (high) | Grok 4.7 (low) | Hermes 4 70B | Hermes 4 70B (non-reasoning) | |
|---|---|---|---|---|---|
| Intelligence Index | 46 | 46 | 42 | 8* | 7* |
| 財務・会計 | 52 | 52 | 48 | -- | -- |
| 戦略・オペレーション | 54 | 54 | 51 | -- | -- |
| 法務 | 54 | 54 | 51 | -- | -- |
| 医療・ヘルスケア | 47 | -- | -- | -- | -- |
| タスクあたりの費用USD | $3.74 | $2.73 | $1.25 | -- | -- |
| 出力速度トークン/秒 | 83 | 79 | 77 | -- | -- |
| 最初のトークンまでの時間秒 | 88.14 | 46.44 | 5.93 | -- | -- |
| コンテキストウィンドウ | 500k | 500k | 500k | 128k | 128k |
| 開発元 | |||||
| ライセンス | 独自 | 独自 | 独自 | オープン | オープン |
| 入力モダリティ | 対応:テキスト、画像 | 対応:テキスト、画像 | 対応:テキスト、画像 | 対応:テキスト | 対応:テキスト |
| 出力モダリティ | 対応:テキスト | 対応:テキスト | 対応:テキスト | 対応:テキスト | 対応:テキスト |
| プロバイダー | -- | -- | |||
* 推定値
知能
Artificial Analysis Intelligence Index
Intelligence Index とタスクあたりのコスト
タスク当たりのコスト(USD、対数スケール)
費用
Intelligence Index タスクあたりのコスト
速度と遅延
出力速度
能力スコア
能力指数
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: GDPval-AA v2.1, AA-Briefcase v1.1, AA-Omniscience, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better