GPT-6 Astra vs. Hermes 4 - Llama-3.1 405B:リリース比較
GPT-6 AstraとHermes 4 - Llama-3.1 405Bのリリース比較:それぞれ5個と2個のモデルがあり、知能・性能・料金の特性が異なります。以下では、全7個のモデルの主要指標を比較します。
- 知能が最も高いのはGPT-6 Astraです。GPT-6 Astra (Max)(53)に対し、Hermes 4 - Llama-3.1 405BはHermes 4 - Llama-3.1 405B (Reasoning)(7)です。
- 出力速度が最も速いのはGPT-6 Astraです。GPT-6 Astra (Max)(54トークン/秒)に対し、Hermes 4 - Llama-3.1 405BはHermes 4 - Llama-3.1 405B (Non-reasoning)(41トークン/秒)です。
| GPT-6 Astra (max) | GPT-6 Astra (xhigh) | GPT-6 Astra (high) | GPT-6 Astra (medium) | GPT-6 Astra (low) | Hermes 4 405B | Hermes 4 405B (non-reasoning) | |
|---|---|---|---|---|---|---|---|
| Intelligence Index | 53 | 52 | 51 | 50 | 46 | 7* | 7* |
| 財務・会計 | 55 | 54 | 53 | 52 | 49 | -- | -- |
| 戦略・オペレーション | 57 | 57 | 55 | 54 | 50 | -- | -- |
| 法務 | 59 | 58 | 58 | 57 | 53 | -- | -- |
| 医療・ヘルスケア | 52 | -- | -- | -- | -- | -- | -- |
| タスクあたりの費用USD | $3.26 | $2.31 | $1.73 | $1.54 | $0.82 | -- | -- |
| 出力速度トークン/秒 | 54 | 49 | 48 | 46 | 47 | 37 | 41 |
| 最初のトークンまでの時間秒 | 319.00 | 144.37 | 78.16 | 5.89 | 2.75 | 2.38 | 2.38 |
| コンテキストウィンドウ | 1M | 1M | 1M | 1M | 1M | 128k | 128k |
| 開発元 | |||||||
| ライセンス | 独自 | 独自 | 独自 | 独自 | 独自 | オープン | オープン |
| 入力モダリティ | 対応:テキスト、画像 | 対応:テキスト、画像 | 対応:テキスト、画像 | 対応:テキスト、画像 | 対応:テキスト、画像 | 対応:テキスト | 対応:テキスト |
| 出力モダリティ | 対応:テキスト | 対応:テキスト | 対応:テキスト | 対応:テキスト | 対応:テキスト | 対応:テキスト | 対応:テキスト |
| プロバイダー | |||||||
* 推定値
知能
Artificial Analysis Intelligence Index
Intelligence Index とタスクあたりのコスト
タスク当たりのコスト(USD、対数スケール)
費用
Intelligence Index タスクあたりのコスト
速度と遅延
出力速度
能力スコア
能力指数
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better