GPT-6 Astra vs. Kimi K3:リリース比較
GPT-6 AstraとKimi K3のリリース比較:それぞれ5個と2個のモデルがあり、知能・性能・料金の特性が異なります。以下では、全7個のモデルの主要指標を比較します。
- 知能が最も高いのはGPT-6 Astraです。GPT-6 Astra (Max)(53)に対し、Kimi K3はKimi K3 (Max)(44)です。
- 出力速度が最も速いのはGPT-6 Astraです。GPT-6 Astra (Max)(51トークン/秒)に対し、Kimi K3はKimi K3 (Low)(36トークン/秒)です。
- タスクあたりの費用が最も低いのはGPT-6 Astraです。GPT-6 Astra (Low)($0.82)に対し、Kimi K3はKimi K3 (Low)($1.15)です。
| GPT-6 Astra (max) | GPT-6 Astra (xhigh) | GPT-6 Astra (high) | GPT-6 Astra (medium) | GPT-6 Astra (low) | Kimi K3 (max) | Kimi K3 (low) | |
|---|---|---|---|---|---|---|---|
| Intelligence Index | 53 | 52 | 51 | 50 | 46 | 44 | 30 |
| 財務・会計 | 55 | 54 | 53 | 52 | 49 | 47 | 32 |
| 戦略・オペレーション | 57 | 57 | 55 | 54 | 50 | 50 | 39 |
| 法務 | 59 | 58 | 58 | 57 | 53 | 49 | 34 |
| 医療・ヘルスケア | 52 | -- | -- | -- | -- | 45 | -- |
| エンジニアリング | 55 | 55 | 53 | 52 | 48 | 43 | 30 |
| 経済学 | 60 | 59 | 58 | 58 | 55 | 53 | 37 |
| タスクあたりの費用USD | $3.26 | $2.31 | $1.73 | $1.54 | $0.82 | $2.00 | $1.15 |
| 出力速度トークン/秒 | 51 | 47 | 43 | 44 | 43 | 34 | 36 |
| 最初のトークンまでの時間秒 | 320.33 | 205.74 | 65.56 | 6.21 | 2.86 | 4.49 | 5.49 |
| コンテキストウィンドウ | 1M | 1M | 1M | 1M | 1M | 1M | 1M |
| 開発元 | |||||||
| ライセンス | 独自 | 独自 | 独自 | 独自 | 独自 | オープン | オープン |
| 入力モダリティ | 対応:テキスト、画像 | 対応:テキスト、画像 | 対応:テキスト、画像 | 対応:テキスト、画像 | 対応:テキスト、画像 | 対応:テキスト、画像 | 対応:テキスト、画像 |
| 出力モダリティ | 対応:テキスト | 対応:テキスト | 対応:テキスト | 対応:テキスト | 対応:テキスト | 対応:テキスト | 対応:テキスト |
| プロバイダー | |||||||
知能
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
Cost per Task (USD, Log Scale)
費用
Cost per Intelligence Index Task
速度と遅延
Output Speed
能力スコア
能力指数
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better