Kimi K3 vs. gpt-oss-20b:リリース比較
Kimi K3とgpt-oss-20bのリリース比較:それぞれ2個と2個のモデルがあり、知能・性能・料金の特性が異なります。以下では、全4個のモデルの主要指標を比較します。
- 知能が最も高いのはKimi K3です。Kimi K3 (max)(44)に対し、gpt-oss-20bはgpt-oss-20b (low)(10)です。
- 出力速度が最も速いのはgpt-oss-20bです。gpt-oss-20b (low)(224トークン/秒)に対し、Kimi K3はKimi K3 (low)(37トークン/秒)です。
- タスクあたりの費用が最も低いのはgpt-oss-20bです。gpt-oss-20b (high)($0.01)に対し、Kimi K3はKimi K3 (max)($2.00)です。
知能
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
Cost per Task (USD, Log Scale)
費用
Cost per Intelligence Index Task
速度と遅延
Output Speed
能力スコア
能力指数
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
詳細
入力モダリティ | 出力モダリティ | ウェイト | プロバイダーのベンチマーク | ||||||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| Kimi K3 (max) | 44 | 47 | 50 | 49 | 45 | 43 | 53 | $2.00 | $2.3 | $3.00 | $15.00 | $0.30 | $3,658 | 48k | 32k | 161M | 37 | 4.15秒 | 58.21秒 | 71.73秒 | 1134.71秒 | 2.8T 推論時に104Bが有効 | 1M | 2026年7月 | - | はい | 対応:テキスト、画像 | 対応:テキスト | +10 | ||||
| Kimi K3 (low) | 34 | - | - | - | - | - | - | - | $2.3 | $3.00 | $15.00 | $0.30 | - | - | - | - | 37 | 5.07秒 | 59.06秒 | 72.55秒 | - | 2.8T 推論時に104Bが有効 | 1M | 2026年7月 | - | はい | 対応:テキスト、画像 | 対応:テキスト | |||||
| gpt-oss-20b (low) | 10 | - | - | - | - | - | - | - | $0.1 | $0.07 | $0.215 | - | - | - | - | - | 224 | 0.92秒 | 9.85秒 | 12.08秒 | - | 21B 推論時に3.6Bが有効 | 131k | 2025年8月 | 2025年5月 | はい | 対応:テキスト | 対応:テキスト | +4 | ||||
| gpt-oss-20b (high) | 9 | 7 | 5 | 7 | 7 | 12 | 11 | $0.01 | $0.1 | $0.07 | $0.18 | - | $31 | 18k | 16k | 70M | 189 | 0.85秒 | 11.42秒 | 14.06秒 | 104.23秒 | 21B 推論時に3.6Bが有効 | 131k | 2025年8月 | 2024年5月 | はい | 対応:テキスト | 対応:テキスト | +5 | ||||