すべてのリリース•

11個のモデル

Kimiのモデル:知能・性能・料金

Artificial AnalysisはKimiの11個のモデルをベンチマークしています。以下では、これらのモデルの主要指標を比較します。

  • 知能が最も高いKimiのモデルはKimi K3 (max)(44)です。
  • タスクあたりの費用が最も低いモデルはKimi K2.7 Code($0.54)です。モデル間の料金差は最大3.7倍です。

知能

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Index vs. Cost per Intelligence Index Task

Artificial Analysis Intelligence Index · Weighted average cost (USD) per Artificial Analysis Intelligence Index task
Most attractive quadrant
Pareto line

費用

Cost per Intelligence Index Task

Weighted average cost (USD) per Artificial Analysis Intelligence Index task, segmented by token type. Lower is better

速度と遅延

Output Speed

Output tokens per second · Higher is better
No data available

能力スコア

能力指数

特定の能力や業界におけるモデルの性能を測定
Finance & Accounting Index

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Strategy & Ops Index

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Legal Index

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better

Healthcare & Medical Index

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better

Engineering Index

Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better

Economics Index

Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better

Kimiのすべてのリリース

詳細

ウェイト
プロバイダーのベンチマーク
Kimi K3 (max)
KimiのロゴKimi
44
2.8T
推論時に104Bが有効
1M
$2.3
-
DatabricksFireworksModal
+11
Kimi K3 (low)
KimiのロゴKimi
34
2.8T
推論時に104Bが有効
1M
$2.3
-
KimiBasetenDatabricksNebius
Kimi K2.6
KimiのロゴKimi
27
1T
推論時に32Bが有効
256k
$0.7
-
BasetenCrusoeCoreWeave
+10
Kimi K2.7 Code
KimiのロゴKimi
26
1T
推論時に32Bが有効
256k
$0.7
-
NebiusGMICoreWeave
+6
Kimi K2.6 (Non-reasoning)
KimiのロゴKimi
24
1T
推論時に32Bが有効
256k
$0.7
-
BasetenSiliconFlowParasail
+8
Kimi K2.5 (Reasoning)
KimiのロゴKimi
23
1T
推論時に32Bが有効
256k
$0.6
-
DeepInfraSiliconFlowMicrosoft Azure
+2
Kimi K2 Thinking
KimiのロゴKimi
22
1T
推論時に32Bが有効
256k
$0.8
123
NovitaAmazon BedrockMicrosoft AzureGoogle
Kimi K2.5 (Non-reasoning)
KimiのロゴKimi
19
1T
推論時に32Bが有効
256k
$0.8
-
NovitaGMIMicrosoft Azure
Kimi K2 0905
KimiのロゴKimi
15
1T
推論時に32Bが有効
256k
$0.8
54
Novita
Kimi K2
KimiのロゴKimi
13
1T
推論時に32Bが有効
128k
$0.7
53
Novita
Kimi Linear 48B A3B Instruct
KimiのロゴKimi
7
49.1B
推論時に3Bが有効
1M
-
-
-