微型开放权重 AI 模型比较(≤4B)

参数量不超过 4B 的开放权重 AI 模型。就资源需求而言,它们通常是最小的模型。

如果模型权重可供下载,我们便将其视为开放权重模型。这样用户就可以在自己的基础设施上自行托管,并通过微调等方式定制模型。

如需了解包括方法论在内的更多详情,请参阅常见问题。

Institute of Foundation Models 标志K2 Horizon 3.7B 和 OpenBMB 标志MiniCPM5-2B 是智能得分最高的微型开放权重模型,定义为参数量不超过 4B 的模型,其次是 AI9Stars 标志G9v3-3B 和 IBM 标志Granite 4.2 3B。
Artificial Analysis Openness Index · Higher is better
Updated
Artificial Analysis Intelligence Index · Higher is better
可训练参数(十亿)

开放性

Artificial Analysis 开放性指数:得分

开放性指数以 0 至 100 的标准化评分衡量模型的开放程度(分数越高,越开放)

智能

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
查看更多

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

SciCodeUnder review

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

CritPtUnder review

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

No data available

Agentic business operations

No data available

Agentic scientific research workflows in a terminal

No data available

Quantitative analysis on spreadsheets & documents

No data available

Kubernetes incident root-cause analysis

No data available

Visual reasoning

Medical long context reasoning

No data available

规模

模型规模:总参数量与活跃参数量

Comparison between total model parameters and parameters active during inference (billions)

Intelligence Index 与活跃参数

Artificial Analysis Intelligence Index · Active parameters at inference time (billions)
Most attractive quadrant
Pareto line

Intelligence Index 与总参数量

Artificial Analysis Intelligence Index · Size in parameters (billions)
Most attractive quadrant
Pareto line

上下文窗口

上下文窗口

Context window: tokens limit · Higher is better

更多详情

权重
服务商基准测试
K2 Horizon 3.7B
Institute of Foundation Models 标志Institute of Foundation Models
16
3.7B
524k
-
-
-
MiniCPM5-2B
OpenBMB 标志OpenBMB
12
2.6B
131k
-
-
-
G9v3-3B
AI9Stars 标志AI9Stars
11
3B
131k
-
-
AI9Stars
Granite 4.2 3B
IBM 标志IBM
9
3B
131k
$0.0
221
DeepInfra
MiniCPM5-1B (Reasoning)
OpenBMB 标志OpenBMB
9
1B
128k
-
-
-
MiniCPM5-1B (Non-reasoning)
OpenBMB 标志OpenBMB
9
1B
128k
-
-
-
Nanbeige4.1-3B
Nanbeige 标志Nanbeige
8
3.9B
256k
-
-
-
LFM2.5-2.6B
Liquid AI 标志Liquid AI
8
2.7B
128k
-
-
Liquid AI
Qwen3.5 2B (Reasoning)
Alibaba 标志Alibaba
7
2.3B
262k
-
-
-
Phi-4 Mini Instruct
Microsoft 标志Microsoft
6
3.8B
128k
-
45
Microsoft Azure
Qwen3.5 2B (Non-reasoning)
Alibaba 标志Alibaba
6
2.3B
262k
-
-
-
Qwen3.5 0.8B (Reasoning)
Alibaba 标志Alibaba
6
0.9B
262k
-
-
-