小型开放权重 AI 模型比较(4B-40B)

参数量介于 4B 和 40B 之间的开放权重 AI 模型。

如果模型权重可供下载,我们便将其视为开放权重模型。这样用户就可以在自己的基础设施上自行托管,并通过微调等方式定制模型。

如需了解包括方法论在内的更多详情,请参阅常见问题。

Alibaba 标志Qwen3.8 27B (xhigh)Alibaba 标志Qwen3.8 27B (medium) 是智能得分最高的小型开放权重模型,定义为参数量介于 4B 和 40B 之间的模型,其次是 Alibaba 标志Qwen3.8 27B (low)MBZUAI Institute of Foundation Models 标志K2 Horizon MoVA 36B A4B

亮点

Artificial Analysis Openness Index · Higher is better
Updated
Artificial Analysis Intelligence Index · Higher is better
可训练参数(十亿)

开放性

Artificial Analysis Openness Index: Score

Openness Index assesses model openness on a 0 to 100 normalized scale (higher is more open)

智能

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3 incorporates 10 evaluations: AA-Briefcase, GDPval-AA v2, AutomationBench-AA, Terminal-Bench v4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
See more

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

Agentic business operations

Quantitative analysis on spreadsheets & documents

No data available

Instruction following

Agentic tool use

Long-horizon agentic tasks

No data available

Kubernetes incident root-cause analysis

Visual reasoning

规模

Model Size: Total and Active Parameters

Comparison between total model parameters and parameters active during inference

Intelligence Index vs. Active Parameters

Artificial Analysis Intelligence Index · Active parameters at inference time
Most attractive quadrant
Pareto line

Intelligence Index vs. Total Parameters

Artificial Analysis Intelligence Index · Size in parameters (billions)
Most attractive quadrant
Pareto line

上下文窗口

Context Window

Context window: tokens limit · Higher is better

更多详情

权重
服务商基准测试
Qwen3.8 27B (xhigh)
Alibaba 标志Alibaba
34
27B
256k
$0.4
46
DeepInfraSelf-hostedCoreWeave
+5
Qwen3.8 27B (medium)
Alibaba 标志Alibaba
28
27B
256k
$0.4
52
Alibaba CloudMultiverse Computing
Qwen3.8 27B (low)
Alibaba 标志Alibaba
26
27B
256k
$0.4
51
Alibaba CloudMultiverse Computing
K2 Horizon MoVA 36B A4B
MBZUAI Institute of Foundation Models 标志MBZUAI Institute of Foundation Models
26
36B
推理时启用 4B 个参数
524k
-
-
-
Qwen3.8 27B (Non-reasoning)
Alibaba 标志Alibaba
22
27B
256k
$0.4
51
Alibaba CloudMultiverse Computing
Qwen3.6 27B (Reasoning)
Alibaba 标志Alibaba
22
27.8B
262k
$0.9
57
DeepInfraGroqNovita
+2
G9v3-39A5B
AI9Stars 标志AI9Stars
22
39B
推理时启用 5B 个参数
131k
-
-
AI9Stars
K2 Horizon 7B
MBZUAI Institute of Foundation Models 标志MBZUAI Institute of Foundation Models
21
7B
524k
-
-
-
Qwen3.6 27B (Non-reasoning)
Alibaba 标志Alibaba
20
27.8B
262k
$0.9
58
GroqCoreWeaveDeepInfra
+2
Qwen3.6 35B A3B (Reasoning)
Alibaba 标志Alibaba
19
36B
推理时启用 3B 个参数
262k
$0.6
127
Alibaba CloudSiliconFlowScaleway
+5
Muse Glimmer (high)
Meta 标志Meta
18
30B
131k
$0.2
90
Together AIDeepInfraFireworks
Gemma 4 26B A4B (Reasoning)
Google 标志Google
17
25.2B
推理时启用 3.8B 个参数
256k
$0.1
-
MakoraNovitaGoogle
+5