中規模オープンウェイトAIモデルの比較(40B~150B)

パラメーター数が40B~150BのオープンウェイトAIモデルです。

ウェイトをダウンロードできるモデルをオープンウェイト(一般にオープンソースとも呼ばれます)とみなします。独自のインフラストラクチャでセルフホストでき、ファインチューニングなどによるモデルのカスタマイズも可能です。

方法論などの詳細は、よくある質問をご覧ください。

InclusionAIのロゴLing-3.0-flash-VLとInclusionAIのロゴLing-3.0-flash-Finはパラメーター数40B~150Bと定義される中規模オープンウェイトモデルの中で知能が最も高く、InclusionAIのロゴLing 3.0 FlashとAlibabaのロゴQwen3.5 122B A10B (non-reasoning)が続きます。
Artificial Analysis Openness Index · Higher is better
Updated
Artificial Analysis Intelligence Index · Higher is better
学習可能なパラメーター数(十億単位)

オープン性

Artificial Analysis Openness Index:スコア

Openness Indexはモデルのオープン性を0~100の正規化尺度で評価します(高いほどオープン)

知能

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Evaluations

Intelligence evaluations measured independently by Artificial Analysis · Higher is better
もっと見る

Agentic knowledge work, (Elo-500)/2000

Agentic real-world work tasks, (Elo-500)/2000

Agentic SaaS workflows

Agentic coding & terminal use

SciCodeUnder review

Coding

Reasoning & knowledge

Professional document reasoning, All-pass

CritPtUnder review

Physics reasoning

Long context reasoning

Legal agentic work, criterion pass rate

Agentic business operations

Agentic scientific research workflows in a terminal

No data available

Quantitative analysis on spreadsheets & documents

Kubernetes incident root-cause analysis

Visual reasoning

Medical long context reasoning

規模

モデルサイズ:総パラメータ数とアクティブパラメータ数

Comparison between total model parameters and parameters active during inference (billions)

Intelligence Indexと有効パラメーター数

Artificial Analysis Intelligence Index · Active parameters at inference time (billions)
Most attractive quadrant
Pareto line

Intelligence Index と総パラメータ数

Artificial Analysis Intelligence Index · Size in parameters (billions)
Most attractive quadrant
Pareto line

コンテキストウィンドウ

コンテキストウィンドウ

Context window: tokens limit · Higher is better

詳細

ウェイト
プロバイダーのベンチマーク
Ling-3.0-flash-VL
InclusionAIのロゴInclusionAI
25
124B
推論時に5.5Bが有効
262k
$0.0
145
InclusionAI
Ling-3.0-flash-Fin
InclusionAIのロゴInclusionAI
23
124B
推論時に5.1Bが有効
262k
$0.0
342
InclusionAI
Ling 3.0 Flash
InclusionAIのロゴInclusionAI
20
124B
推論時に5.1Bが有効
262k
$0.0
334
利用不可
DeepInfraInclusionAI
Qwen3.5 122B A10B (Non-reasoning)
AlibabaのロゴAlibaba
18
125B
推論時に10Bが有効
262k
$0.7
142
DeepInfraAlibaba Cloud
Qwen3.5 122B A10B (Reasoning)
AlibabaのロゴAlibaba
16
125B
推論時に10Bが有効
262k
$0.7
128
SiliconFlowDeepInfraAlibaba Cloud
+2
Mistral Medium 3.5
MistralのロゴMistral
14
128B
256k
$1.2
168
MistralSelf-hosted
Nemotron 3 Super 120B A12B (Reasoning)
NVIDIAのロゴNVIDIA
13
120.6B
推論時に12.7Bが有効
1M
$0.3
156
CrusoeNebiusDeepInfra
HyperNova 60B 2605 (High, Based on gpt-oss-120b)
Multiverse ComputingのロゴMultiverse Computing
12
58.7B
推論時に4.8Bが有効
131k
-
-
-
gpt-oss-120b (High)
OpenAIのロゴOpenAI
12
117B
推論時に5.1Bが有効
131k
$0.2
196
GroqCloudflareScaleway
+17
K2 Think V2
Institute of Foundation ModelsのロゴInstitute of Foundation Models
11
70B
262k
-
-
-
LongCat Flash Lite
LongCatのロゴLongCat
11
68.5B
推論時に3Bが有効
256k
-
-
-
Mistral Small 4 (Reasoning)
MistralのロゴMistral
11
119B
推論時に6.5Bが有効
256k
$0.1
174
Mistral