모든 릴리스•

모델 19개

NVIDIA 모델: 지능, 성능 및 가격

Artificial Analysis는 NVIDIA의 모델 19개를 벤치마크했습니다. 아래에서 이 모델들의 주요 지표를 비교합니다.

  • 지능 부문에서 NVIDIA의 최고 모델은 Nemotron 3 Ultra 550B A55B (Reasoning)(23)입니다.
  • 출력 속도가 가장 빠른 모델은 Nemotron 3.5 Lightning(288 토큰/초)입니다.
  • 지연 시간 부문에서 첫 응답 토큰까지 걸리는 시간이 가장 짧은 모델은 NVIDIA Nemotron 3 Nano 30B A3B (Non-reasoning)(0.90초)입니다.
  • 가격 부문에서 작업당 비용이 가장 낮은 모델은 NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)($0.02)입니다. 모델 간 가격 차이는 최대 98배입니다.

지능

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Index vs. Cost per Intelligence Index Task

Artificial Analysis Intelligence Index · Weighted average cost (USD) per Artificial Analysis Intelligence Index task
Most attractive quadrant
Pareto line

비용

Cost per Intelligence Index Task

Weighted average cost (USD) per Artificial Analysis Intelligence Index task, segmented by token type. Lower is better

속도 및 지연 시간

Output Speed

Output tokens per second · Higher is better

역량 점수

역량 지수

특정 역량 및 산업에서 모델의 성능을 측정
Finance & Accounting Index

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Strategy & Ops Index

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Legal Index

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better

Healthcare & Medical Index

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better

Engineering Index

Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better

Economics Index

Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better

NVIDIA의 모든 릴리스

상세 정보

웨이트
제공업체 벤치마크
Nemotron 3 Ultra 550B A55B (Reasoning)
NVIDIA 로고NVIDIA
23
550B
추론 시 55B 활성
262k
US$0.5
201
CoreWeaveGMIDeepInfra
+3
Nemotron 3.5 Lightning
NVIDIA 로고NVIDIA
13
31.6B
추론 시 3.6B 활성
1M
US$0.1
288
제공되지 않음
DeepInfraNebiusCoreWeave
+3
Nemotron 3 Super 120B A12B (Reasoning)
NVIDIA 로고NVIDIA
13
120.6B
추론 시 12.7B 활성
1M
US$0.3
166
CrusoeNebiusDeepInfra
Nemotron Cascade 2 30B A3B
NVIDIA 로고NVIDIA
12
31.6B
추론 시 3B 활성
1M
-
-
-
Nemotron 3 Nano Omni 30B A3B Reasoning
NVIDIA 로고NVIDIA
10
30B
추론 시 3B 활성
256k
US$0.3
264
Crusoe
Llama Nemotron Super 49B v1.5 (Reasoning)
NVIDIA 로고NVIDIA
9
49B
128k
-
-
-
Llama 3.3 Nemotron Super 49B v1 (Reasoning)
NVIDIA 로고NVIDIA
9
49B
128k
-
-
-
NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)
NVIDIA 로고NVIDIA
9
31.6B
추론 시 3.6B 활성
1M
US$0.1
182
NebiusNovitaDeepInfraCrusoe
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning)
NVIDIA 로고NVIDIA
8
253B
128k
-
-
-
NVIDIA Nemotron Nano 12B v2 VL (Reasoning)
NVIDIA 로고NVIDIA
7
13.2B
128k
-
-
-
NVIDIA Nemotron Nano 9B V2 (Reasoning)
NVIDIA 로고NVIDIA
7
9B
131k
US$0.1
117
DeepInfra
NVIDIA Nemotron 3 Nano 4B
NVIDIA 로고NVIDIA
7
4.0B
262k
-
-
-
Llama Nemotron Super 49B v1.5 (Non-reasoning)
NVIDIA 로고NVIDIA
7
49B
128k
-
-
-
Llama 3.1 Nemotron Nano 4B v1.1 (Reasoning)
NVIDIA 로고NVIDIA
7
4.5B
128k
-
-
-
Llama 3.3 Nemotron Super 49B v1 (Non-reasoning)
NVIDIA 로고NVIDIA
7
49B
128k
-
-
-
Llama 3.1 Nemotron Instruct 70B
NVIDIA 로고NVIDIA
7
70B
128k
-
-
-
NVIDIA Nemotron 3 Nano 30B A3B (Non-reasoning)
NVIDIA 로고NVIDIA
7
31.6B
추론 시 3.6B 활성
1M
US$0.1
234
NovitaDeepInfraCrusoe
NVIDIA Nemotron Nano 9B V2 (Non-reasoning)
NVIDIA 로고NVIDIA
7
9B
131k
US$0.1
163
DeepInfraAmazon Bedrock
NVIDIA Nemotron Nano 12B v2 VL (Non-reasoning)
NVIDIA 로고NVIDIA
6
13.2B
128k
US$0.2
202
Amazon Bedrock