NVIDIA Nemotron 3 Nano 30B A3B: inteligencia, rendimiento y precio del lanzamiento
Resumen del modelo
Verbosidad
El lanzamiento NVIDIA Nemotron 3 Nano 30B A3B ofrece 2 modelos, cada uno con distintas características de inteligencia, rendimiento y precio. A continuación se comparan las métricas clave de los 2 modelos.
- En inteligencia, el modelo líder de NVIDIA Nemotron 3 Nano 30B A3B es NVIDIA Nemotron 3 Nano 30B A3B (Reasoning), con 9.
- En velocidad de salida, el modelo más rápido es NVIDIA Nemotron 3 Nano 30B A3B (Non-reasoning), con 224 tokens/s.
- En latencia, NVIDIA Nemotron 3 Nano 30B A3B (Non-reasoning), con 0,93 s ofrece el menor tiempo hasta el primer token de respuesta.
- En precio, NVIDIA Nemotron 3 Nano 30B A3B (Reasoning), con $0.02 ofrece el menor costo por tarea.
| Modalidad de entrada | Admite: texto |
|---|---|
| Modalidad de salida | Admite: texto |
| Ventana de contexto | 1M ~1500 páginas A4 con fuente Arial de 12 puntos |
| Parámetros totales | 31.6B |
| Parámetros activos | 3.6B Número de parámetros activos por token durante la inferencia |
| Licencia | Nvidia Nemotron Open Model License |
| Pesos del modelo | Hugging Face |
Las métricas se comparan con modelos de la misma clase:
- Modelos sin razonamiento → se comparan solo con otros modelos sin razonamiento
- Modelos de razonamiento → se comparan tanto con modelos de razonamiento como sin razonamiento
- Modelos de pesos abiertos → se comparan solo con otros modelos de pesos abiertos de la misma categoría de tamaño:
- Muy pequeño: ≤4B parámetros
- Pequeño: 4B–40B parámetros
- Mediano: 40B–150B parámetros
- Grande: >150B parámetros
- Modelos propietarios → se comparan con modelos propietarios y de pesos abiertos del mismo rango de precio mediante una proporción combinada de precios de entrada/salida de 3:1:
- <$0.15 por 1 M de tokens
- $0.15–$1 por 1 M de tokens
- >$1 por 1 M de tokens
Inteligencia
Índice de inteligencia de Artificial Analysis
Índice de Inteligencia vs. costo por tarea del Índice de Inteligencia
Costo
Costo por tarea del Índice de Inteligencia
Velocidad y latencia
Velocidad de salida
Puntuaciones de capacidades
Índices de capacidades
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Más de NVIDIA
Nemotron 3 Ultra 550B A55B
1 modelo
23
Mayor inteligencia
Nemotron 3.5 Lightning
1 modelo
13
Mayor inteligencia
Nemotron 3 Super 120B A12B
1 modelo
13
Mayor inteligencia
Nemotron Cascade 2 30B A3B
1 modelo
12
Mayor inteligencia
Nemotron 3 Nano Omni 30B A3B Reasoning
1 modelo
10
Mayor inteligencia
Llama 3.1 Nemotron Ultra 253B v1
1 modelo
8
Mayor inteligencia
Más detalles
Pesos | Benchmarks de proveedores | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| NVIDIA Nemotron 3 Nano 30B A3B (Reasoning) | 9 | 31.6B 3,6B activos en inferencia | 1M | 0,1 US$ | 179 | ||||
| NVIDIA Nemotron 3 Nano 30B A3B (Non-reasoning) | 7 | 31.6B 3,6B activos en inferencia | 1M | 0,1 US$ | 224 |