Análisis de inteligencia, rendimiento y precio de Llama 3.1 Nemotron Ultra 253B v1 (Reasoning)
Resumen del modelo
Velocidad
Verbosidad
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) está entre los modelos menos inteligentes, pero tiene un precio muy competitivo en comparación con otros modelos de pesos abiertos y tamaño similar. El modelo admite entrada de texto, genera texto y tiene una ventana de contexto de 128k tokens.
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) obtiene 8 puntos en el Índice de Inteligencia de Artificial Analysis, lo que lo sitúa en el extremo inferior entre modelos comparables (con una mediana de 18).
El precio de Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) es de $0.00 por 1 M de tokens de entrada (muy competitivo; mediana: $0.30) y $0.00 por 1 M de tokens de salida (muy competitivo; mediana: $1.15).
| Razonamiento | Sí Esta página muestra la versión con razonamiento de este modelo. También puede existir una variante sin razonamiento. |
|---|---|
| Modalidad de entrada | Admite: texto |
| Modalidad de salida | Admite: texto |
| Ventana de contexto | 128k ~192 páginas A4 con fuente Arial de 12 puntos |
| Parámetros totales | 253B |
| Licencia | NVIDIA Open Model License Agreement |
| Pesos del modelo | Hugging Face |
Las métricas se comparan con modelos de la misma clase:
- Modelos sin razonamiento → se comparan solo con otros modelos sin razonamiento
- Modelos de razonamiento → se comparan tanto con modelos de razonamiento como sin razonamiento
- Modelos de pesos abiertos → se comparan solo con otros modelos de pesos abiertos de la misma categoría de tamaño:
- Muy pequeño: ≤4B parámetros
- Pequeño: 4B–40B parámetros
- Mediano: 40B–150B parámetros
- Grande: >150B parámetros
- Modelos propietarios → se comparan con modelos propietarios y de pesos abiertos del mismo rango de precio mediante una proporción combinada de precios de entrada/salida de 3:1:
- <$0.15 por 1 M de tokens
- $0.15–$1 por 1 M de tokens
- >$1 por 1 M de tokens
Aspectos destacados
Velocidad
InteligenciaUpdated
Artificial Analysis Intelligence Index
Artificial Analysis Intelligence Index by Open Weights / Proprietary
Intelligence Evaluations
Agentic knowledge work, (Elo-500)/2000
Agentic real-world work tasks, (Elo-500)/2000
Agentic SaaS workflows
Agentic coding & terminal use
Coding
Reasoning & knowledge
Professional document reasoning, All-pass
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Legal agentic work, criterion pass rate
Agentic business operations
Quantitative analysis on spreadsheets & documents
Agentic tool use
Kubernetes incident root-cause analysis
Visual reasoning
Medical long context reasoning
AA-Omniscience
AA-Omniscience Index
Índice de apertura
Artificial Analysis Openness Index: Score
Comparaciones del Índice de Inteligencia
Intelligence Index vs. Cost per Intelligence Index Task
Costo
Cost per Intelligence Index Task
Cost to Run Artificial Analysis Intelligence Index
Pricing: Cache Hit, Input, and Output
Ventana de contexto
Context Window
Tamaño del modelo (solo modelos de pesos abiertos)
Model Size: Total and Active Parameters
Preguntas frecuentes
Preguntas comunes sobre Llama 3.1 Nemotron Ultra 253B v1 (Reasoning)
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) se lanzó el 7 de abril de 2025.
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) fue creado por NVIDIA.
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) obtiene 8 puntos (estimados) en el Índice de Inteligencia de Artificial Analysis, lo que lo sitúa en el extremo inferior entre otros modelos de pesos abiertos y tamaño similar (mediana: 18).
Sí, Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) es un modelo de razonamiento. Usa pensamiento extendido o razonamiento en cadena para resolver problemas complejos antes de dar una respuesta.
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) admite entrada de texto.
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) admite salida de texto.
No, Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) no admite imágenes como entrada. Solo puede procesar texto.
No, Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) no es multimodal. Solo admite entradas de texto.
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) tiene una ventana de contexto de 130k tokens. Esto determina cuánto texto e historial de conversación puede procesar el modelo en una sola solicitud.
Sí, Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) es un modelo de pesos abiertos. Los pesos del modelo están disponibles públicamente y pueden descargarse para alojarlo por cuenta propia.
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) tiene 253 mil millones de parámetros.
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) se publica bajo la licencia NVIDIA Open Model License Agreement, que permite el uso comercial. Ver licencia
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) obtiene 8 puntos en el Índice de Inteligencia de Artificial Analysis. Este benchmark compuesto evalúa los modelos en razonamiento, conocimiento, matemáticas y programación.
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) es un modelo de pesos abiertos que puede alojarse por cuenta propia. Ver proveedores
Llama 3.1 Nemotron Ultra 253B v1 (Reasoning) es un modelo de pesos abiertos que puede descargarse y alojarse por cuenta propia. Comparar proveedores