GPT-6.1 Sol (Max) vs. K2 Horizon 375B A23B
Comparación entre GPT-6.1 Sol (Max) y K2 Horizon 375B A23B según inteligencia, precio, velocidad, ventana de contexto y más.
Para más detalles sobre nuestra metodología, consulta la página de metodología.
| Inteligencia | |||
|---|---|---|---|
| Índice de Inteligencia | 52 | 31 | |
| AA-Briefcase v1.1 | 1564 | 1295 | |
| GDPval-AA v2.1 | 1575 | 1349 | |
| AutomationBench-AA | 65% | 37% | |
| Terminal-Bench 4.0 | 56% | 2% | |
| SciCode | 54% | 43% | |
| Humanity's Last Exam | 53% | 32% | |
| GDP.pdf | 31% | 7% | |
| CritPt | 32% | 5% | |
| AA-Omniscience | 42 | −3 | |
| AA-LCR v1.1 | 83% | 80% | |
| Costo | |||
| Precio por millón de tokens | $1.47 | $0.00 | |
| Precio de entrada por 1M de tokens | $2.00 | $0.00 | |
| Precio de salida por 1M de tokens | $10.00 | $0.00 | |
| Precio de acierto de caché por 1M de tokens | $0.10 | ||
| Costo por tarea | $0.72 | $0.00 | |
| Costo de ejecutar el Intelligence Index | 1082 US$ | 0 US$ | |
| Uso de tokens | |||
| Tokens de salida por tarea | 38k | 52k | |
| Tokens de razonamiento por tarea | 25k | 36k | |
| Tokens de salida para ejecutar el Intelligence Index | 67M | 126M | |
| Rendimiento | |||
| Velocidad de salida | 64 tokens/s | 123 tokens/s | |
| Tiempo hasta el primer token | 281.94s | 21.89s | |
| Tiempo hasta el primer token de respuesta | 281.94s | 38.17s | |
| Tiempo de respuesta de extremo a extremo | 289.74s | 42.24s | |
| Tiempo por tarea | 592.78s | 445.76s | |
| Especificaciones técnicas | |||
| Ventana de contexto | 1000k tokens~1500 páginas A4 con fuente Arial de tamaño 12 | 524k tokens~786 páginas A4 con fuente Arial de tamaño 12 | |
| Fecha de lanzamiento | septiembre de 2026 | septiembre de 2026 | |
| Parámetros totales | 375B | ||
| Parámetros activos | 23B | ||
| Razonamiento | Sí | Sí | |
| Modalidad de entrada | Admite: texto e imágenes | Admite: texto | |
| Modalidad de salida | Admite: texto | Admite: texto | |
| Pesos abiertos | No | ||
| Licencia | |||
| La licencia permite el uso comercial sin restricciones | Sí | ||
Aspectos destacados
InteligenciaUpdated
Índice de inteligencia de Artificial Analysis
Índice de Inteligencia de Artificial Analysis: pesos abiertos vs. propietarios
Miden el rendimiento de modelos en capacidades e industrias específicas
Artificial Analysis Índice de finanzas y contabilidad
Intelligence Evaluations
Agentic knowledge work, (Elo-500)/2000
Agentic real-world work tasks, (Elo-500)/2000
Agentic SaaS workflows
Agentic coding & terminal use
Coding
Reasoning & knowledge
Professional document reasoning, All-pass
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Legal agentic work, criterion pass rate
Agentic business operations
Agentic scientific research workflows in a terminal
Quantitative analysis on spreadsheets & documents
Kubernetes incident root-cause analysis
Visual reasoning
Medical long context reasoning
AA-Briefcase v1.1Updated
Elo de AA-Briefcase
AA-Omniscience
Índice AA-Omniscience
Índice de apertura
Artificial Analysis Openness Index: puntuación
Comparaciones del Índice de Inteligencia
Índice de Inteligencia vs. costo por tarea del Índice de Inteligencia
Costo por tarea (USD, escala logarítmica)
Uso de tokens
Output Tokens per Intelligence Index Task
Costo
Costo por tarea del Índice de Inteligencia
Costo de ejecutar el Índice de Inteligencia de Artificial Analysis
Pricing: Cache Hit, Input, and Output
Ventana de contexto
Ventana de contexto
Velocidad
Medida por la velocidad de salida (tokens por segundo)
Output Speed
Time per Intelligence Index Task
Latencia
Medida por el tiempo (segundos) hasta el primer token
Latency: Time To First Answer Token
Tiempo de respuesta de extremo a extremo
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
End-to-End Response Time
Tamaño del modelo (solo modelos de pesos abiertos)
Tamaño del modelo: parámetros totales y activos
Preguntas frecuentes
GPT-6.1 Sol (Max) es más inteligente. GPT-6.1 Sol (Max) obtiene 52, frente a los 31 de K2 Horizon 375B A23B en el Índice de Inteligencia de Artificial Analysis.
K2 Horizon 375B A23B es más rápido. K2 Horizon 375B A23B genera 122.9 tokens por segundo, frente a los 64.2 tokens por segundo de GPT-6.1 Sol (Max).
K2 Horizon 375B A23B tiene menor latencia. El tiempo hasta el primer token de K2 Horizon 375B A23B es de 21.89s, frente a los 281.94s de GPT-6.1 Sol (Max).
GPT-6.1 Sol (Max) tiene una ventana de contexto más grande. GPT-6.1 Sol (Max) admite 1.0M tokens, frente a los 520k tokens de K2 Horizon 375B A23B.