Claude Code vs. Grok Build
Comparación entre Claude Code y Grok Build en el Índice de agentes de programación de Artificial Analysis, incluidos resultados de benchmarks, costo, tiempo de ejecución y uso de tokens.
Para más detalles sobre nuestra metodología, consulta nuestra página de metodología.
Destacados
Comparación
Comparación lado a lado de Claude Code y Grok Build.
Comparación de agentes de programación
Métrica | Análisis | ||
|---|---|---|---|
Harness del agente | Claude Code | Grok Build | |
Modelo representativo | Fable 5.1 (max) (with fallback) | Grok 4.5 (high) | |
Índice de agentes de programación | 70 | 64 | Claude Code tiene un Índice de agentes de programación más alto que Grok Build |
DeepSWE | 66% | 60% | Claude Code tiene una puntuación más alta en DeepSWE que Grok Build |
Terminal-Bench v2.1 | 89% | 84% | Claude Code tiene una puntuación más alta en Terminal-Bench v2.1 que Grok Build |
SWE-Atlas-QnA | 56% | 48% | Claude Code tiene una puntuación más alta en SWE-Atlas-QnA que Grok Build |
Costo por tarea | $9.18 | $2.44 | Grok Build tiene un costo por tarea más bajo que Claude Code |
Tiempo por tarea | 24.0m | 15.5m | Grok Build tiene un tiempo por tarea más bajo que Claude Code |
Turnos por tarea | 25.4 | 60.7 | Claude Code tiene menos turnos por tarea que Grok Build |
Uso de tokens por tarea | 7.1M | 3.6M | Grok Build tiene un uso de tokens por tarea más bajo que Claude Code |
Tasa de aciertos de caché | 90% | 92% | Grok Build tiene una tasa de aciertos de caché más alta que Claude Code |
Variantes de modelo
Variantes de modelo evaluadas para Claude Code y Grok Build.
Variantes de modelo
70 | 66% | 89% | 56% | $9.18 | 24.0m | 7.1M | ||
68 | 60% | 89% | 55% | $8.17 | 23.7m | 21.6M | ||
67 | 66% | 87% | 49% | $11.69 | 23.5m | 13.9M | ||
67 | 63% | 89% | 49% | $8.94 | 24.2m | 23.7M | ||
66 | 65% | 87% | 46% | $8.53 | 17.1m | 10.3M | ||
66 | 61% | 87% | 49% | $3.92 | 14.0m | 9.9M | ||
65 | 64% | 89% | 42% | $5.97 | 12.2m | 7.1M | ||
64 | 63% | 85% | 44% | $3.17 | 12.2m | 8M | ||
63 | 64% | 87% | 39% | $4.74 | 11.0m | 5.7M | ||
62 | 56% | 84% | 47% | $7.72 | 23.1m | 17.9M | ||
61 | 52% | 84% | 48% | $3.23 | 29.9m | 12.5M | ||
59 | 57% | 82% | 39% | $2.30 | 10.0m | 5.3M | ||
59 | 44% | 82% | 52% | $3.53 | 11.8m | 9.2M | ||
59 | 51% | 83% | 43% | $5.67 | 17.8m | 13.6M | ||
59 | 60% | 82% | 34% | $3.17 | 8.2m | 3.7M | ||
58 | 52% | 82% | 39% | $3.78 | 12.7m | 9.2M | ||
56 | 49% | 82% | 36% | $3.30 | 12.0m | 7.8M | ||
52 | 40% | 78% | 37% | $5.92 | 15.8m | 16.1M | ||
49 | 41% | 78% | 28% | $2.18 | 8.6m | 5.2M | ||
43 | 29% | 72% | 29% | $1.91 | 25.1m | 10.8M | ||
42 | 27% | 77% | 23% | $1.80 | 6.7m | 4.6M | ||
39 | 29% | 67% | 20% | $2.04 | 13.8m | 8.4M | ||
38 | 19% | 72% | 24% | $6.30 | 10.7m | 8.8M | ||
37 | 19% | 67% | 25% | $4.28 | 19.0m | 25.8M | ||
34 | 17% | 69% | 16% | $1.22 | 40.7m | 11.7M | ||
33 | 9% | 70% | 20% | $0.25 | 17.9m | 9.9M | ||
64 | 60% | 84% | 48% | $2.44 | 15.5m | 3.6M |
Rendimiento
Rendimiento en el Índice de agentes de programación de Artificial Analysis.
Índice de agentes de programación de Artificial Analysis
Uso de tokens
Consumo de tokens en el Índice de agentes de programación de Artificial Analysis.
Uso de tokens por tarea
Índice de agentes de programación de Artificial Analysis vs. tokens totales
Costo
Costo de la API de pago por token en el Índice de agentes de programación de Artificial Analysis, según los precios actuales por token.
Costo por tarea
Índice de agentes de programación de Artificial Analysis vs. costo por tarea
Tiempo de ejecución
Tiempo de ejecución activo del agente en el Índice de agentes de programación de Artificial Analysis.