Codex vs. Gemini CLI
Comparación entre Codex y Gemini CLI en el Índice de agentes de programación de Artificial Analysis, incluidos resultados de benchmarks, costo, tiempo de ejecución y uso de tokens.
Para más detalles sobre nuestra metodología, consulta nuestra página de metodología.
Destacados
Comparación
Comparación lado a lado de Codex y Gemini CLI.
Comparación de agentes de programación
Métrica | Análisis | ||
|---|---|---|---|
Harness del agente | Codex | Gemini CLI | |
Modelo representativo | GPT-6 Astra (max) | Gemini 3.1 Pro (high) | |
Índice de agentes de programación | 67 | 33 | Codex tiene un Índice de agentes de programación más alto que Gemini CLI |
DeepSWE | 67% | 14% | Codex tiene una puntuación más alta en DeepSWE que Gemini CLI |
Terminal-Bench v2.1 | 83% | 76% | Codex tiene una puntuación más alta en Terminal-Bench v2.1 que Gemini CLI |
SWE-Atlas-QnA | 51% | 9% | Codex tiene una puntuación más alta en SWE-Atlas-QnA que Gemini CLI |
Costo por tarea | $4.72 | $1.04 | Gemini CLI tiene un costo por tarea más bajo que Codex |
Tiempo por tarea | 26.8m | 11.1m | Gemini CLI tiene un tiempo por tarea más bajo que Codex |
Turnos por tarea | 29.2 | 31 | Codex tiene menos turnos por tarea que Gemini CLI |
Uso de tokens por tarea | 4M | 4.7M | Codex tiene un uso de tokens por tarea más bajo que Gemini CLI |
Tasa de aciertos de caché | 91% | 87% | Codex tiene una tasa de aciertos de caché más alta que Gemini CLI |
Variantes de modelo
Variantes de modelo evaluadas para Codex y Gemini CLI.
Variantes de modelo
67 | 67% | 83% | 51% | $4.72 | 26.8m | 4M | ||
65 | 69% | 83% | 43% | $5.00 | 10.2m | 13.2M | ||
64 | 65% | 82% | 45% | $3.00 | 6.2m | 8M | ||
63 | 67% | 80% | 43% | $3.74 | 7.3m | 9.9M | ||
62 | 64% | 81% | 40% | $2.19 | 5.0m | 5.8M | ||
61 | 64% | 83% | 36% | $4.75 | 10.2m | 12.2M | ||
60 | 67% | 78% | 36% | $1.93 | 8.2m | 9.6M | ||
57 | 63% | 75% | 33% | $0.29 | 8.0m | 16M | ||
56 | 58% | 77% | 33% | $1.36 | 6.7m | 6.6M | ||
55 | 57% | 79% | 31% | $2.65 | 6.4m | 6.9M | ||
55 | 53% | 78% | 34% | $1.29 | 3.5m | 3.2M | ||
55 | 60% | 72% | 31% | $1.14 | 6.0m | 5.6M | ||
53 | 57% | 71% | 31% | $0.24 | 6.9m | 12.8M | ||
52 | 53% | 73% | 29% | $0.18 | 5.7m | 9.6M | ||
50 | 43% | 68% | 39% | $0.06 | 14.5m | 20.8M | ||
48 | 46% | 70% | 29% | $0.67 | 4.0m | 3.2M | ||
43 | 35% | 60% | 34% | $1.09 | 3.3m | 3.4M | ||
43 | 16% | 63% | 49% | $0.09 | 12.4m | 12.7M | ||
42 | 37% | 62% | 27% | $0.09 | 3.2m | 4.3M | ||
39 | 30% | 63% | 23% | $0.39 | 2.6m | 1.7M | ||
25 | 10% | 50% | 15% | $0.04 | 1.7m | 1.4M | ||
23 | 13% | 37% | 19% | $0.29 | 1.5m | 1.1M | ||
19 | 6% | 33% | 17% | $0.07 | 2.2m | 3.5M | ||
33 | 14% | 76% | 9% | $1.04 | 11.1m | 4.7M |
Rendimiento
Rendimiento en el Índice de agentes de programación de Artificial Analysis.
Índice de agentes de programación de Artificial Analysis
Uso de tokens
Consumo de tokens en el Índice de agentes de programación de Artificial Analysis.
Uso de tokens por tarea
Índice de agentes de programación de Artificial Analysis vs. tokens totales
Costo
Costo de la API de pago por token en el Índice de agentes de programación de Artificial Analysis, según los precios actuales por token.
Costo por tarea
Índice de agentes de programación de Artificial Analysis vs. costo por tarea
Tiempo de ejecución
Tiempo de ejecución activo del agente en el Índice de agentes de programación de Artificial Analysis.