Codex vs. Kimi Code CLI
Vergleich von Codex und Kimi Code CLI im Artificial Analysis Coding Agent Index, einschließlich Benchmark-Werten, Kosten, Ausführungszeit und Tokenverbrauch.
Einzelheiten zu unserer Methodik finden Sie auf unserer Methodikseite.
Weitere Vergleiche entdecken
vs
Vergleich
Direkter Vergleich von Codex und Kimi Code CLI.
Programmieragenten-Vergleich
Metrik | Analyse | ||
|---|---|---|---|
Agent-Harness | Codex | Kimi Code CLI | |
Repräsentatives Modell | GPT-6.1 Sol (xhigh) | Kimi K3 | |
Coding Agent Index | 63 | 52 | Codex hat einen höheren Coding Agent Index als Kimi Code CLI |
DeepSWE v1.1 | 73% | 68% | Codex hat einen höheren DeepSWE v1.1-Wert als Kimi Code CLI |
Terminal-Bench 4.0 | 55% | 21% | Codex hat einen höheren Terminal-Bench 4.0-Wert als Kimi Code CLI |
SWE-Atlas-QnA | 61% | 66% | Kimi Code CLI hat einen höheren SWE-Atlas-QnA-Wert als Codex |
Kosten pro Aufgabe | 1,04 $ | 5,05 $ | Codex hat geringere Kosten pro Aufgabe als Kimi Code CLI |
Zeit pro Aufgabe | 15,5 Min. | 1,0h | Codex hat eine geringere Zeit pro Aufgabe als Kimi Code CLI |
Runden pro Aufgabe | 40,1 | 173,4 | Codex hat weniger Runden pro Aufgabe als Kimi Code CLI |
Token-Nutzung pro Aufgabe | 3,2 Mio. | 8,5 Mio. | Codex hat eine geringere Token-Nutzung pro Aufgabe als Kimi Code CLI |
Cache-Trefferquote | 93 % | 95 % | Kimi Code CLI hat eine höhere Cache-Trefferquote als Codex |
Modellvarianten
Bewertete Modellvarianten für Codex und Kimi Code CLI.
Modellvarianten
63 | 73% | 55% | 61% | 1,04 $ | 15,5 Min. | 3,2 Mio. | ||
62 | 68% | 56% | 62% | 7,47 $ | 29,4 Min. | 3,3 Mio. | ||
61 | 72% | 52% | 61% | 0,70 $ | 10,9 Min. | 2,3 Mio. | ||
60 | 71% | 50% | 60% | 0,89 $ | 13,3 Min. | 2,8 Mio. | ||
60 | 70% | 53% | 58% | 1,55 $ | 24,4 Min. | 4 Mio. | ||
57 | 68% | 49% | 55% | 0,50 $ | 8,6 Min. | 1,7 Mio. | ||
57 | 69% | 43% | 58% | 2,99 $ | 22,3 Min. | 9,8 Mio. | ||
55 | 72% | 37% | 54% | 6,35 $ | 20,6 Min. | 10,2 Mio. | ||
43 | 66% | 15% | 49% | 0,44 $ | 23,5 Min. | 14,9 Mio. | ||
43 | 57% | 10% | 62% | 0,24 $ | 40,3 Min. | 24,2 Mio. | ||
41 | 64% | 15% | 44% | 0,18 $ | 21,4 Min. | 10,2 Mio. | ||
39 | 54% | 11% | 51% | 0,09 $ | 18,3 Min. | 15,4 Mio. | ||
52 | 68% | 21% | 66% | 5,05 $ | 1,0h | 8,5 Mio. |
Leistung
Leistung im Artificial Analysis Coding Agent Index.
Artificial Analysis Coding Agent Index
Artificial Analysis Coding Agent Index v1.5 incorporates 3 benchmarks: DeepSWE v1.1, Terminal-Bench 4.0, and SWE-Atlas-QnA · Higher is better
Färben nach
Artificial Analysis Coding Agent Index vs. Kosten pro Aufgabe
Artificial Analysis Coding Agent Index vs. durchschnittliche Pay-per-Token-API-Kosten pro Aufgabe (USD)
Färben nach
Most attractive quadrant
Token-Nutzung
Token-Verbrauch im Artificial Analysis Coding Agent Index.
Token-Nutzung pro Aufgabe
Durchschnittliche Eingabe-, Cache- und Ausgabe-Tokens pro Aufgabe
Die Trefferquoten des Prompt-Caches können je nach Anbieter-Routing erheblich variieren und dadurch die effektiven Kosten deutlich verändern.
Artificial Analysis Coding Agent Index vs. Gesamt-Tokens
Artificial Analysis Coding Agent Index vs. durchschnittliche Gesamt-Tokens pro Aufgabe
Färben nach
Most attractive quadrant
Kosten
Pay-per-Token-API-Kosten im Artificial Analysis Coding Agent Index, basierend auf den aktuellen Preisen pro Token.
Kosten pro Aufgabe
Average pay-per-token API cost per task (USD) · Lower is better
Färben nach
Ausführungszeit
Aktive Agent-Laufzeit im Artificial Analysis Coding Agent Index.
Zeit pro Aufgabe
Average agent wall time per task · Lower is better
Färben nach
Artificial Analysis Coding Agent Index vs. Ausführungszeit
Artificial Analysis Coding Agent Index vs. durchschnittliche Agent-Laufzeit pro Aufgabe
Färben nach
Most attractive quadrant