Claude Code vs. Codex
Vergleich von Claude Code und Codex im Artificial Analysis Coding Agent Index, einschließlich Benchmark-Werten, Kosten, Ausführungszeit und Tokenverbrauch.
Einzelheiten zu unserer Methodik finden Sie auf unserer Methodikseite.
Weitere Vergleiche entdecken
vs
Vergleich
Direkter Vergleich von Claude Code und Codex.
Programmieragenten-Vergleich
Metrik | Analyse | ||
|---|---|---|---|
Agent-Harness | Claude Code | Codex | |
Repräsentatives Modell | Sonnet 5.5 (max) | GPT-6.1 Sol (xhigh) | |
Coding Agent Index | 68 | 63 | Claude Code hat einen höheren Coding Agent Index als Codex |
DeepSWE v1.1 | 72% | 73% | Codex hat einen höheren DeepSWE v1.1-Wert als Claude Code |
Terminal-Bench 4.0 | 66% | 55% | Claude Code hat einen höheren Terminal-Bench 4.0-Wert als Codex |
SWE-Atlas-QnA | 67% | 61% | Claude Code hat einen höheren SWE-Atlas-QnA-Wert als Codex |
Kosten pro Aufgabe | 14,19 $ | 1,04 $ | Codex hat geringere Kosten pro Aufgabe als Claude Code |
Zeit pro Aufgabe | 1,5h | 15,5 Min. | Codex hat eine geringere Zeit pro Aufgabe als Claude Code |
Runden pro Aufgabe | 265,9 | 40,1 | Codex hat weniger Runden pro Aufgabe als Claude Code |
Token-Nutzung pro Aufgabe | 27,7 Mio. | 3,2 Mio. | Codex hat eine geringere Token-Nutzung pro Aufgabe als Claude Code |
Cache-Trefferquote | 95 % | 93 % | Claude Code hat eine höhere Cache-Trefferquote als Codex |
Modellvarianten
Bewertete Modellvarianten für Claude Code und Codex.
Modellvarianten
68 | 72% | 66% | 67% | 14,19 $ | 1,5h | 27,7 Mio. | ||
66 | 68% | 63% | 66% | 13,04 $ | 1,1h | 15,6 Mio. | ||
63 | 68% | 58% | 62% | 3,33 $ | 27,0 Min. | 7,1 Mio. | ||
62 | 64% | 58% | 65% | 12,39 $ | 34,8 Min. | 5,7 Mio. | ||
60 | 63% | 55% | 62% | 10,79 $ | 41,9 Min. | 11,4 Mio. | ||
55 | 67% | 42% | 56% | 1,24 $ | 12,3 Min. | 2,7 Mio. | ||
46 | 65% | 27% | 45% | 0,62 $ | 8,5 Min. | 1,3 Mio. | ||
43 | 51% | 17% | 62% | 3,48 $ | 1,1h | 8,7 Mio. | ||
42 | 62% | 25% | 39% | 0,48 $ | 6,3 Min. | 977.284,8 | ||
63 | 73% | 55% | 61% | 1,04 $ | 15,5 Min. | 3,2 Mio. | ||
62 | 68% | 56% | 62% | 7,47 $ | 29,4 Min. | 3,3 Mio. | ||
61 | 72% | 52% | 61% | 0,70 $ | 10,9 Min. | 2,3 Mio. | ||
60 | 71% | 50% | 60% | 0,89 $ | 13,3 Min. | 2,8 Mio. | ||
60 | 70% | 53% | 58% | 1,55 $ | 24,4 Min. | 4 Mio. | ||
57 | 68% | 49% | 55% | 0,50 $ | 8,6 Min. | 1,7 Mio. | ||
57 | 69% | 43% | 58% | 2,99 $ | 22,3 Min. | 9,8 Mio. | ||
55 | 72% | 37% | 54% | 6,35 $ | 20,6 Min. | 10,2 Mio. | ||
43 | 66% | 15% | 49% | 0,44 $ | 23,5 Min. | 14,9 Mio. | ||
43 | 57% | 10% | 62% | 0,24 $ | 40,3 Min. | 24,2 Mio. | ||
41 | 64% | 15% | 44% | 0,18 $ | 21,4 Min. | 10,2 Mio. | ||
39 | 54% | 11% | 51% | 0,09 $ | 18,3 Min. | 15,4 Mio. |
Leistung
Leistung im Artificial Analysis Coding Agent Index.
Artificial Analysis Coding Agent Index
Artificial Analysis Coding Agent Index v1.5 incorporates 3 benchmarks: DeepSWE v1.1, Terminal-Bench 4.0, and SWE-Atlas-QnA · Higher is better
Färben nach
Artificial Analysis Coding Agent Index vs. Kosten pro Aufgabe
Artificial Analysis Coding Agent Index vs. durchschnittliche Pay-per-Token-API-Kosten pro Aufgabe (USD)
Färben nach
Most attractive quadrant
Pareto line
Token-Nutzung
Token-Verbrauch im Artificial Analysis Coding Agent Index.
Token-Nutzung pro Aufgabe
Durchschnittliche Eingabe-, Cache- und Ausgabe-Tokens pro Aufgabe
Die Trefferquoten des Prompt-Caches können je nach Anbieter-Routing erheblich variieren und dadurch die effektiven Kosten deutlich verändern.
Artificial Analysis Coding Agent Index vs. Gesamt-Tokens
Artificial Analysis Coding Agent Index vs. durchschnittliche Gesamt-Tokens pro Aufgabe
Färben nach
Most attractive quadrant
Kosten
Pay-per-Token-API-Kosten im Artificial Analysis Coding Agent Index, basierend auf den aktuellen Preisen pro Token.
Kosten pro Aufgabe
Average pay-per-token API cost per task (USD) · Lower is better
Färben nach
Ausführungszeit
Aktive Agent-Laufzeit im Artificial Analysis Coding Agent Index.
Zeit pro Aufgabe
Average agent wall time per task · Lower is better
Färben nach
Artificial Analysis Coding Agent Index vs. Ausführungszeit
Artificial Analysis Coding Agent Index vs. durchschnittliche Agent-Laufzeit pro Aufgabe
Färben nach
Most attractive quadrant