Claude Code vs. Codex
Vergleich von Claude Code und Codex im Artificial Analysis Coding Agent Index, einschließlich Benchmark-Werten, Kosten, Ausführungszeit und Tokenverbrauch.
Einzelheiten zu unserer Methodik finden Sie auf unserer Methodikseite.
Weitere Vergleiche entdecken
vs
Wichtigste Ergebnisse
Vergleich
Direkter Vergleich von Claude Code und Codex.
Programmieragenten-Vergleich
Metrik | Analyse | ||
|---|---|---|---|
Agent-Harness | Claude Code | Codex | |
Repräsentatives Modell | Fable 5.1 (max) (with fallback) | GPT-6 Astra (max) | |
Coding Agent Index | 62 | 62 | Claude Code hat einen höheren Coding Agent Index als Codex |
DeepSWE v1.1 | 64% | 68% | Codex hat einen höheren DeepSWE v1.1-Wert als Claude Code |
Terminal-Bench 4.0 | 58% | 56% | Claude Code hat einen höheren Terminal-Bench 4.0-Wert als Codex |
SWE-Atlas-QnA | 65% | 62% | Claude Code hat einen höheren SWE-Atlas-QnA-Wert als Codex |
Kosten pro Aufgabe | $12.39 | $7.47 | Codex hat geringere Kosten pro Aufgabe als Claude Code |
Zeit pro Aufgabe | 34.8m | 29.4m | Codex hat eine geringere Zeit pro Aufgabe als Claude Code |
Runden pro Aufgabe | 36.7 | 39.4 | Claude Code hat weniger Runden pro Aufgabe als Codex |
Token-Nutzung pro Aufgabe | 5.7M | 3.3M | Codex hat eine geringere Token-Nutzung pro Aufgabe als Claude Code |
Cache-Trefferquote | 92% | 93% | Codex hat eine höhere Cache-Trefferquote als Claude Code |
Modellvarianten
Bewertete Modellvarianten für Claude Code und Codex.
Modellvarianten
62 | 64% | 58% | 65% | $12.39 | 34.8m | 5.7M | ||
60 | 63% | 55% | 62% | $10.79 | 41.9m | 11.4M | ||
43 | 51% | 17% | 62% | $3.49 | 1.1h | 8.7M | ||
62 | 68% | 56% | 62% | $7.47 | 29.4m | 3.3M | ||
55 | 72% | 37% | 54% | $6.58 | 20.6m | 10.2M | ||
43 | 57% | 10% | 62% | $0.24 | 40.3m | 24.2M | ||
39 | 54% | 11% | 51% | $0.08 | 18.3m | 15.4M |
Leistung
Leistung im Artificial Analysis Coding Agent Index.
Artificial Analysis Coding Agent Index
Artificial Analysis Coding Agent Index v1.5 incorporates 3 benchmarks: DeepSWE v1.1, Terminal-Bench 4.0, and SWE-Atlas-QnA · Higher is better
Color by
Artificial Analysis Coding Agent Index vs. Kosten pro Aufgabe
Artificial Analysis Coding Agent Index vs. durchschnittliche Pay-per-Token-API-Kosten pro Aufgabe (USD)
Color by
Most attractive quadrant
Pareto line
Token-Nutzung
Token-Verbrauch im Artificial Analysis Coding Agent Index.
Token-Nutzung pro Aufgabe
Durchschnittliche Eingabe-, Cache- und Ausgabe-Tokens pro Aufgabe
Prompt cache hit rates can vary significantly by provider routing, which can materially change effective cost.
Artificial Analysis Coding Agent Index vs. Gesamt-Tokens
Artificial Analysis Coding Agent Index vs. durchschnittliche Gesamt-Tokens pro Aufgabe
Color by
Most attractive quadrant
Kosten
Pay-per-Token-API-Kosten im Artificial Analysis Coding Agent Index, basierend auf den aktuellen Preisen pro Token.
Kosten pro Aufgabe
Average pay-per-token API cost per task (USD) · Lower is better
Color by
Ausführungszeit
Aktive Agent-Laufzeit im Artificial Analysis Coding Agent Index.
Zeit pro Aufgabe
Average agent wall time per task · Lower is better
Color by
Artificial Analysis Coding Agent Index vs. Ausführungszeit
Artificial Analysis Coding Agent Index vs. durchschnittliche Agent-Laufzeit pro Aufgabe
Color by
Most attractive quadrant