Codex vs. Muse Code
Vergleich von Codex und Muse Code im Artificial Analysis Coding Agent Index, einschließlich Benchmark-Werten, Kosten, Ausführungszeit und Tokenverbrauch.
Einzelheiten zu unserer Methodik finden Sie auf unserer Methodikseite.
Weitere Vergleiche entdecken
vs
Wichtigste Ergebnisse
Artificial Analysis Coding Agent Index v1.4 · Higher is better
Not publicly available
Vergleich
Direkter Vergleich von Codex und Muse Code.
Programmieragenten-Vergleich
Metrik | Analyse | ||
|---|---|---|---|
Agent-Harness | Codex | Muse Code | |
Repräsentatives Modell | GPT-5.6 Sol (max) | Muse Spark 1.3 (max) | |
Coding Agent Index | 65 | 68 | Muse Code hat einen höheren Coding Agent Index als Codex |
DeepSWE | 69% | 68% | Codex hat einen höheren DeepSWE-Wert als Muse Code |
Terminal-Bench v2.1 | 83% | 84% | Muse Code hat einen höheren Terminal-Bench v2.1-Wert als Codex |
SWE-Atlas-QnA | 43% | 52% | Muse Code hat einen höheren SWE-Atlas-QnA-Wert als Codex |
Kosten pro Aufgabe | $5.00 | $0.00 | Vergleich nicht verfügbar |
Zeit pro Aufgabe | 10.2m | 24.6m | Codex hat eine geringere Zeit pro Aufgabe als Muse Code |
Runden pro Aufgabe | 112.3 | 128.5 | Codex hat weniger Runden pro Aufgabe als Muse Code |
Token-Nutzung pro Aufgabe | 13.2M | 14.2M | Codex hat eine geringere Token-Nutzung pro Aufgabe als Muse Code |
Cache-Trefferquote | 90% | 95% | Muse Code hat eine höhere Cache-Trefferquote als Codex |
Modellvarianten
Bewertete Modellvarianten für Codex und Muse Code.
Modellvarianten
65 | 69% | 83% | 43% | $5.00 | 10.2m | 13.2M | ||
64 | 65% | 82% | 45% | $3.00 | 6.2m | 8M | ||
63 | 67% | 80% | 43% | $3.74 | 7.3m | 9.9M | ||
62 | 64% | 81% | 40% | $2.19 | 5.0m | 5.8M | ||
61 | 64% | 83% | 36% | $4.75 | 10.2m | 12.2M | ||
60 | 67% | 78% | 36% | $1.93 | 8.2m | 9.6M | ||
57 | 63% | 75% | 33% | $0.29 | 8.0m | 16M | ||
56 | 58% | 77% | 33% | $1.36 | 6.7m | 6.6M | ||
55 | 57% | 79% | 31% | $2.65 | 6.4m | 6.9M | ||
55 | 53% | 78% | 34% | $1.29 | 3.5m | 3.2M | ||
55 | 60% | 72% | 31% | $1.14 | 6.0m | 5.6M | ||
53 | 57% | 71% | 31% | $0.24 | 6.9m | 12.8M | ||
52 | 53% | 73% | 29% | $0.18 | 5.7m | 9.6M | ||
50 | 43% | 68% | 39% | $0.06 | 14.5m | 20.8M | ||
48 | 46% | 70% | 29% | $0.67 | 4.0m | 3.2M | ||
43 | 35% | 60% | 34% | $1.09 | 3.3m | 3.4M | ||
43 | 16% | 63% | 49% | $0.09 | 12.4m | 12.7M | ||
42 | 37% | 62% | 27% | $0.09 | 3.2m | 4.3M | ||
39 | 30% | 63% | 23% | $0.39 | 2.6m | 1.7M | ||
25 | 10% | 50% | 15% | $0.04 | 1.7m | 1.4M | ||
23 | 13% | 37% | 19% | $0.29 | 1.5m | 1.1M | ||
19 | 6% | 33% | 17% | $0.07 | 2.2m | 3.5M | ||
68 | 68% | 84% | 52% | $0.00 | 24.6m | 14.2M | ||
64 | 67% | 82% | 44% | $1.72 | 12.8m | 14.8M | ||
62 | 58% | 82% | 45% | $2.07 | 40.8m | 20M |
Leistung
Leistung im Artificial Analysis Coding Agent Index.
Artificial Analysis Coding Agent Index
Artificial Analysis Coding Agent Index v1.4 incorporates 3 benchmarks: DeepSWE, Terminal-Bench v2.1, and SWE-Atlas-QnA · Higher is better
Not publicly available
Since benchmarking, we have observed a higher rate of content safety filtering on this endpoint.
Token-Nutzung
Token-Verbrauch im Artificial Analysis Coding Agent Index.
Token-Nutzung pro Aufgabe
Durchschnittliche Eingabe-, Cache- und Ausgabe-Tokens pro Aufgabe
Prompt cache hit rates can vary significantly by provider routing, which can materially change effective cost.
Artificial Analysis Coding Agent Index vs. Gesamt-Tokens
Artificial Analysis Coding Agent Index vs. durchschnittliche Gesamt-Tokens pro Aufgabe
Most attractive quadrant
Kosten
Pay-per-Token-API-Kosten im Artificial Analysis Coding Agent Index, basierend auf den aktuellen Preisen pro Token.
Kosten pro Aufgabe
Average pay-per-token API cost per task (USD) · Lower is better
Artificial Analysis Coding Agent Index vs. Kosten pro Aufgabe
Artificial Analysis Coding Agent Index vs. durchschnittliche Pay-per-Token-API-Kosten pro Aufgabe (USD)
Most attractive quadrant
Ausführungszeit
Aktive Agent-Laufzeit im Artificial Analysis Coding Agent Index.
Zeit pro Aufgabe
Average agent wall time per task · Lower is better
Not publicly available
Artificial Analysis Coding Agent Index vs. Ausführungszeit
Artificial Analysis Coding Agent Index vs. durchschnittliche Agent-Laufzeit pro Aufgabe
Most attractive quadrant