Devin Fusion CLI vs. Grok Build
Vergleich von Devin Fusion CLI und Grok Build im Artificial Analysis Coding Agent Index, einschließlich Benchmark-Werten, Kosten, Ausführungszeit und Tokenverbrauch.
Einzelheiten zu unserer Methodik finden Sie auf unserer Methodikseite.
Weitere Vergleiche entdecken
vs
Wichtigste Ergebnisse
Vergleich
Direkter Vergleich von Devin Fusion CLI und Grok Build.
Programmieragenten-Vergleich
Metrik | Analyse | ||
|---|---|---|---|
Agent-Harness | Devin Fusion CLI | Grok Build | |
Repräsentatives Modell | Claude Fable 5.1 XHigh + SWE-2 Medium | Grok 4.7 (xhigh) | |
Coding Agent Index | 62 | 56 | Devin Fusion CLI hat einen höheren Coding Agent Index als Grok Build |
DeepSWE v1.1 | 63% | 73% | Grok Build hat einen höheren DeepSWE v1.1-Wert als Devin Fusion CLI |
Terminal-Bench 4.0 | 56% | 33% | Devin Fusion CLI hat einen höheren Terminal-Bench 4.0-Wert als Grok Build |
SWE-Atlas-QnA | 66% | 63% | Devin Fusion CLI hat einen höheren SWE-Atlas-QnA-Wert als Grok Build |
Kosten pro Aufgabe | 7,90 $ | 8,82 $ | Devin Fusion CLI hat geringere Kosten pro Aufgabe als Grok Build |
Zeit pro Aufgabe | 35,8 Min. | 39,2 Min. | Devin Fusion CLI hat eine geringere Zeit pro Aufgabe als Grok Build |
Runden pro Aufgabe | 99,5 | 162,6 | Devin Fusion CLI hat weniger Runden pro Aufgabe als Grok Build |
Token-Nutzung pro Aufgabe | 9,7 Mio. | 14,3 Mio. | Devin Fusion CLI hat eine geringere Token-Nutzung pro Aufgabe als Grok Build |
Cache-Trefferquote | 96 % | 94 % | Devin Fusion CLI hat eine höhere Cache-Trefferquote als Grok Build |
Modellvarianten
Bewertete Modellvarianten für Devin Fusion CLI und Grok Build.
Modellvarianten
62 | 63% | 56% | 66% | 7,90 $ | 35,8 Min. | 9,7 Mio. | ||
59 | 67% | 50% | 59% | 4,54 $ | 24,7 Min. | 6,1 Mio. | ||
56 | 73% | 33% | 63% | 8,82 $ | 39,2 Min. | 14,3 Mio. | ||
47 | 65% | 18% | 58% | 3,57 $ | 19,5 Min. | 5,5 Mio. |
Leistung
Leistung im Artificial Analysis Coding Agent Index.
Artificial Analysis Coding Agent Index
Artificial Analysis Coding Agent Index v1.5 incorporates 3 benchmarks: DeepSWE v1.1, Terminal-Bench 4.0, and SWE-Atlas-QnA · Higher is better
Färben nach
Artificial Analysis Coding Agent Index vs. Kosten pro Aufgabe
Artificial Analysis Coding Agent Index vs. durchschnittliche Pay-per-Token-API-Kosten pro Aufgabe (USD)
Färben nach
Most attractive quadrant
Token-Nutzung
Token-Verbrauch im Artificial Analysis Coding Agent Index.
Token-Nutzung pro Aufgabe
Durchschnittliche Eingabe-, Cache- und Ausgabe-Tokens pro Aufgabe
Die Trefferquoten des Prompt-Caches können je nach Anbieter-Routing erheblich variieren und dadurch die effektiven Kosten deutlich verändern.
Artificial Analysis Coding Agent Index vs. Gesamt-Tokens
Artificial Analysis Coding Agent Index vs. durchschnittliche Gesamt-Tokens pro Aufgabe
Färben nach
Most attractive quadrant
Kosten
Pay-per-Token-API-Kosten im Artificial Analysis Coding Agent Index, basierend auf den aktuellen Preisen pro Token.
Kosten pro Aufgabe
Average pay-per-token API cost per task (USD) · Lower is better
Färben nach
Ausführungszeit
Aktive Agent-Laufzeit im Artificial Analysis Coding Agent Index.
Zeit pro Aufgabe
Average agent wall time per task · Lower is better
Färben nach
Artificial Analysis Coding Agent Index vs. Ausführungszeit
Artificial Analysis Coding Agent Index vs. durchschnittliche Agent-Laufzeit pro Aufgabe
Färben nach
Most attractive quadrant