Gemini CLI vs. Grok Build
Vergleich von Gemini CLI und Grok Build im Artificial Analysis Coding Agent Index, einschließlich Benchmark-Werten, Kosten, Ausführungszeit und Tokenverbrauch.
Einzelheiten zu unserer Methodik finden Sie auf unserer Methodikseite.
Weitere Vergleiche entdecken
vs
Wichtigste Ergebnisse
Vergleich
Direkter Vergleich von Gemini CLI und Grok Build.
Programmieragenten-Vergleich
Metrik | Analyse | ||
|---|---|---|---|
Agent-Harness | Gemini CLI | Grok Build | |
Repräsentatives Modell | Gemini 3.1 Pro (high) | Grok 4.5 (high) | |
Coding Agent Index | 33 | 64 | Grok Build hat einen höheren Coding Agent Index als Gemini CLI |
DeepSWE | 14% | 60% | Grok Build hat einen höheren DeepSWE-Wert als Gemini CLI |
Terminal-Bench v2.1 | 76% | 84% | Grok Build hat einen höheren Terminal-Bench v2.1-Wert als Gemini CLI |
SWE-Atlas-QnA | 9% | 48% | Grok Build hat einen höheren SWE-Atlas-QnA-Wert als Gemini CLI |
Kosten pro Aufgabe | $1.04 | $2.44 | Gemini CLI hat geringere Kosten pro Aufgabe als Grok Build |
Zeit pro Aufgabe | 11.1m | 15.5m | Gemini CLI hat eine geringere Zeit pro Aufgabe als Grok Build |
Runden pro Aufgabe | 31 | 60.7 | Gemini CLI hat weniger Runden pro Aufgabe als Grok Build |
Token-Nutzung pro Aufgabe | 4.7M | 3.6M | Grok Build hat eine geringere Token-Nutzung pro Aufgabe als Gemini CLI |
Cache-Trefferquote | 87% | 92% | Grok Build hat eine höhere Cache-Trefferquote als Gemini CLI |
Modellvarianten
Bewertete Modellvarianten für Gemini CLI und Grok Build.
Modellvarianten
33 | 14% | 76% | 9% | $1.04 | 11.1m | 4.7M | ||
64 | 60% | 84% | 48% | $2.44 | 15.5m | 3.6M |
Leistung
Leistung im Artificial Analysis Coding Agent Index.
Artificial Analysis Coding Agent Index
Artificial Analysis Coding Agent Index v1.4 incorporates 3 benchmarks: DeepSWE, Terminal-Bench v2.1, and SWE-Atlas-QnA · Higher is better
Since benchmarking, we have observed a higher rate of content safety filtering on this endpoint.
Token-Nutzung
Token-Verbrauch im Artificial Analysis Coding Agent Index.
Token-Nutzung pro Aufgabe
Durchschnittliche Eingabe-, Cache- und Ausgabe-Tokens pro Aufgabe
Prompt cache hit rates can vary significantly by provider routing, which can materially change effective cost.
Artificial Analysis Coding Agent Index vs. Gesamt-Tokens
Artificial Analysis Coding Agent Index vs. durchschnittliche Gesamt-Tokens pro Aufgabe
Most attractive quadrant
Kosten
Pay-per-Token-API-Kosten im Artificial Analysis Coding Agent Index, basierend auf den aktuellen Preisen pro Token.
Kosten pro Aufgabe
Average pay-per-token API cost per task (USD) · Lower is better
Artificial Analysis Coding Agent Index vs. Kosten pro Aufgabe
Artificial Analysis Coding Agent Index vs. durchschnittliche Pay-per-Token-API-Kosten pro Aufgabe (USD)
Most attractive quadrant
Pareto line
Ausführungszeit
Aktive Agent-Laufzeit im Artificial Analysis Coding Agent Index.
Zeit pro Aufgabe
Average agent wall time per task · Lower is better
Artificial Analysis Coding Agent Index vs. Ausführungszeit
Artificial Analysis Coding Agent Index vs. durchschnittliche Agent-Laufzeit pro Aufgabe
Most attractive quadrant