Gemini CLI vs. Muse Code
Artificial Analysis Coding Agent Index의 벤치마크 점수, 비용, 실행 시간, 토큰 사용량을 기준으로 Gemini CLI 및 Muse Code를 비교합니다.
방법론에 관한 자세한 내용은 방법론 페이지를 참조하세요.
다른 비교 살펴보기
vs
주요 내용
Artificial Analysis Coding Agent Index v1.4 · Higher is better
Not publicly available
비교
Gemini CLI 및 Muse Code의 나란히 비교.
코딩 에이전트 비교
지표 | 분석 | ||
|---|---|---|---|
에이전트 하네스 | Gemini CLI | Muse Code | |
대표 모델 | Gemini 3.1 Pro (high) | Muse Spark 1.3 (max) | |
Coding Agent Index | 33 | 68 | Muse Code의 Coding Agent Index가 Gemini CLI보다 높습니다 |
DeepSWE | 14% | 68% | Muse Code의 DeepSWE 점수가 Gemini CLI보다 높습니다 |
Terminal-Bench v2.1 | 76% | 84% | Muse Code의 Terminal-Bench v2.1 점수가 Gemini CLI보다 높습니다 |
SWE-Atlas-QnA | 9% | 52% | Muse Code의 SWE-Atlas-QnA 점수가 Gemini CLI보다 높습니다 |
작업당 비용 | $1.04 | $0.00 | 비교할 수 없음 |
작업당 시간 | 11.1m | 24.6m | Gemini CLI의 작업당 시간이 Muse Code보다 짧습니다 |
작업당 턴 | 31 | 128.5 | Gemini CLI의 작업당 턴이 Muse Code보다 적습니다 |
작업당 토큰 사용량 | 4.7M | 14.2M | Gemini CLI의 작업당 토큰 사용량이 Muse Code보다 적습니다 |
캐시 적중률 | 87% | 95% | Muse Code의 캐시 적중률이 Gemini CLI보다 높습니다 |
모델 변형
Gemini CLI 및 Muse Code의 평가된 모델 변형.
모델 변형
33 | 14% | 76% | 9% | $1.04 | 11.1m | 4.7M | ||
68 | 68% | 84% | 52% | $0.00 | 24.6m | 14.2M | ||
64 | 67% | 82% | 44% | $1.72 | 12.8m | 14.8M | ||
62 | 58% | 82% | 45% | $2.07 | 40.8m | 20M |
성능
Artificial Analysis Coding Agent Index 전반의 성능.
Artificial Analysis Coding Agent Index
Artificial Analysis Coding Agent Index v1.4 incorporates 3 benchmarks: DeepSWE, Terminal-Bench v2.1, and SWE-Atlas-QnA · Higher is better
Not publicly available
Since benchmarking, we have observed a higher rate of content safety filtering on this endpoint.
토큰 사용량
Artificial Analysis Coding Agent Index 전반의 토큰 소비량.
작업당 토큰 사용량
작업당 평균 입력·캐시·출력 토큰
Prompt cache hit rates can vary significantly by provider routing, which can materially change effective cost.
Artificial Analysis Coding Agent Index vs. 총 토큰
Artificial Analysis Coding Agent Index vs. 작업당 평균 총 토큰
Most attractive quadrant
비용
현재 토큰당 가격을 기준으로 한 Artificial Analysis Coding Agent Index의 토큰당 종량제 API 비용.
작업당 비용
Average pay-per-token API cost per task (USD) · Lower is better
Artificial Analysis Coding Agent Index vs. 작업당 비용
Artificial Analysis Coding Agent Index vs. 작업당 평균 토큰당 종량제 API 비용 (USD)
Most attractive quadrant
실행 시간
Artificial Analysis Coding Agent Index 전반의 활성 에이전트 실행 시간.
작업당 시간
Average agent wall time per task · Lower is better
Not publicly available
Artificial Analysis Coding Agent Index vs. 실행 시간
Artificial Analysis Coding Agent Index vs. 작업당 평균 에이전트 실행 시간
Most attractive quadrant