Grok Build vs. Opencode
Artificial Analysis Coding Agent Index의 벤치마크 점수, 비용, 실행 시간, 토큰 사용량을 기준으로 Grok Build 및 Opencode를 비교합니다.
방법론에 관한 자세한 내용은 방법론 페이지를 참조하세요.
다른 비교 살펴보기
vs
비교
Grok Build 및 Opencode의 나란히 비교.
코딩 에이전트 비교
지표 | 분석 | ||
|---|---|---|---|
에이전트 하네스 | Grok Build | Opencode | |
대표 모델 | Grok 4.7 (xhigh) | GLM-5.3 | |
Coding Agent Index | 56 | 54 | Grok Build의 Coding Agent Index가 Opencode보다 높습니다 |
DeepSWE v1.1 | 73% | 61% | Grok Build의 DeepSWE v1.1 점수가 Opencode보다 높습니다 |
Terminal-Bench 4.0 | 33% | 40% | Opencode의 Terminal-Bench 4.0 점수가 Grok Build보다 높습니다 |
SWE-Atlas-QnA | 63% | 59% | Grok Build의 SWE-Atlas-QnA 점수가 Opencode보다 높습니다 |
작업당 비용 | US$8.82 | US$4.24 | Opencode의 작업당 비용이 Grok Build보다 낮습니다 |
작업당 시간 | 39.2분 | 48.1분 | Grok Build의 작업당 시간이 Opencode보다 짧습니다 |
작업당 턴 | 162.6 | 107 | Opencode의 작업당 턴이 Grok Build보다 적습니다 |
작업당 토큰 사용량 | 1432.5만 | 1427.6만 | Opencode의 작업당 토큰 사용량이 Grok Build보다 적습니다 |
캐시 적중률 | 94% | 97% | Opencode의 캐시 적중률이 Grok Build보다 높습니다 |
모델 변형
Grok Build 및 Opencode의 평가된 모델 변형.
모델 변형
56 | 73% | 33% | 63% | US$8.82 | 39.2분 | 1432.5만 | ||
47 | 65% | 18% | 58% | US$3.57 | 19.5분 | 554.4만 | ||
54 | 61% | 40% | 59% | US$4.24 | 48.1분 | 1427.6만 |
성능
Artificial Analysis Coding Agent Index 전반의 성능.
Artificial Analysis Coding Agent Index
Artificial Analysis Coding Agent Index v1.5 incorporates 3 benchmarks: DeepSWE v1.1, Terminal-Bench 4.0, and SWE-Atlas-QnA · Higher is better
색상 기준
Artificial Analysis Coding Agent Index vs. 작업당 비용
Artificial Analysis Coding Agent Index vs. 작업당 평균 토큰당 종량제 API 비용 (USD)
색상 기준
Most attractive quadrant
Pareto line
토큰 사용량
Artificial Analysis Coding Agent Index 전반의 토큰 소비량.
작업당 토큰 사용량
작업당 평균 입력·캐시·출력 토큰
프롬프트 캐시 적중률은 제공업체 라우팅에 따라 크게 달라질 수 있으며, 이에 따라 실제 비용도 크게 달라질 수 있습니다.
Artificial Analysis Coding Agent Index vs. 총 토큰
Artificial Analysis Coding Agent Index vs. 작업당 평균 총 토큰
색상 기준
Most attractive quadrant
비용
현재 토큰당 가격을 기준으로 한 Artificial Analysis Coding Agent Index의 토큰당 종량제 API 비용.
작업당 비용
Average pay-per-token API cost per task (USD) · Lower is better
색상 기준
실행 시간
Artificial Analysis Coding Agent Index 전반의 활성 에이전트 실행 시간.
작업당 시간
Average agent wall time per task · Lower is better
색상 기준
Artificial Analysis Coding Agent Index vs. 실행 시간
Artificial Analysis Coding Agent Index vs. 작업당 평균 에이전트 실행 시간
색상 기준
Most attractive quadrant