Antigravity CLI 与 Codex

根据 Artificial Analysis Coding Agent Index比较 Antigravity CLI 与 Codex,包括基准测试得分、成本、执行时间和 token 用量。

有关我们方法论的详细信息,请参阅方法论页面。

浏览其他比较
vs

亮点

Updated
Artificial Analysis Coding Agent Index v1.5 · Higher is better
Average agent wall time per task · Lower is better
Average API cost per task (USD) · Lower is better

比较

Antigravity CLI 与 Codex 的并排比较。

编程智能体比较

指标
Antigravity CLI
Gemini 4 Argon
Codex
GPT-6.1 Sol (xhigh)
分析
智能体 Harness
Antigravity CLI
Codex
代表模型
Gemini 4 Argon
GPT-6.1 Sol (xhigh)
编程智能体指数
64
63
Antigravity CLI 的编程智能体指数高于 Codex
DeepSWE v1.1
79%
73%
Antigravity CLI 的 DeepSWE v1.1 分数高于 Codex
Terminal-Bench 4.0
56%
55%
Antigravity CLI 的 Terminal-Bench 4.0 分数高于 Codex
SWE-Atlas-QnA
56%
61%
Codex 的 SWE-Atlas-QnA 分数高于 Antigravity CLI
每个任务的成本
US$5.84
US$1.04
Codex 的每个任务成本低于 Antigravity CLI
每个任务的时间
34.5分钟
15.5分钟
Codex 的每个任务时间短于 Antigravity CLI
每个任务的轮次
149.2
40.1
Codex 的每个任务轮次少于 Antigravity CLI
每个任务的 Token 用量
1373.4万
321.3万
Codex 的每个任务 token 用量少于 Antigravity CLI
缓存命中率
87%
93%
Codex 的缓存命中率高于 Antigravity CLI

模型变体

Antigravity CLI 与 Codex 的已评估模型变体。

模型变体

Antigravity CLI
Gemini 4 Argon
64
79%
56%
56%
US$5.84
34.5分钟
1373.4万
Codex
GPT-6.1 Sol (xhigh)
63
73%
55%
61%
US$1.04
15.5分钟
321.3万
Codex
GPT-6 Astra (max)
62
68%
56%
62%
US$7.47
29.4分钟
334.7万
Codex
GPT-6.1 Sol (medium)
61
72%
52%
61%
US$0.70
10.9分钟
229.8万
Codex
GPT-6.1 Sol (high)
60
71%
50%
60%
US$0.89
13.3分钟
282万
Codex
GPT-6.1 Sol (max)
60
70%
53%
58%
US$1.55
24.4分钟
400万
Codex
GPT-6.1 Sol (low)
57
68%
49%
55%
US$0.50
8.6分钟
171.4万
Codex
GPT-6 Sol (max)
57
69%
43%
58%
US$2.99
22.3分钟
984.1万
Codex
GPT-5.6 Sol (max)
55
72%
37%
54%
US$6.35
20.6分钟
1017万
Codex
GPT-5.6 Luna (max)
43
66%
15%
49%
US$0.44
23.5分钟
1485.5万
Codex
DeepSeek V4 Pro 0813 (max)
43
57%
10%
62%
US$0.24
40.3分钟
2418万
Codex
GPT-6 Luna (max)
41
64%
15%
44%
US$0.18
21.4分钟
1021.8万
Codex
DeepSeek V4 Flash 0731 (max)
39
54%
11%
51%
US$0.09
18.3分钟
1535万

性能

Artificial Analysis Coding Agent Index上的性能。

Artificial Analysis Coding Agent Index

Artificial Analysis Coding Agent Index v1.5 incorporates 3 benchmarks: DeepSWE v1.1, Terminal-Bench 4.0, and SWE-Atlas-QnA · Higher is better

Artificial Analysis Coding Agent Index vs. 每个任务的成本

Artificial Analysis Coding Agent Index vs. 每个任务的平均按 token 计费 API 成本(USD)
Most attractive quadrant
Pareto line

Token 用量

Artificial Analysis Coding Agent Index上的 token 消耗。

每个任务的 Token 用量

每个任务的平均输入、缓存和输出 token
提示词缓存命中率可能因提供商路由而显著变化,从而实质性地影响实际成本。

Artificial Analysis Coding Agent Index vs. 总 Token

Artificial Analysis Coding Agent Index vs. 每个任务的平均总 Token
Most attractive quadrant

成本

基于当前按 token 计费价格的 Artificial Analysis Coding Agent Index按 token 计费 API 成本。

每个任务的成本

Average pay-per-token API cost per task (USD) · Lower is better

执行时间

Artificial Analysis Coding Agent Index上的智能体活跃运行时间。

每个任务的时间

Average agent wall time per task · Lower is better

Artificial Analysis Coding Agent Index vs. 执行时间

Artificial Analysis Coding Agent Index vs. 每个任务的平均智能体运行时间
Most attractive quadrant