比较编程智能体
根据 Artificial Analysis Coding Agent Index 并排比较编程智能体,包括基准测试表现、成本、执行时间和 token 用量。
如需比较语言模型,请参阅我们的模型基准测试。
比较方式
选择两个编程智能体,并排查看性能、成本、每任务耗时和 token 用量。结果采用与Coding Agent Index相同的评测。
任意选择两个智能体,查看完整的并排明细。
vs
Popular comparisons
Claude Code
Opus 5 (xhigh)
67Codex
GPT-5.6 Sol (max)
67Claude Code
Opus 5 (xhigh)
67Cursor CLI
GPT-5.5 (medium)
46Claude Code
Opus 5 (xhigh)
67Gemini CLI
Gemini 3.1 Pro (high)
30Claude Code
Opus 5 (xhigh)
67Opencode
Muse Spark 1.1 (xhigh)
54Codex
GPT-5.6 Sol (max)
67Cursor CLI
GPT-5.5 (medium)
46Cursor CLI
GPT-5.5 (medium)
46Opencode
Muse Spark 1.1 (xhigh)
54