比较编程智能体

根据 Artificial Analysis Coding Agent Index 并排比较编程智能体,包括基准测试表现、成本、执行时间和 token 用量。

如需比较语言模型,请参阅我们的模型基准测试

比较方式

选择两个编程智能体,并排查看性能、成本、每任务耗时和 token 用量。结果采用与Coding Agent Index相同的评测。

任意选择两个智能体,查看完整的并排明细。

vs

Popular comparisons