语言
为每个已追踪的语言模型提供独立基准测试、价格、延迟和服务商可用性数据。
- 语言模型
- 模型服务商
Intelligence Index
/ 100
50.2
Output Speed
268 t/s
Input · 1M
$1.50
Output · 1M
$9.00
First Token
13.04s
无需再从截图中抄录数值。直接获取我们在 Artificial Analysis 上发布的同一套基准测试、价格和性能数据。



以稳定且文档完善的格式获取已发布的模型、服务商、基准测试、价格和性能指标。
模型与服务商信息
语言和媒体模型的名称、开发商、发布日期、模态、参数量、上下文窗口和许可证状态。
综合指数
所有已追踪模型的 Intelligence、Coding、Agentic、Math、Openness 和 Multilingual Index 得分。
基准测试
GPQA、HLE、SciCode、IFBench、MMLU-Pro、AIME、LiveCodeBench、τ²-Bench、Terminal-Bench、AA-Omniscience、GDPval-AA v2 等基准测试的独立得分。
价格
按模型和服务商提供每 100 万 token 的输入、输出、混合和缓存价格。
性能分布
输出速度、首 Token 延迟、首个答案 Token 延迟和端到端响应时间的中位数与百分位数。
时间序列
按模型和服务商提供 7 天、30 天和 90 天的性能窗口,粒度可为每日、每周或每月,覆盖中等、长文本、100K、视觉、编程和并行工作负载。
服务商级数据
每个模型托管服务商的价格、性能和上下文窗口数据,可直接用于路由和比较。
服务商测量数据
面向获批推理服务商的测量级数据导出,仅限列入白名单的服务商 slug。
当模型数据需要保持最新、可比较且机器可读时,团队会使用该 API。
构建模型选择器的产品团队
利用名称、开发商、基准测试得分、价格和服务商可用性,帮助客户选择合适的模型。
智能体与模型路由器
在运行时根据最新的基准测试得分、价格和可用性,将请求路由到合适的模型和服务商。
推理服务商与 AI 实验室
了解自己的模型和接入点在公开基准测试中的表现,与同类产品比较,并访问获批的第一方测量数据。
分析师与内部 AI 团队
在研究、报告、市场分析和内部评测仪表板中使用独立排名、基准测试得分和价格,无需手动录入数据即可保持最新。
媒体生成产品
使用结构化的模型、服务商、排名、价格和基准测试数据,比较图像、视频、语音和音乐系统。
商业集成
为面向客户的产品、出版物和数据源获取更高限额和数据再分发权利。
只需集成一次,之后无需重建数据模型即可添加语言、图像、视频、语音和音乐接入点。
为每个已追踪的语言模型提供独立基准测试、价格、延迟和服务商可用性数据。
文生图和图像编辑系统的竞技场排名、价格和能力元数据。
文生视频和图生视频生成模型的价格、运行时间和竞技场排名。
语音合成、转录、实时对话和音乐生成的质量、延迟与价格。
每个接入点均采用稳定标识符、文档完善的字段、分页、速率限制响应头和可预期的错误。
一致的数据结构
模型、服务商、语言、媒体和评测接入点均提供结构化 JSON。
基于密钥的访问
按机构划分作用域的密钥,支持按套餐控制访问,并提供明确的速率限制文档。
可比较的指标
经过标准化的质量、速度、延迟和价格字段,可直接进行比较。
持续更新
模型、服务商、基准测试和价格会随发布持续更新。
生产工作流
让仪表板、路由逻辑、分析和面向客户的工具使用同一个可信数据源。
再分发权利
商业许可可以涵盖在面向客户的产品、报告和数据源中再分发数据的权利。
# List models with benchmarks, pricing, and performance
curl "https://artificialanalysis.ai/api/v2/language/models" \
-H "x-api-key: $AA_API_KEY"{"intelligence_index_version": 4.1,"data": [{"slug": "gemini-3-5-flash","name": "Gemini 3.5 Flash","model_creator": {"name": "Google"},"evaluations": {"artificial_analysis_intelligence_index": 50.2},"pricing": {"price_1m_input_tokens": 1.5,"price_1m_output_tokens": 9},"performance": {"median_output_tokens_per_second": 267.95,"median_time_to_first_token_seconds": 13.04}}]}
使用 Free API 进行探索和构建内部工作流。对于 B2B 集成、更高限额、再分发权利、特定套餐的媒体数据和获批测量数据导出,请选择 Commercial 套餐。
| 功能 | Free API | Pro API | Commercial API |
|---|---|---|---|
| 每日速率限制 | 100 次请求 | 500 次请求 | 定制(基础套餐每天 1,000 次) |
| 模型信息与主要指数 | |||
| 竞技场排名(图像、视频、语音、音乐) | |||
| 输入与输出 token 价格 | |||
| 性能指标中位数 | |||
| 单项评测得分 | |||
| 混合价格字段 | |||
| 性能百分位数(P5 至 P95) | |||
| 性能随时间变化(7 天、30 天和 90 天窗口) | |||
| 开放性指数(8 项组成明细) | |||
| 每个模型的服务商级数据 | |||
| 服务商原始测量数据 | 仅限获批服务商 | ||
| 再分发权利 | 仅限内部使用,须注明出处 | 受限的外部使用 | 可注明出处后进行商业再分发 |
| 支持 | 无 | 电子邮件支持 | 个性化支持 |
| 价格 | $0 | 查看月付和年付价格 | 按套餐报价 |
| 机构规模 | 少于 150 名员工 | 少于 150 名员工 | 150 名及以上员工 |
告诉我们你正在构建什么、需要哪些数据,以及需要内部使用还是商业使用权利。我们会推荐合适的套餐、限额、权利和接入点。