Artificial Analysis AI 趋势
分析 AI 的当前状况和推动其进步的主要趋势,包括模型智能、效率、架构、推理速度与成本,以及训练趋势。
AI 进展
追踪 AI 的持续进步以及各家领先 AI 公司的相对位置。
Frontier Language Model Intelligence, Over Time
Artificial Analysis Intelligence Index v4.1 incorporates 9 evaluations: GDPval-AA v2, 𝜏³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience, AA-LCR
主要科技公司的资本支出变化
各季度资本支出(十亿美元)
Intelligence Index 与发布日期
Artificial Analysis Intelligence Index · Release date
Most attractive region
各 AI 实验室的领先模型
各 AI 实验室达到的最高 Artificial Analysis Intelligence Index
Reasoning models are indicated by a lightbulb icon
效率
分析 AI 效率的发展,包括达到不同智能水平的成本以及获取这种智能的速度如何变化。
按 Intelligence Index 区间划分的语言模型推理价格变化
每 100 万 token 的价格(美元,缓存、输入和输出 token 价格按 7:2:1 混合计算)。区间采用 Artificial Analysis Intelligence Index v4.1。
Reasoning models are indicated by a lightbulb icon
按 Intelligence Index 区间划分的语言模型输出速度变化
每秒输出 token 数。区间采用 Artificial Analysis Intelligence Index v4.1。
Reasoning models are indicated by a lightbulb icon
国家分析
AI 是一种全球现象。我们分享 AI 进展发生在哪里,以及各国领先模型如何比较的观点,并深入分析美国和中国这两个主要的 AI 发展中心。
各国前沿语言模型的智能变化
Artificial Analysis Intelligence Index v4.1 incorporates 9 evaluations: GDPval-AA v2, 𝜏³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience, AA-LCR
Reasoning models are indicated by a lightbulb icon
开放权重:各国前沿语言模型的智能变化
Artificial Analysis Intelligence Index v4.1 incorporates 9 evaluations: GDPval-AA v2, 𝜏³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience, AA-LCR
Reasoning models are indicated by a lightbulb icon
Leading Models by Country
Artificial Analysis Intelligence Index · Leading models
Reasoning models are indicated by a lightbulb icon
开放权重模型
开放权重模型具备灵活部署的优势,并可针对特定使用场景进行微调。我们分析领先的开放权重模型,以及它们的智能与专有模型相比如何。
Progress in Open Weights vs. Proprietary Intelligence
Artificial Analysis Intelligence Index v4.1 incorporates 9 evaluations: GDPval-AA v2, 𝜏³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience, AA-LCR
Reasoning models are indicated by a lightbulb icon
Artificial Analysis Intelligence Index by Open Weights / Proprietary
Artificial Analysis Intelligence Index v4.1 incorporates 9 evaluations: GDPval-AA v2, 𝜏³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience, AA-LCR
Reasoning models are indicated by a lightbulb icon
模型架构
AI 模型的架构会影响其性能和效率。本部分研究模型架构的趋势,例如混合专家(MoE)架构日益普及,以及这些趋势与模型能力之间的关系。
按模型架构划分的 Intelligence Index 与发布日期
Artificial Analysis Intelligence Index,仅限开放权重模型
Most attractive region
Model Size: Total and Active Parameters
Comparison between total model parameters and parameters active during inference
Reasoning models are indicated by a lightbulb icon
Intelligence Index vs. Active Parameters
Artificial Analysis Intelligence Index · Active parameters at inference time
Most attractive quadrant
Pareto line
Reasoning models are indicated by a lightbulb icon
Intelligence Index 与总参数量
Artificial Analysis Intelligence Index · Size in parameters (billions)
Most attractive quadrant
Pareto line
Reasoning models are indicated by a lightbulb icon
上下文长度(Token):各季度中位数
上下文长度中位数(千 token)
训练分析
我们对 AI 模型训练趋势的分析,既考察训练运行规模的变化,也考察训练运行规模与模型智能之间的关系。
各模型的训练 Token 数
训练 token 数(万亿)
No data available
Reasoning models are indicated by a lightbulb icon
Intelligence Index 与训练 Token 数
Artificial Analysis Intelligence Index v4.1 incorporates 9 evaluations: GDPval-AA v2, 𝜏³-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience, AA-LCR · 训练 token 数(万亿)
Most attractive quadrant
No data available
Reasoning models are indicated by a lightbulb icon