Meta 模型:智能、性能与价格
Artificial Analysis 已对 Meta 的 22 个模型进行基准测试。下方对这些模型的关键指标进行了比较。
- 智能方面,Meta 得分最高的模型是 Muse Spark 1.3 (max)(48)。
- 输出速度方面,最快的模型是 Muse Spark 1.3 (xhigh)(221 token/秒)。
- 延迟方面,Llama 4 Scout(0.84 秒) 的首个答案 token 等待时间最短。
- 价格方面,Muse Glimmer (high)($0.06) 的单任务成本最低。不同模型的价格差异最高可达 28 倍。
智能
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
成本
Cost per Intelligence Index Task
速度与延迟
Output Speed
能力得分
能力指数
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Meta 的所有发布
Muse Spark 1.3
2 个模型
48
最高智能得分
Muse Glimmer
1 个模型
17
最高智能得分
Muse Spark 1.2
1 个模型
40
最高智能得分
Muse Spark 1.1
1 个模型
34
最高智能得分
Muse Spark
1 个模型
31
最高智能得分
Llama 4 Maverick
1 个模型
10
最高智能得分
Llama 4 Scout
1 个模型
8
最高智能得分
Llama 3.3 Instruct 70B
1 个模型
8
最高智能得分
Llama 3.2 Instruct 11B (Vision)
1 个模型
5
最高智能得分
Llama 3.2 Instruct 1B
1 个模型
5
最高智能得分
Llama 3.2 Instruct 3B
1 个模型
6
最高智能得分
Llama 3.2 Instruct 90B (Vision)
1 个模型
6
最高智能得分
Llama 3.1 Instruct 405B
1 个模型
7
最高智能得分
Llama 3.1 Instruct 70B
1 个模型
7
最高智能得分
Llama 3.1 Instruct 8B
1 个模型
7
最高智能得分
Llama 3 Instruct 70B
1 个模型
5
最高智能得分
Llama 3 Instruct 8B
1 个模型
5
最高智能得分
Llama 2 Chat 13B
1 个模型
5
最高智能得分
Llama 2 Chat 70B
1 个模型
5
最高智能得分
Llama 2 Chat 7B
1 个模型
6
最高智能得分
Llama 65B
1 个模型
5
最高智能得分
更多详情
权重 | 服务商基准测试 | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| Muse Spark 1.3 (max) | 48 | - | 1M | US$0.8 | 203 | 不可用 | |||
| Muse Spark 1.3 (xhigh) | 45 | - | 1M | US$0.8 | 221 | 不可用 | |||
| Muse Spark 1.2 (xhigh) | 40 | - | 1M | US$0.8 | 234 | 不可用 | |||
| Muse Spark 1.1 (xhigh) | 34 | - | 1M | US$0.8 | - | 不可用 | |||
| Muse Spark | 31 | - | 262k | - | - | 不可用 | - | ||
| Muse Glimmer (high) | 17 | 30B | 131k | US$0.2 | 122 | ||||
| Llama 4 Maverick | 10 | 402B 推理时启用 17B 个参数 | 1M | US$0.3 | 110 | +3 | |||
| Llama 4 Scout | 8 | 109B 推理时启用 17B 个参数 | 10M | US$0.2 | 107 | +3 | |||
| Llama 3.3 Instruct 70B | 8 | 70B | 128k | US$0.7 | 90 | +10 | |||
| Llama 3.1 Instruct 405B | 7 | 405B | 128k | - | - | - | |||
| Llama 3.1 Instruct 8B | 7 | 8B | 128k | US$0.0 | 136 | +3 | |||
| Llama 3.1 Instruct 70B | 7 | 70B | 128k | US$0.6 | 52 | ||||
| Llama 3.2 Instruct 90B (Vision) | 6 | 90B | 128k | - | - | - | |||
| Llama 2 Chat 7B | 6 | 7B | 4k | US$0.1 | - | ||||
| Llama 3.2 Instruct 3B | 6 | 3B | 128k | - | - | - | |||
| Llama 3 Instruct 70B | 5 | 70B | 8k | US$0.9 | - | ||||
| Llama 3.2 Instruct 11B (Vision) | 5 | 11B | 128k | US$0.3 | 17 | ||||
| Llama 2 Chat 70B | 5 | 70B | 4k | - | - | - | |||
| Llama 2 Chat 13B | 5 | 13B | 4k | - | - | - | |||
| Llama 65B | 5 | 65B | 2k | - | - | - | |||
| Llama 3.2 Instruct 1B | 5 | 1B | 128k | - | - | - | |||
| Llama 3 Instruct 8B | 5 | 8B | 8k | US$0.1 | - |