Institute of Foundation Models 模型:智能、性能与价格
Artificial Analysis Intelligence Index
* 估计值
每项 Intelligence Index 任务
Artificial Analysis 已对 Institute of Foundation Models 的 9 个模型进行基准测试。下方对这些模型的关键指标进行了比较。
- 智能方面,Institute of Foundation Models 得分最高的模型是 K2 Horizon 375B A23B(31)。
智能
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
成本
Cost per Intelligence Index Task
速度与延迟
Output Speed
能力得分
能力指数
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Institute of Foundation Models 的所有发布
更多详情
权重 | 服务商基准测试 | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| K2 Horizon 375B A23B | 31 | 375B 推理时启用 23B 个参数 | 524k | - | - | - | |||
| K2 Horizon MoVA 36B A4B | 25 | 36B 推理时启用 4B 个参数 | 524k | - | - | - | |||
| K2 Horizon 7B | 21 | 7B | 524k | - | - | - | |||
| K2 Horizon 3.7B | 16 | 3.7B | 524k | - | - | - | |||
| K2 Think V2 | 11 | 70B | 262k | - | - | - | |||
| K2-V2 (high) | 10 | 70B | 512k | - | - | - | |||
| K2-V2 (medium) | 9 | 70B | 512k | - | - | - | |||
| K2-V2 (low) | 7 | 70B | 512k | - | - | - | |||
| K2 Horizon 0.9B | 3 | 0.9B | 131k | - | - | - |