Nous Research 模型:智能、性能与价格
Artificial Analysis 已对 Nous Research 的 7 个模型进行基准测试。下方对这些模型的关键指标进行了比较。
- 智能方面,Nous Research 得分最高的模型是 Hermes 4 - Llama-3.1 70B (Reasoning)(8,估算值)。
- 输出速度方面,最快的模型是 Hermes 4 - Llama-3.1 405B (Reasoning)(43 token/秒)。
- 延迟方面,Hermes 4 - Llama-3.1 405B (Non-reasoning)(2.31 秒) 的首个答案 token 等待时间最短。
智能
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
成本
Cost per Intelligence Index Task
速度与延迟
Output Speed
能力得分
能力指数
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Nous Research 的所有发布
更多详情
权重 | 服务商基准测试 | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| Hermes 4 - Llama-3.1 70B (Reasoning) | 8 | 70.6B | 128k | - | - | - | |||
| Hermes 4 - Llama-3.1 405B (Reasoning) | 7 | 406B | 128k | US$1.2 | 43 | ||||
| Hermes 4 - Llama-3.1 405B (Non-reasoning) | 7 | 406B | 128k | US$1.2 | 43 | ||||
| Hermes 4 - Llama-3.1 70B (Non-reasoning) | 7 | 70.6B | 128k | - | - | - | |||
| DeepHermes 3 - Mistral 24B Preview (Non-reasoning) | 6 | 24B | 32k | - | - | - | |||
| Hermes 3 - Llama-3.1 70B | 6 | 70.6B | 128k | US$0.7 | 30 | ||||
| DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning) | 5 | 8B | 128k | - | - | - |
