Claude Haiku 5.5 vs. Grok 4.7:发布比较
Claude Haiku 5.5 与 Grok 4.7 发布比较:分别包含 5 个和 3 个模型,各自具有不同的智能、性能与价格特征。下方对全部 8 个模型的关键指标进行了比较。
- 智能方面,Grok 4.7 得分最高:Grok 4.7 (Xhigh)(46),Claude Haiku 5.5 为 Claude Haiku 5.5 (Max, Default Fallback)(43)。
- 输出速度方面,Claude Haiku 5.5 最快:Claude Haiku 5.5 (Max, Default Fallback)(243 token/秒),Grok 4.7 为 Grok 4.7 (High)(78 token/秒)。
- 单任务成本方面,Claude Haiku 5.5 最低:Claude Haiku 5.5 (Low, Default Fallback)($0.02),Grok 4.7 为 Grok 4.7 (Low)($1.25)。
| Grok 4.7 (xhigh) | Grok 4.7 (high) | Claude Haiku 5.5 (max with fallback) | Grok 4.7 (low) | Claude Haiku 5.5 (xhigh with fallback) | Claude Haiku 5.5 (high with fallback) | Claude Haiku 5.5 (medium with fallback) | Claude Haiku 5.5 (low with fallback) | |
|---|---|---|---|---|---|---|---|---|
| Intelligence Index | 46 | 46 | 43 | 42 | 41 | 38 | 34 | 29 |
| 财务与会计 | 52 | 52 | 44 | 48 | 41 | 38 | 35 | 29 |
| 战略与运营 | 54 | 54 | 40 | 51 | 39 | 37 | 34 | 28 |
| 法律 | 54 | 54 | 42 | 51 | 40 | 38 | 36 | 31 |
| 医疗与健康 | 47 | -- | -- | -- | -- | -- | -- | -- |
| 每任务成本美元 | $3.74 | $2.73 | $0.21 | $1.25 | $0.12 | $0.08 | $0.05 | $0.02 |
| 输出速度Token/秒 | 73 | 78 | 243 | 69 | 188 | 137 | 137 | 181 |
| 首 Token 延迟秒 | 67.02 | 87.05 | 415.30 | 5.57 | 87.15 | 26.15 | 12.63 | 6.28 |
| 上下文窗口 | 500k | 500k | 1M | 500k | 1M | 1M | 1M | 1M |
| 开发商 | ||||||||
| 许可证 | 专有 | 专有 | 专有 | 专有 | 专有 | 专有 | 专有 | 专有 |
| 输入模态 | 支持:文本和图像 | 支持:文本和图像 | 支持:文本和图像 | 支持:文本和图像 | 支持:文本和图像 | 支持:文本和图像 | 支持:文本和图像 | 支持:文本和图像 |
| 输出模态 | 支持:文本 | 支持:文本 | 支持:文本 | 支持:文本 | 支持:文本 | 支持:文本 | 支持:文本 | 支持:文本 |
| 服务商 | ||||||||
智能
Artificial Analysis Intelligence Index
Intelligence Index 与每项任务的成本
单任务成本(美元,对数刻度)
成本
每项 Intelligence Index 任务的成本
速度与延迟
输出速度
能力得分
能力指数
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better