GPT-6 Astra vs. DeepSeek V4 Pro 0424:发布比较
GPT-6 Astra 与 DeepSeek V4 Pro 0424 发布比较:分别包含 6 个和 3 个模型,各自具有不同的智能、性能与价格特征。下方对全部 9 个模型的关键指标进行了比较。
- 智能方面,GPT-6 Astra 得分最高:GPT-6 Astra (max)(53),DeepSeek V4 Pro 0424 为 DeepSeek V4 Pro (Reasoning, Max Effort)(31)。
- 输出速度方面,DeepSeek V4 Pro 0424 最快:DeepSeek V4 Pro (Reasoning, Max Effort)(72 token/秒),GPT-6 Astra 为 GPT-6 Astra (max)(54 token/秒)。
- 单任务成本方面,DeepSeek V4 Pro 0424 最低:DeepSeek V4 Pro (Reasoning, Max Effort)($0.12),GPT-6 Astra 为 GPT-6 Astra (low)($0.82)。
智能
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
成本
Cost per Intelligence Index Task
速度与延迟
Output Speed
能力得分
能力指数
Incorporates 5 evaluations: AA-Omniscience, GDPval-AA v2, Humanity's Last Exam, 𝜏³-Banking, AA-LCR v1.1 · Higher is better
Incorporates 4 evaluations: AA-Omniscience, GDPval-AA v2, 𝜏³-Banking, AA-LCR v1.1 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, GDPval-AA v2, AA-LCR v1.1, 𝜏³-Banking, Humanity's Last Exam · Higher is better
Incorporates 5 evaluations: AA-Omniscience, GDPval-AA v2, MLCR-AA, Humanity's Last Exam, 𝜏³-Banking · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, GPQA Diamond, CritPt, GDPval-AA v2, Terminal-Bench v2.1 · Higher is better
Incorporates 4 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2, AA-LCR v1.1 · Higher is better
更多详情
权重 | 服务商基准测试 | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| GPT-6 Astra (max) | 53 | - | 1M | US$7.7 | 54 | 不可用 | |||
| GPT-6 Astra (xhigh) | 53 | - | 1M | US$7.7 | 51 | 不可用 | |||
| GPT-6 Astra (high) | 51 | - | 1M | US$7.7 | 49 | 不可用 | |||
| GPT-6 Astra (medium) | 50 | - | 1M | US$7.7 | 44 | 不可用 | |||
| GPT-6 Astra (low) | 46 | - | 1M | US$7.7 | 47 | 不可用 | |||
| GPT-6 Astra (Non-reasoning) | 45 | - | 1M | US$7.7 | - | 不可用 | |||
| DeepSeek V4 Pro (Reasoning, Max Effort) | 31 | 1.6T 推理时启用 49B 个参数 | 1M | US$0.2 | 72 | +6 | |||
| DeepSeek V4 Pro (Reasoning, High Effort) | 30 | 1.6T 推理时启用 49B 个参数 | 1M | US$0.2 | 66 | +5 | |||
| DeepSeek V4 Pro (Non-reasoning) | 21 | 1.6T 推理时启用 49B 个参数 | 1M | US$0.2 | 70 | +2 |