GPT-6 Astra vs. Gemma 4 E2B:发布比较
GPT-6 Astra 与 Gemma 4 E2B 发布比较:分别包含 5 个和 2 个模型,各自具有不同的智能、性能与价格特征。下方对全部 7 个模型的关键指标进行了比较。
- 智能方面,GPT-6 Astra 得分最高:GPT-6 Astra (Max)(53),Gemma 4 E2B 为 Gemma 4 E2B (Reasoning)(8)。
| GPT-6 Astra (max) | GPT-6 Astra (xhigh) | GPT-6 Astra (high) | GPT-6 Astra (medium) | GPT-6 Astra (low) | Gemma 4 E2B | Gemma 4 E2B (non-reasoning) | |
|---|---|---|---|---|---|---|---|
| Intelligence Index | 53 | 52 | 51 | 50 | 46 | 8* | 6* |
| 财务与会计 | 55 | 54 | 53 | 52 | 49 | -- | -- |
| 战略与运营 | 57 | 57 | 55 | 54 | 50 | -- | -- |
| 法律 | 59 | 58 | 58 | 57 | 53 | -- | -- |
| 医疗与健康 | 52 | -- | -- | -- | -- | -- | -- |
| 工程 | 55 | 55 | 53 | 52 | 48 | -- | -- |
| 经济学 | 60 | 59 | 58 | 58 | 55 | -- | -- |
| 每任务成本美元 | $3.26 | $2.31 | $1.73 | $1.54 | $0.82 | -- | -- |
| 输出速度Token/秒 | 51 | 47 | 44 | 44 | 43 | -- | -- |
| 首 Token 延迟秒 | 326.68 | 205.74 | 65.56 | 6.21 | 2.86 | -- | -- |
| 上下文窗口 | 1M | 1M | 1M | 1M | 1M | 128k | 128k |
| 开发商 | |||||||
| 许可证 | 专有 | 专有 | 专有 | 专有 | 专有 | 开放 | 开放 |
| 输入模态 | 支持:文本和图像 | 支持:文本和图像 | 支持:文本和图像 | 支持:文本和图像 | 支持:文本和图像 | 支持:文本、图像、语音和视频 | 支持:文本、图像、语音和视频 |
| 输出模态 | 支持:文本 | 支持:文本 | 支持:文本 | 支持:文本 | 支持:文本 | 支持:文本和图像 | 支持:文本和图像 |
| 服务商 | -- | -- | |||||
* 估计值
智能
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
Cost per Task (USD, Log Scale)
成本
Cost per Intelligence Index Task
速度与延迟
Output Speed
能力得分
能力指数
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better