Claude Haiku 5.5 vs. gpt-oss-120b:リリース比較
Claude Haiku 5.5とgpt-oss-120bのリリース比較:それぞれ5個と2個のモデルがあり、知能・性能・料金の特性が異なります。以下では、全7個のモデルの主要指標を比較します。
- 知能が最も高いのはClaude Haiku 5.5です。Claude Haiku 5.5 (Max, Default Fallback)(43)に対し、gpt-oss-120bはgpt-oss-120b (High)(12)です。
- 出力速度が最も速いのはClaude Haiku 5.5です。Claude Haiku 5.5 (Max, Default Fallback)(243トークン/秒)に対し、gpt-oss-120bはgpt-oss-120b (Low)(210トークン/秒)です。
- タスクあたりの費用が最も低いのはClaude Haiku 5.5です。Claude Haiku 5.5 (Low, Default Fallback)($0.02)に対し、gpt-oss-120bはgpt-oss-120b (High)($0.11)です。
| Claude Haiku 5.5 (max with fallback) | Claude Haiku 5.5 (xhigh with fallback) | Claude Haiku 5.5 (high with fallback) | Claude Haiku 5.5 (medium with fallback) | Claude Haiku 5.5 (low with fallback) | gpt-oss-120b (high) | gpt-oss-120b (low) | |
|---|---|---|---|---|---|---|---|
| Intelligence Index | 43 | 41 | 38 | 34 | 29 | 12 | 10* |
| 財務・会計 | 44 | 41 | 38 | 35 | 29 | 12 | -- |
| 戦略・オペレーション | 40 | 39 | 37 | 34 | 28 | 8 | -- |
| 法務 | 42 | 40 | 38 | 36 | 31 | 11 | -- |
| 医療・ヘルスケア | -- | -- | -- | -- | -- | 11 | -- |
| タスクあたりの費用USD | $0.21 | $0.12 | $0.08 | $0.05 | $0.02 | $0.11 | -- |
| 出力速度トークン/秒 | 243 | 188 | 137 | 137 | 181 | 185 | 210 |
| 最初のトークンまでの時間秒 | 415.30 | 87.15 | 26.15 | 12.63 | 6.28 | 0.87 | 0.83 |
| コンテキストウィンドウ | 1M | 1M | 1M | 1M | 1M | 131k | 131k |
| 開発元 | |||||||
| ライセンス | 独自 | 独自 | 独自 | 独自 | 独自 | オープン | オープン |
| 入力モダリティ | 対応:テキスト、画像 | 対応:テキスト、画像 | 対応:テキスト、画像 | 対応:テキスト、画像 | 対応:テキスト、画像 | 対応:テキスト | 対応:テキスト |
| 出力モダリティ | 対応:テキスト | 対応:テキスト | 対応:テキスト | 対応:テキスト | 対応:テキスト | 対応:テキスト | 対応:テキスト |
| プロバイダー | |||||||
* 推定値
知能
Artificial Analysis Intelligence Index
Intelligence Index とタスクあたりのコスト
タスク当たりのコスト(USD、対数スケール)
費用
Intelligence Index タスクあたりのコスト
速度と遅延
出力速度
能力スコア
能力指数
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better