Alle Veröffentlichungen

Claude Haiku 5.5 vs. Hermes 4 - Llama-3.1 70B: Vergleich der Veröffentlichungen

Vergleich der Veröffentlichungen Claude Haiku 5.5 und Hermes 4 - Llama-3.1 70B: 5 bzw. 2 Modelle mit unterschiedlichen Eigenschaften bei Intelligenz, Leistung und Preis. Unten werden die wichtigsten Kennzahlen aller 7 Modelle verglichen.

  • Bei der Intelligenz liegt Claude Haiku 5.5 vorn: Claude Haiku 5.5 (Max, Default Fallback) mit 43, gegenüber Hermes 4 - Llama-3.1 70B (Reasoning) mit 8 bei Hermes 4 - Llama-3.1 70B.
Modell-Playground

Verglichene Veröffentlichungen

Claude Haiku 5.5 (max with fallback)Claude Haiku 5.5 (xhigh with fallback)Claude Haiku 5.5 (high with fallback)Claude Haiku 5.5 (medium with fallback)Claude Haiku 5.5 (low with fallback)Hermes 4 70BHermes 4 70B (non-reasoning)
Intelligence Index
43
41
38
34
29
8*
7*
Finanzen und Rechnungswesen
44
41
38
35
29
--
--
Strategie und Betrieb
40
39
37
34
28
--
--
Recht
42
40
38
36
31
--
--
Gesundheit und Medizin
--
--
--
--
--
--
--
Kosten pro AufgabeUSD
$0.21
$0.12
$0.08
$0.05
$0.02
--
--
AusgabegeschwindigkeitTokens/s
243
188
137
137
181
--
--
Zeit bis zum ersten Tokens
415,30
87,15
26,15
12,63
6,28
--
--
Kontextfenster
1M
1M
1M
1M
1M
128k
128k
Modellentwickler
Anthropic
Anthropic
Anthropic
Anthropic
Anthropic
Nous Research
Nous Research
Lizenz
Proprietär
Proprietär
Proprietär
Proprietär
Proprietär
Offen
Offen
Eingabemodalität

Unterstützt: Text und Bilder

Unterstützt: Text und Bilder

Unterstützt: Text und Bilder

Unterstützt: Text und Bilder

Unterstützt: Text und Bilder

Unterstützt: Text

Unterstützt: Text

Ausgabemodalität

Unterstützt: Text

Unterstützt: Text

Unterstützt: Text

Unterstützt: Text

Unterstützt: Text

Unterstützt: Text

Unterstützt: Text

Anbieter
Anthropic
Anthropic
Anthropic
Anthropic
Anthropic
--
--

* Geschätzt

Artificial Analysis Intelligence Index · Higher is better
Output tokens per second · Higher is better
Weighted average cost (USD) per Intelligence Index task · Lower is better

Intelligenz

Artificial Analysis Intelligence Index

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Estimate (independent evaluation forthcoming)

Intelligence Index vs. Kosten pro Intelligence-Index-Aufgabe

Artificial Analysis Intelligence Index · Weighted average cost (USD) per Artificial Analysis Intelligence Index task
Most attractive quadrant
Claude Haiku 5.5
Pareto line

Kosten pro Aufgabe (USD, logarithmische Skala)

Kosten

Kosten pro Intelligence-Index-Aufgabe

Weighted average cost (USD) per Artificial Analysis Intelligence Index task, segmented by token type. Lower is better

Geschwindigkeit und Latenz

Ausgabegeschwindigkeit

Output tokens per second · Higher is better

Fähigkeitswerte

Fähigkeitsindizes

Misst die Leistung von Modellen bei bestimmten Fähigkeiten und in bestimmten Branchen
Index für Finanzen und Rechnungswesen

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Index für Strategie und Betrieb

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Rechtsindex

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better

Index für Gesundheit und Medizin

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better

Ingenieurwesen-Index

Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better

Volkswirtschaftsindex

Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better