Claude 3.7 Sonnet: Intelligenz, Leistung und Preis der Veröffentlichung
Verfügbare Anbieter
Modellübersicht
IntelligenzUpdated
* Geschätzt
Ausführlichkeit
Die Veröffentlichung Claude 3.7 Sonnet umfasst 2 Modelle mit unterschiedlichen Eigenschaften bei Intelligenz, Leistung und Preis. Unten werden die wichtigsten Kennzahlen der 2 Modelle verglichen.
- Bei der Intelligenz ist Claude 3.7 Sonnet (Reasoning) mit 18 (geschätzt) das führende Modell von Claude 3.7 Sonnet.
| Eingabemodalität | Unterstützt: Text und Bilder |
|---|---|
| Ausgabemodalität | Unterstützt: Text |
| Wissensstichtag | 01.10.2024 |
| Kontextfenster | 200k ~300 A4-Seiten in Arial mit Schriftgröße 12 |
Metriken werden mit Modellen derselben Klasse verglichen:
- Modelle ohne Reasoning → Vergleich nur mit anderen Modellen ohne Reasoning
- Reasoning-Modelle → Vergleich mit Reasoning-Modellen und Modellen ohne Reasoning
- Modelle mit offenen Gewichten → Vergleich nur mit anderen Modellen mit offenen Gewichten derselben Größenklasse:
- Sehr klein: ≤4B Parameter
- Klein: 4B–40B Parameter
- Mittel: 40B–150B Parameter
- Groß: >150B Parameter
- Proprietäre Modelle → Vergleich mit proprietären Modellen und Modellen mit offenen Gewichten derselben Preisklasse anhand eines Mischpreisverhältnisses von 3:1 für Eingabe/Ausgabe:
- <$0.15 pro 1 Mio. Tokens
- $0.15–$1 pro 1 Mio. Tokens
- >$1 pro 1 Mio. Tokens
Intelligenz
Artificial Analysis Intelligence Index
Intelligence Index vs. Kosten pro Intelligence-Index-Aufgabe
Kosten
Kosten pro Intelligence-Index-Aufgabe
Geschwindigkeit und Latenz
Ausgabegeschwindigkeit
Fähigkeitswerte
Fähigkeitsindizes
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Weitere Veröffentlichungen von Anthropic
Weitere Details
Gewichte | Anbieter-Benchmarks | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| Claude 3.7 Sonnet (Reasoning) | 18 | - | 200k | - | - | Nicht verfügbar | - | ||
| Claude 3.7 Sonnet (Non-reasoning) | 15 | - | 200k | 2,3 $ | - | Nicht verfügbar |