Grok 4.3: Intelligenz, Leistung und Preis der Veröffentlichung
Verfügbare Anbieter
Modellübersicht
Ausführlichkeit
Die Veröffentlichung Grok 4.3 umfasst 4 Modelle mit unterschiedlichen Eigenschaften bei Intelligenz, Leistung und Preis. Unten werden die wichtigsten Kennzahlen der 4 Modelle verglichen.
- Bei der Intelligenz ist Grok 4.3 (High) mit 25 das führende Modell von Grok 4.3.
- Bei der Ausgabegeschwindigkeit ist Grok 4.3 (High) mit 146 Tokens/s das schnellste Modell.
- Bei der Latenz bietet Grok 4.3 (Non-reasoning) mit 0,79 s die kürzeste Zeit bis zum ersten Antwort-Token.
- Beim Preis bietet Grok 4.3 (Non-reasoning) mit $0.17 die niedrigsten Kosten pro Aufgabe. Die Preise unterscheiden sich zwischen den Modellen um einen Faktor von bis zu 1,2.
| Eingabemodalität | Unterstützt: Text und Bilder |
|---|---|
| Ausgabemodalität | Unterstützt: Text |
| Kontextfenster | 1M ~1500 A4-Seiten in Arial mit Schriftgröße 12 |
Metriken werden mit Modellen derselben Klasse verglichen:
- Modelle ohne Reasoning → Vergleich nur mit anderen Modellen ohne Reasoning
- Reasoning-Modelle → Vergleich mit Reasoning-Modellen und Modellen ohne Reasoning
- Modelle mit offenen Gewichten → Vergleich nur mit anderen Modellen mit offenen Gewichten derselben Größenklasse:
- Sehr klein: ≤4B Parameter
- Klein: 4B–40B Parameter
- Mittel: 40B–150B Parameter
- Groß: >150B Parameter
- Proprietäre Modelle → Vergleich mit proprietären Modellen und Modellen mit offenen Gewichten derselben Preisklasse anhand eines Mischpreisverhältnisses von 3:1 für Eingabe/Ausgabe:
- <$0.15 pro 1 Mio. Tokens
- $0.15–$1 pro 1 Mio. Tokens
- >$1 pro 1 Mio. Tokens
Intelligenz
Artificial Analysis Intelligence Index
Intelligence Index vs. Kosten pro Intelligence-Index-Aufgabe
Kosten
Kosten pro Intelligence-Index-Aufgabe
Geschwindigkeit und Latenz
Ausgabegeschwindigkeit
Fähigkeitswerte
Fähigkeitsindizes
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Weitere Veröffentlichungen von SpaceXAI
Weitere Details
Gewichte | Anbieter-Benchmarks | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| Grok 4.3 (High) | 25 | - | 1M | 0,6 $ | 146 | Nicht verfügbar | |||
| Grok 4.3 (Medium) | 25 | - | 1M | 0,6 $ | 115 | Nicht verfügbar | |||
| Grok 4.3 (Low) | 24 | - | 1M | 0,6 $ | 120 | Nicht verfügbar | |||
| Grok 4.3 (Non-reasoning) | 14 | - | 1M | 0,6 $ | 111 | Nicht verfügbar |