Grok 4.6: Intelligenz, Leistung und Preis der Veröffentlichung
Verfügbare Anbieter
Modellübersicht
Ausführlichkeit
Die Veröffentlichung Grok 4.6 umfasst 4 Modelle mit unterschiedlichen Eigenschaften bei Intelligenz, Leistung und Preis. Unten werden die wichtigsten Kennzahlen der 4 Modelle verglichen.
- Bei der Intelligenz ist Grok 4.6 (High) mit 44 das führende Modell von Grok 4.6.
- Bei der Ausgabegeschwindigkeit ist Grok 4.6 (Medium) mit 70 Tokens/s das schnellste Modell.
- Bei der Latenz bietet Grok 4.6 (Low) mit 7,78 s die kürzeste Zeit bis zum ersten Antwort-Token.
- Beim Preis bietet Grok 4.6 (Low) mit $0.38 die niedrigsten Kosten pro Aufgabe. Die Preise unterscheiden sich zwischen den Modellen um einen Faktor von bis zu 4,7.
| Reasoning | Ja Diese Seite zeigt die Reasoning-Version dieses Modells. Möglicherweise gibt es auch eine Variante ohne Reasoning. |
|---|---|
| Eingabemodalität | Unterstützt: Text und Bilder |
| Ausgabemodalität | Unterstützt: Text |
| Kontextfenster | 500k ~750 A4-Seiten in Arial mit Schriftgröße 12 |
Metriken werden mit Modellen derselben Klasse verglichen:
- Modelle ohne Reasoning → Vergleich nur mit anderen Modellen ohne Reasoning
- Reasoning-Modelle → Vergleich mit Reasoning-Modellen und Modellen ohne Reasoning
- Modelle mit offenen Gewichten → Vergleich nur mit anderen Modellen mit offenen Gewichten derselben Größenklasse:
- Sehr klein: ≤4B Parameter
- Klein: 4B–40B Parameter
- Mittel: 40B–150B Parameter
- Groß: >150B Parameter
- Proprietäre Modelle → Vergleich mit proprietären Modellen und Modellen mit offenen Gewichten derselben Preisklasse anhand eines Mischpreisverhältnisses von 3:1 für Eingabe/Ausgabe:
- <$0.15 pro 1 Mio. Tokens
- $0.15–$1 pro 1 Mio. Tokens
- >$1 pro 1 Mio. Tokens
Intelligenz
Artificial Analysis Intelligence Index
Intelligence Index vs. Kosten pro Intelligence-Index-Aufgabe
Kosten
Kosten pro Intelligence-Index-Aufgabe
Geschwindigkeit und Latenz
Ausgabegeschwindigkeit
Fähigkeitswerte
Fähigkeitsindizes
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Intelligence Evaluations
Agentic knowledge work, (Elo-500)/2000
Agentic real-world work tasks, (Elo-500)/2000
Agentic SaaS workflows
Agentic coding & terminal use
Coding
Reasoning & knowledge
Professional document reasoning, All-pass
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Agentic business operations
Agentic scientific research workflows in a terminal
Quantitative analysis on spreadsheets & documents
Medical long context reasoning
Weitere Veröffentlichungen von SpaceXAI
Weitere Details
Gewichte | Anbieter-Benchmarks | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| Grok 4.6 (High) | 44 | - | 500k | 1,4 $ | 68 | Nicht verfügbar | |||
| Grok 4.6 (Xhigh) | 44 | - | 500k | 1,4 $ | 66 | Nicht verfügbar | |||
| Grok 4.6 (Medium) | 43 | - | 500k | 1,4 $ | 70 | Nicht verfügbar | |||
| Grok 4.6 (Low) | 35 | - | 500k | 1,4 $ | 61 | Nicht verfügbar |