Qwen3 8B: Intelligenz, Leistung und Preis der Veröffentlichung
Verfügbare Anbieter
Modellübersicht
Ausführlichkeit
Die Veröffentlichung Qwen3 8B umfasst 2 Modelle mit unterschiedlichen Eigenschaften bei Intelligenz, Leistung und Preis. Unten werden die wichtigsten Kennzahlen der 2 Modelle verglichen.
- Bei der Intelligenz ist Qwen3 8B (Reasoning) mit 7 (geschätzt) das führende Modell von Qwen3 8B.
- Bei der Ausgabegeschwindigkeit ist Qwen3 8B (Non-reasoning) mit 42 Tokens/s das schnellste Modell.
- Bei der Latenz bietet Qwen3 8B (Non-reasoning) mit 3,71 s die kürzeste Zeit bis zum ersten Antwort-Token.
| Eingabemodalität | Unterstützt: Text |
|---|---|
| Ausgabemodalität | Unterstützt: Text |
| Kontextfenster | 131k ~197 A4-Seiten in Arial mit Schriftgröße 12 |
| Gesamtparameter | 8.2B |
| Lizenz | Apache 2.0 |
| Modellgewichte | Hugging Face |
Metriken werden mit Modellen derselben Klasse verglichen:
- Modelle ohne Reasoning → Vergleich nur mit anderen Modellen ohne Reasoning
- Reasoning-Modelle → Vergleich mit Reasoning-Modellen und Modellen ohne Reasoning
- Modelle mit offenen Gewichten → Vergleich nur mit anderen Modellen mit offenen Gewichten derselben Größenklasse:
- Sehr klein: ≤4B Parameter
- Klein: 4B–40B Parameter
- Mittel: 40B–150B Parameter
- Groß: >150B Parameter
- Proprietäre Modelle → Vergleich mit proprietären Modellen und Modellen mit offenen Gewichten derselben Preisklasse anhand eines Mischpreisverhältnisses von 3:1 für Eingabe/Ausgabe:
- <$0.15 pro 1 Mio. Tokens
- $0.15–$1 pro 1 Mio. Tokens
- >$1 pro 1 Mio. Tokens
Intelligenz
Artificial Analysis Intelligence Index
Intelligence Index vs. Kosten pro Intelligence-Index-Aufgabe
Kosten
Kosten pro Intelligence-Index-Aufgabe
Geschwindigkeit und Latenz
Ausgabegeschwindigkeit
Fähigkeitswerte
Fähigkeitsindizes
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Intelligence Evaluations
Agentic knowledge work, (Elo-500)/2000
Agentic real-world work tasks, (Elo-500)/2000
Agentic SaaS workflows
Agentic coding & terminal use
Coding
Reasoning & knowledge
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Weitere Veröffentlichungen von Alibaba
Weitere Details
Gewichte | Anbieter-Benchmarks | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| Qwen3 8B (Reasoning) | 7 | 8.2B | 131k | 0,4 $ | 41 | ||||
| Qwen3 8B (Non-reasoning) | 6 | 8.2B | 131k | 0,2 $ | 42 |