Kimi K3: Intelligenz, Leistung und Preis der Veröffentlichung
Modellübersicht
Ausführlichkeit
Die Veröffentlichung Kimi K3 umfasst 2 Modelle mit unterschiedlichen Eigenschaften bei Intelligenz, Leistung und Preis. Unten werden die wichtigsten Kennzahlen der 2 Modelle verglichen.
- Bei der Intelligenz ist Kimi K3 (Max) mit 44 das führende Modell von Kimi K3.
- Bei der Ausgabegeschwindigkeit ist Kimi K3 (Max) mit 46 Tokens/s das schnellste Modell.
- Bei der Latenz bietet Kimi K3 (Max) mit 46,94 s die kürzeste Zeit bis zum ersten Antwort-Token.
- Beim Preis bietet Kimi K3 (Low) mit $1.15 die niedrigsten Kosten pro Aufgabe. Die Preise unterscheiden sich zwischen den Modellen um einen Faktor von bis zu 1,7.
| Reasoning | Ja Diese Seite zeigt die Reasoning-Version dieses Modells. Möglicherweise gibt es auch eine Variante ohne Reasoning. |
|---|---|
| Eingabemodalität | Unterstützt: Text und Bilder |
| Ausgabemodalität | Unterstützt: Text |
| Kontextfenster | 1M ~1573 A4-Seiten in Arial mit Schriftgröße 12 |
| Gesamtparameter | 2.8T |
| Aktive Parameter | 104B Anzahl der pro Token während der Inferenz aktiven Parameter |
| Lizenz | Kimi K3 License |
| Modellgewichte | Hugging Face |
Metriken werden mit Modellen derselben Klasse verglichen:
- Modelle ohne Reasoning → Vergleich nur mit anderen Modellen ohne Reasoning
- Reasoning-Modelle → Vergleich mit Reasoning-Modellen und Modellen ohne Reasoning
- Modelle mit offenen Gewichten → Vergleich nur mit anderen Modellen mit offenen Gewichten derselben Größenklasse:
- Sehr klein: ≤4B Parameter
- Klein: 4B–40B Parameter
- Mittel: 40B–150B Parameter
- Groß: >150B Parameter
- Proprietäre Modelle → Vergleich mit proprietären Modellen und Modellen mit offenen Gewichten derselben Preisklasse anhand eines Mischpreisverhältnisses von 3:1 für Eingabe/Ausgabe:
- <$0.15 pro 1 Mio. Tokens
- $0.15–$1 pro 1 Mio. Tokens
- >$1 pro 1 Mio. Tokens
Intelligenz
Artificial Analysis Intelligence Index
Intelligence Index vs. Kosten pro Intelligence-Index-Aufgabe
Kosten
Kosten pro Intelligence-Index-Aufgabe
Geschwindigkeit und Latenz
Ausgabegeschwindigkeit
Fähigkeitswerte
Fähigkeitsindizes
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Weitere Veröffentlichungen von Kimi
Weitere Details
Gewichte | Anbieter-Benchmarks | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| Kimi K3 (Max) | 44 | 2.8T 104B während der Inferenz aktiv | 1M | 2,3 $ | 46 | +9 | |||
| Kimi K3 (Low) | 30 | 2.8T 104B während der Inferenz aktiv | 1M | 2,3 $ | 46 |
