DeepSeek V4.1 Flash vs. Mistral Small 4: Vergleich der Veröffentlichungen
Vergleich der Veröffentlichungen DeepSeek V4.1 Flash und Mistral Small 4: 2 bzw. 2 Modelle mit unterschiedlichen Eigenschaften bei Intelligenz, Leistung und Preis. Unten werden die wichtigsten Kennzahlen aller 4 Modelle verglichen.
- Bei der Intelligenz liegt DeepSeek V4.1 Flash vorn: DeepSeek V4.1 Flash (Reasoning, Max Effort) mit 39, gegenüber Mistral Small 4 (Reasoning) mit 11 bei Mistral Small 4.
- Bei der Ausgabegeschwindigkeit ist DeepSeek V4.1 Flash am schnellsten: DeepSeek V4.1 Flash (Non-Reasoning) mit 269 Tokens/s, gegenüber Mistral Small 4 (Reasoning) mit 170 Tokens/s bei Mistral Small 4.
- Bei den Kosten pro Aufgabe ist Mistral Small 4 am günstigsten: Mistral Small 4 (Reasoning) mit $0.02, gegenüber DeepSeek V4.1 Flash (Non-Reasoning) mit $0.15 bei DeepSeek V4.1 Flash.
Intelligenz
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
Cost per Task (USD, Log Scale)
Kosten
Cost per Intelligence Index Task
Geschwindigkeit und Latenz
Output Speed
Fähigkeitswerte
Fähigkeitsindizes
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Weitere Details
Eingabemodalität | Ausgabemodalität | Gewichte | Anbieter-Benchmarks | ||||||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash (Reasoning, Max Effort) | 39 | 45 | 52 | 41 | 41 | 39 | 44 | $0.27 | 0,2 $ | $0.30 | $1.20 | $0.006 | 477 $ | 89k | 63k | 253M | 232 | 0.92 s | 9.55 s | 11.70 s | 282.36 s | 552B 16B während der Inferenz aktiv | 1M | Sept. 2026 | - | Ja | Unterstützt: Text und Bilder | Unterstützt: Text | +15 | ||||
| DeepSeek V4.1 Flash (Non-Reasoning) | 25 | 30 | 36 | 30 | - | 25 | 32 | $0.15 | 0,2 $ | $0.30 | $1.20 | $0.006 | 156 $ | 34k | 0 | 45M | 269 | 1.26 s | 1.26 s | 3.12 s | 125.69 s | 552B 16B während der Inferenz aktiv | 1M | Sept. 2026 | - | Nein | Unterstützt: Text und Bilder | Unterstützt: Text | |||||
| Mistral Small 4 (Reasoning) | 11 | 10 | 7 | 13 | - | 16 | 18 | $0.02 | 0,1 $ | $0.15 | $0.60 | $0.015 | 42 $ | 14k | 9k | 54M | 170 | 0.75 s | 12.54 s | 15.49 s | 96.29 s | 119B 6,5B während der Inferenz aktiv | 256k | März 2026 | - | Ja | Unterstützt: Text und Bilder | Unterstützt: Text | |||||
| Mistral Small 4 (Non-reasoning) | 9 | - | - | - | - | - | - | - | 0,1 $ | $0.15 | $0.60 | $0.015 | - | - | - | - | 150 | 0.76 s | 0.76 s | 4.09 s | - | 119B 6,5B während der Inferenz aktiv | 256k | März 2026 | - | Nein | Unterstützt: Text und Bilder | Unterstützt: Text | |||||