DeepSeek V4.1 Flash vs. gpt-oss-120b: Vergleich der Veröffentlichungen
Vergleich der Veröffentlichungen DeepSeek V4.1 Flash und gpt-oss-120b: 2 bzw. 2 Modelle mit unterschiedlichen Eigenschaften bei Intelligenz, Leistung und Preis. Unten werden die wichtigsten Kennzahlen aller 4 Modelle verglichen.
- Bei der Intelligenz liegt DeepSeek V4.1 Flash vorn: DeepSeek V4.1 Flash (Reasoning, Max Effort) mit 39, gegenüber gpt-oss-120b (high) mit 12 bei gpt-oss-120b.
- Bei der Ausgabegeschwindigkeit ist DeepSeek V4.1 Flash am schnellsten: DeepSeek V4.1 Flash (Non-Reasoning) mit 269 Tokens/s, gegenüber gpt-oss-120b (high) mit 186 Tokens/s bei gpt-oss-120b.
- Bei den Kosten pro Aufgabe ist gpt-oss-120b am günstigsten: gpt-oss-120b (high) mit $0.11, gegenüber DeepSeek V4.1 Flash (Non-Reasoning) mit $0.15 bei DeepSeek V4.1 Flash.
Intelligenz
Artificial Analysis Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
Cost per Task (USD, Log Scale)
Kosten
Cost per Intelligence Index Task
Geschwindigkeit und Latenz
Output Speed
Fähigkeitswerte
Fähigkeitsindizes
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Weitere Details
Eingabemodalität | Ausgabemodalität | Gewichte | Anbieter-Benchmarks | ||||||||||||||||||||||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| DeepSeek V4.1 Flash (Reasoning, Max Effort) | 39 | 45 | 52 | 41 | 41 | 39 | 44 | $0.27 | 0,2 $ | $0.30 | $1.20 | $0.006 | 477 $ | 89k | 63k | 253M | 232 | 0.92 s | 9.55 s | 11.70 s | 282.36 s | 552B 16B während der Inferenz aktiv | 1M | Sept. 2026 | - | Ja | Unterstützt: Text und Bilder | Unterstützt: Text | +15 | ||||
| DeepSeek V4.1 Flash (Non-Reasoning) | 25 | 30 | 36 | 30 | - | 25 | 32 | $0.15 | 0,2 $ | $0.30 | $1.20 | $0.006 | 156 $ | 34k | 0 | 45M | 269 | 1.26 s | 1.26 s | 3.12 s | 125.69 s | 552B 16B während der Inferenz aktiv | 1M | Sept. 2026 | - | Nein | Unterstützt: Text und Bilder | Unterstützt: Text | |||||
| gpt-oss-120b (high) | 12 | 12 | 8 | 11 | 11 | 15 | 18 | $0.11 | 0,2 $ | $0.15 | $0.595 | $0.125 | 122 $ | 27k | 15k | 84M | 186 | 0.87 s | 11.64 s | 14.33 s | 137.42 s | 117B 5,1B während der Inferenz aktiv | 131k | Aug. 2025 | Mai 2024 | Ja | Unterstützt: Text | Unterstützt: Text | +14 | ||||
| gpt-oss-120b (low) | 10 | - | - | - | - | - | - | - | 0,2 $ | $0.15 | $0.545 | $0.15 | - | - | - | - | 171 | 0.83 s | 12.54 s | 15.47 s | - | 117B 5,1B während der Inferenz aktiv | 131k | Aug. 2025 | Mai 2025 | Ja | Unterstützt: Text | Unterstützt: Text | +14 | ||||