Mehrsprachiger Benchmark für KI-Modelle Führende LLMs nach Sprache vergleichen
Entdecken Sie im Multilingual Index von Artificial Analysis, einschließlich des Benchmarks Global-MMLU-Lite, wie führende große Sprachmodelle (LLMs) in verschiedenen Sprachen abschneiden. Filtern Sie nach Sprache und Modell, vergleichen Sie die Zielkonflikte zwischen Genauigkeit, Geschwindigkeit und Kosten und finden Sie das beste LLM für Ihren mehrsprachigen Anwendungsfall.
Details zu Datensätzen und Methodik finden Sie auf der FAQ-Seite.
🌐Alle (Durchschnitt)
Führende Modelle#1
Gemini 3.1 Pro Preview93#2
Gemini 3 Pro Preview (high)92#3
Claude Opus 4.6 (max)92#4
Gemini 3 Flash91#5
Claude Opus 4.591
🇬🇧Englisch
Führende Modelle#1
Claude Opus 4.6 (max)95#2
Gemini 3.1 Pro Preview95#3
Gemini 3 Flash95#4
Claude Opus 4.594#5
GPT-5.1 (high)94
🇨🇳Chinesisch
Führende Modelle#1
Claude Opus 4.6 (max)94#2
Gemini 3.1 Pro Preview94#3
Gemini 3 Pro Preview (high)94#4
Gemini 3 Flash93#5
Claude Opus 4.592
🇮🇳Hindi
Führende Modelle#1
Gemini 3.1 Pro Preview94#2
Claude Opus 4.6 (max)92#3
Gemini 3 Pro Preview (high)91#4
GPT-5 (high)91#5
Claude Opus 4.591
🇪🇸Spanisch
Führende Modelle#1
Gemini 3.1 Pro Preview94#2
Gemini 3 Pro Preview (high)94#3
Gemini 3 Flash94#4
Claude Opus 4.6 (max)94#5
Claude Opus 4.594
🇫🇷Französisch
Führende Modelle#1
Gemini 3.1 Pro Preview94#2
GPT-5.1 (high)94#3
Gemini 3 Pro Preview (high)93#4
Claude Opus 4.6 (max)93#5
GPT-5 (high)93
Weitere Länder
🇸🇦 Arabisch
Gemini 3.1 Pro Preview🇧🇩 Bengalisch
Gemini 3.1 Pro Preview🇵🇹 Portugiesisch
Gemini 3.1 Pro Preview🇮🇩 Indonesisch
Gemini 3.1 Pro Preview🇯🇵 Japanisch
Gemini 3.1 Pro Preview🇰🇪 Suaheli
Gemini 3.1 Pro Preview🇩🇪 Deutsch
Gemini 3.1 Pro Preview🇰🇷 Koreanisch
Claude Opus 4.6 (max)🇮🇹 Italienisch
Gemini 3.1 Pro Preview🇳🇬 Yoruba
Gemini 3.1 Pro Preview🇲🇲 Birmanisch
Gemini 3.1 Pro Preview
Überblick
Artificial Analysis Multilingual Index
Higher is better
Reasoning models are indicated by a lightbulb icon
Multilingual Index nach Sprache (normalisiert)
Die Werte werden je Sprache über alle getesteten Modelle hinweg normalisiert. Grün steht für den höchsten und Rot für den niedrigsten Wert in der jeweiligen Sprache.
Reasoning models are indicated by a lightbulb icon
Multilingual Index
Multilingual Index: Durchschnitt über alle Sprachen
Artificial Analysis Multilingual Index · Average across all languages · Higher is better
Reasoning models are indicated by a lightbulb icon
Multilingual Index: Durchschnitt vs. Ausgabegeschwindigkeit
Artificial Analysis Multilingual Index · Output speed: output tokens per second
Most attractive quadrant
Reasoning models are indicated by a lightbulb icon
Multilingual Index: Durchschnitt vs. Preis
Artificial Analysis Multilingual Index · Average across all languages
Most attractive quadrant
Reasoning models are indicated by a lightbulb icon
Global-MMLU-Lite
Mehrsprachiges Global-MMLU-Lite: Durchschnitt
Average across all languages · Higher is better
Reasoning models are indicated by a lightbulb icon
Preise
Pricing: Cache Hit, Input, and Output
Price (USD per M Tokens)
Reasoning models are indicated by a lightbulb icon
Geschwindigkeit und Latenz
Output Speed
Output tokens per second · Higher is better
Reasoning models are indicated by a lightbulb icon
Latency: Time To First Answer Token
Seconds to first answer token received · Accounts for reasoning model 'thinking' time
Reasoning models are indicated by a lightbulb icon
End-to-End Response Time
Seconds to output 500 tokens, including reasoning model 'thinking' time · Lower is better
Reasoning models are indicated by a lightbulb icon