Mehrsprachiger Benchmark für KI-Modelle Führende LLMs nach Sprache vergleichen

Entdecken Sie im Multilingual Index von Artificial Analysis, einschließlich des Benchmarks Global-MMLU-Lite, wie führende große Sprachmodelle (LLMs) in verschiedenen Sprachen abschneiden. Filtern Sie nach Sprache und Modell, vergleichen Sie die Zielkonflikte zwischen Genauigkeit, Geschwindigkeit und Kosten und finden Sie das beste LLM für Ihren mehrsprachigen Anwendungsfall.

Details zu Datensätzen und Methodik finden Sie auf der FAQ-Seite.

Überblick

Artificial Analysis Multilingual Index

Higher is better

Multilingual Index nach Sprache (normalisiert)

Die Werte werden je Sprache über alle getesteten Modelle hinweg normalisiert. Grün steht für den höchsten und Rot für den niedrigsten Wert in der jeweiligen Sprache.

Multilingual Index

Multilingual Index: Durchschnitt über alle Sprachen

Artificial Analysis Multilingual Index · Average across all languages · Higher is better

Multilingual Index: Durchschnitt vs. Ausgabegeschwindigkeit

Artificial Analysis Multilingual Index · Output speed: output tokens per second
Most attractive quadrant

Multilingual Index: Durchschnitt vs. Preis

Artificial Analysis Multilingual Index · Average across all languages
Most attractive quadrant

Global-MMLU-Lite

Mehrsprachiges Global-MMLU-Lite: Durchschnitt

Average across all languages · Higher is better

Preise

Pricing: Cache Hit, Input, and Output

Price (USD per M Tokens)

Geschwindigkeit und Latenz

Output Speed

Output tokens per second · Higher is better

Latency: Time To First Answer Token

Seconds to first answer token received · Accounts for reasoning model 'thinking' time

End-to-End Response Time

Seconds to output 500 tokens, including reasoning model 'thinking' time · Lower is better