多言語AIモデルベンチマーク 言語別に主要LLMを比較
Global-MMLU-Liteベンチマークを含むArtificial Analysis Multilingual Indexで、主要な大規模言語モデル(LLM)が複数の言語にわたって示す性能を確認できます。言語とモデルで絞り込み、精度、速度、費用のトレードオフを確認し、多言語のユースケースに最適なLLMを見つけられます。
データセットと方法論の詳細は、よくある質問のページをご覧ください。
🌐すべて(平均)
上位モデル#1
Gemini 3.1 Pro Preview93#2
Gemini 3 Pro Preview (high)92#3
Claude Opus 4.6 (max)92#4
Gemini 3 Flash91#5
Claude Opus 4.591
🇬🇧英語
上位モデル#1
Claude Opus 4.6 (max)95#2
Gemini 3.1 Pro Preview95#3
Gemini 3 Flash95#4
Claude Opus 4.594#5
GPT-5.1 (high)94
🇨🇳中国語
上位モデル#1
Claude Opus 4.6 (max)94#2
Gemini 3.1 Pro Preview94#3
Gemini 3 Pro Preview (high)94#4
Gemini 3 Flash93#5
Claude Opus 4.592
🇮🇳ヒンディー語
上位モデル#1
Gemini 3.1 Pro Preview94#2
Claude Opus 4.6 (max)92#3
Gemini 3 Pro Preview (high)91#4
GPT-5 (high)91#5
Claude Opus 4.591
🇪🇸スペイン語
上位モデル#1
Gemini 3.1 Pro Preview94#2
Gemini 3 Pro Preview (high)94#3
Gemini 3 Flash94#4
Claude Opus 4.6 (max)94#5
Claude Opus 4.594
🇫🇷フランス語
上位モデル#1
Gemini 3.1 Pro Preview94#2
GPT-5.1 (high)94#3
Gemini 3 Pro Preview (high)93#4
Claude Opus 4.6 (max)93#5
GPT-5 (high)93
その他の国
🇸🇦 アラビア語
Gemini 3.1 Pro Preview🇧🇩 ベンガル語
Gemini 3.1 Pro Preview🇵🇹 ポルトガル語
Gemini 3.1 Pro Preview🇮🇩 インドネシア語
Gemini 3.1 Pro Preview🇯🇵 日本語
Gemini 3.1 Pro Preview🇰🇪 スワヒリ語
Gemini 3.1 Pro Preview🇩🇪 ドイツ語
Gemini 3.1 Pro Preview🇰🇷 韓国語
Claude Opus 4.6 (max)🇮🇹 イタリア語
Gemini 3.1 Pro Preview🇳🇬 ヨルバ語
Gemini 3.1 Pro Preview🇲🇲 ミャンマー語
Gemini 3.1 Pro Preview
概要
Artificial Analysis Multilingual Index
Higher is better
Reasoning models are indicated by a lightbulb icon
言語別Multilingual Index(正規化)
テストした全モデルを対象に言語ごとにスコアを正規化しています。緑はその言語で最高のスコア、赤は最低のスコアを示します。
Reasoning models are indicated by a lightbulb icon
Multilingual Index
Multilingual Index:全言語の平均
Artificial Analysis Multilingual Index · Average across all languages · Higher is better
Reasoning models are indicated by a lightbulb icon
Multilingual Index:平均と出力速度
Artificial Analysis Multilingual Index · Output speed: output tokens per second
Most attractive quadrant
Reasoning models are indicated by a lightbulb icon
Multilingual Index:平均と料金
Artificial Analysis Multilingual Index · Average across all languages
Most attractive quadrant
Reasoning models are indicated by a lightbulb icon
Global-MMLU-Lite
多言語Global-MMLU-Lite:平均
Average across all languages · Higher is better
Reasoning models are indicated by a lightbulb icon
料金
Pricing: Cache Hit, Input, and Output
Price (USD per M Tokens)
Reasoning models are indicated by a lightbulb icon
速度と遅延
Output Speed
Output tokens per second · Higher is better
Reasoning models are indicated by a lightbulb icon
Latency: Time To First Answer Token
Seconds to first answer token received · Accounts for reasoning model 'thinking' time
Reasoning models are indicated by a lightbulb icon
End-to-End Response Time
Seconds to output 500 tokens, including reasoning model 'thinking' time · Lower is better
Reasoning models are indicated by a lightbulb icon