多语言 AI 模型基准测试 按语言比较领先 LLM
探索领先大语言模型(LLM)在 Artificial Analysis 多语言指数中的多语言表现,其中包括 Global-MMLU-Lite 基准测试。按语言和模型筛选,查看准确率、速度与成本之间的权衡,为您的多语言使用场景寻找最佳 LLM。
如需了解数据集和方法论详情,请参阅常见问题页面。
🌐全部(平均)
顶尖模型#1
Gemini 3.1 Pro Preview93#2
Gemini 3 Pro Preview (high)92#3
Claude Opus 4.6 (max)92#4
Gemini 3 Flash91#5
Claude Opus 4.591
🇬🇧英语
顶尖模型#1
Claude Opus 4.6 (max)95#2
Gemini 3.1 Pro Preview95#3
Gemini 3 Flash95#4
Claude Opus 4.594#5
GPT-5.1 (high)94
🇨🇳中文
顶尖模型#1
Claude Opus 4.6 (max)94#2
Gemini 3.1 Pro Preview94#3
Gemini 3 Pro Preview (high)94#4
Gemini 3 Flash93#5
Claude Opus 4.592
🇮🇳印地语
顶尖模型#1
Gemini 3.1 Pro Preview94#2
Claude Opus 4.6 (max)92#3
Gemini 3 Pro Preview (high)91#4
GPT-5 (high)91#5
Claude Opus 4.591
🇪🇸西班牙语
顶尖模型#1
Gemini 3.1 Pro Preview94#2
Gemini 3 Pro Preview (high)94#3
Gemini 3 Flash94#4
Claude Opus 4.6 (max)94#5
Claude Opus 4.594
🇫🇷法语
顶尖模型#1
Gemini 3.1 Pro Preview94#2
GPT-5.1 (high)94#3
Gemini 3 Pro Preview (high)93#4
Claude Opus 4.6 (max)93#5
GPT-5 (high)93
其他国家/地区
🇸🇦 阿拉伯语
Gemini 3.1 Pro Preview🇧🇩 孟加拉语
Gemini 3.1 Pro Preview🇵🇹 葡萄牙语
Gemini 3.1 Pro Preview🇮🇩 印度尼西亚语
Gemini 3.1 Pro Preview🇯🇵 日语
Gemini 3.1 Pro Preview🇰🇪 斯瓦希里语
Gemini 3.1 Pro Preview🇩🇪 德语
Gemini 3.1 Pro Preview🇰🇷 韩语
Claude Opus 4.6 (max)🇮🇹 意大利语
Gemini 3.1 Pro Preview🇳🇬 约鲁巴语
Gemini 3.1 Pro Preview🇲🇲 缅甸语
Gemini 3.1 Pro Preview
概述
Artificial Analysis 多语言指数
Higher is better
Reasoning models are indicated by a lightbulb icon
各语言的多语言指数(归一化)
分数按语言在所有受测模型中归一化,其中绿色表示该语言的最高分,红色表示最低分。
Reasoning models are indicated by a lightbulb icon
多语言指数
多语言指数:所有语言的平均分
Artificial Analysis Multilingual Index · Average across all languages · Higher is better
Reasoning models are indicated by a lightbulb icon
多语言指数:平均分与输出速度
Artificial Analysis Multilingual Index · Output speed: output tokens per second
Most attractive quadrant
Reasoning models are indicated by a lightbulb icon
多语言指数:平均分与价格
Artificial Analysis Multilingual Index · Average across all languages
Most attractive quadrant
Reasoning models are indicated by a lightbulb icon
Global-MMLU-Lite
多语言 Global-MMLU-Lite:平均分
Average across all languages · Higher is better
Reasoning models are indicated by a lightbulb icon
价格
Pricing: Cache Hit, Input, and Output
Price (USD per M Tokens)
Reasoning models are indicated by a lightbulb icon
速度与延迟
Output Speed
Output tokens per second · Higher is better
Reasoning models are indicated by a lightbulb icon
Latency: Time To First Answer Token
Seconds to first answer token received · Accounts for reasoning model 'thinking' time
Reasoning models are indicated by a lightbulb icon
End-to-End Response Time
Seconds to output 500 tokens, including reasoning model 'thinking' time · Lower is better
Reasoning models are indicated by a lightbulb icon