Benchmark multilíngue de modelos de IA Compare os principais LLMs por idioma
Explore o desempenho dos principais modelos de linguagem de grande escala (LLMs) em vários idiomas no Multilingual Index da Artificial Analysis, incluindo o benchmark Global-MMLU-Lite. Filtre por idioma e modelo, analise as contrapartidas entre acurácia, velocidade e custo e encontre o melhor LLM para seu caso de uso multilíngue.
Para saber mais sobre os conjuntos de dados e a metodologia, consulte a página de perguntas frequentes.
🌐Todos (média)
Melhores modelos#1
Gemini 3.1 Pro Preview93#2
Gemini 3 Pro Preview (high)92#3
Claude Opus 4.6 (max)92#4
Gemini 3 Flash91#5
Claude Opus 4.591
🇬🇧Inglês
Melhores modelos#1
Claude Opus 4.6 (max)95#2
Gemini 3.1 Pro Preview95#3
Gemini 3 Flash95#4
Claude Opus 4.594#5
GPT-5.1 (high)94
🇨🇳Chinês
Melhores modelos#1
Claude Opus 4.6 (max)94#2
Gemini 3.1 Pro Preview94#3
Gemini 3 Pro Preview (high)94#4
Gemini 3 Flash93#5
Claude Opus 4.592
🇮🇳Hindi
Melhores modelos#1
Gemini 3.1 Pro Preview94#2
Claude Opus 4.6 (max)92#3
Gemini 3 Pro Preview (high)91#4
GPT-5 (high)91#5
Claude Opus 4.591
🇪🇸Espanhol
Melhores modelos#1
Gemini 3.1 Pro Preview94#2
Gemini 3 Pro Preview (high)94#3
Gemini 3 Flash94#4
Claude Opus 4.6 (max)94#5
Claude Opus 4.594
🇫🇷Francês
Melhores modelos#1
Gemini 3.1 Pro Preview94#2
GPT-5.1 (high)94#3
Gemini 3 Pro Preview (high)93#4
Claude Opus 4.6 (max)93#5
GPT-5 (high)93
Outros países
🇸🇦 Árabe
Gemini 3.1 Pro Preview🇧🇩 Bengali
Gemini 3.1 Pro Preview🇵🇹 Português
Gemini 3.1 Pro Preview🇮🇩 Indonésio
Gemini 3.1 Pro Preview🇯🇵 Japonês
Gemini 3.1 Pro Preview🇰🇪 Suaíli
Gemini 3.1 Pro Preview🇩🇪 Alemão
Gemini 3.1 Pro Preview🇰🇷 Coreano
Claude Opus 4.6 (max)🇮🇹 Italiano
Gemini 3.1 Pro Preview🇳🇬 Iorubá
Gemini 3.1 Pro Preview🇲🇲 Birmanês
Gemini 3.1 Pro Preview
Visão geral
Artificial Analysis Multilingual Index
Higher is better
Reasoning models are indicated by a lightbulb icon
Multilingual Index entre idiomas (normalizado)
As pontuações são normalizadas por idioma entre todos os modelos testados. O verde representa a maior pontuação naquele idioma, e o vermelho, a menor.
Reasoning models are indicated by a lightbulb icon
Multilingual Index
Multilingual Index: média de todos os idiomas
Artificial Analysis Multilingual Index · Average across all languages · Higher is better
Reasoning models are indicated by a lightbulb icon
Multilingual Index: média vs. velocidade de saída
Artificial Analysis Multilingual Index · Output speed: output tokens per second
Most attractive quadrant
Reasoning models are indicated by a lightbulb icon
Multilingual Index: média vs. preço
Artificial Analysis Multilingual Index · Average across all languages
Most attractive quadrant
Reasoning models are indicated by a lightbulb icon
Global-MMLU-Lite
Global-MMLU-Lite multilíngue: média
Average across all languages · Higher is better
Reasoning models are indicated by a lightbulb icon
Preços
Pricing: Cache Hit, Input, and Output
Price (USD per M Tokens)
Reasoning models are indicated by a lightbulb icon
Velocidade e latência
Output Speed
Output tokens per second · Higher is better
Reasoning models are indicated by a lightbulb icon
Latency: Time To First Answer Token
Seconds to first answer token received · Accounts for reasoning model 'thinking' time
Reasoning models are indicated by a lightbulb icon
End-to-End Response Time
Seconds to output 500 tokens, including reasoning model 'thinking' time · Lower is better
Reasoning models are indicated by a lightbulb icon