Benchmark multilingüe de modelos de IA Compara LLMs líderes por idioma
Explora cómo rinden los principales modelos de lenguaje grandes (LLMs) en varios idiomas en el Multilingual Index de Artificial Analysis, incluido el benchmark Global-MMLU-Lite. Filtra por idioma y modelo, consulta los trade-offs entre precisión, velocidad y coste, y encuentra el mejor LLM para tu caso de uso multilingüe.
Para detalles sobre datasets y metodología, consulta la página de FAQ.
🌐Todos (media)
Mejores modelos#1
Gemini 3.1 Pro Preview93#2
Gemini 3 Pro Preview (high)92#3
Claude Opus 4.6 (max)92#4
Gemini 3 Flash91#5
Claude Opus 4.591
🇬🇧Inglés
Mejores modelos#1
Claude Opus 4.6 (max)95#2
Gemini 3.1 Pro Preview95#3
Gemini 3 Flash95#4
Claude Opus 4.594#5
GPT-5.1 (high)94
🇨🇳Chino
Mejores modelos#1
Claude Opus 4.6 (max)94#2
Gemini 3.1 Pro Preview94#3
Gemini 3 Pro Preview (high)94#4
Gemini 3 Flash93#5
Claude Opus 4.592
🇮🇳Hindi
Mejores modelos#1
Gemini 3.1 Pro Preview94#2
Claude Opus 4.6 (max)92#3
Gemini 3 Pro Preview (high)91#4
GPT-5 (high)91#5
Claude Opus 4.591
🇪🇸Español
Mejores modelos#1
Gemini 3.1 Pro Preview94#2
Gemini 3 Pro Preview (high)94#3
Gemini 3 Flash94#4
Claude Opus 4.6 (max)94#5
Claude Opus 4.594
🇫🇷Francés
Mejores modelos#1
Gemini 3.1 Pro Preview94#2
GPT-5.1 (high)94#3
Gemini 3 Pro Preview (high)93#4
Claude Opus 4.6 (max)93#5
GPT-5 (high)93
Otros países
🇸🇦 Árabe
Gemini 3.1 Pro Preview🇧🇩 Bengalí
Gemini 3.1 Pro Preview🇵🇹 Portugués
Gemini 3.1 Pro Preview🇮🇩 Indonesio
Gemini 3.1 Pro Preview🇯🇵 Japonés
Gemini 3.1 Pro Preview🇰🇪 Suajili
Gemini 3.1 Pro Preview🇩🇪 Alemán
Gemini 3.1 Pro Preview🇰🇷 Coreano
Claude Opus 4.6 (max)🇮🇹 Italiano
Gemini 3.1 Pro Preview🇳🇬 Yoruba
Gemini 3.1 Pro Preview🇲🇲 Birmano
Gemini 3.1 Pro Preview
Resumen
Artificial Analysis Multilingual Index
Higher is better
Reasoning models are indicated by a lightbulb icon
Multilingual Index por idioma (normalizado)
Las puntuaciones están normalizadas por idioma entre todos los modelos evaluados: el verde representa la puntuación más alta para ese idioma y el rojo la más baja.
Reasoning models are indicated by a lightbulb icon
Multilingual Index
Multilingual Index: media de todos los idiomas
Artificial Analysis Multilingual Index · Average across all languages · Higher is better
Reasoning models are indicated by a lightbulb icon
Multilingual Index: media vs. velocidad de salida
Artificial Analysis Multilingual Index · Output speed: output tokens per second
Most attractive quadrant
Reasoning models are indicated by a lightbulb icon
Multilingual Index: media vs. precio
Artificial Analysis Multilingual Index · Average across all languages
Most attractive quadrant
Reasoning models are indicated by a lightbulb icon
Global-MMLU-Lite
Global-MMLU-Lite multilingüe: media
Average across all languages · Higher is better
Reasoning models are indicated by a lightbulb icon
Precios
Pricing: Cache Hit, Input, and Output
Price (USD per M Tokens)
Reasoning models are indicated by a lightbulb icon
Velocidad y latencia
Output Speed
Output tokens per second · Higher is better
Reasoning models are indicated by a lightbulb icon
Latency: Time To First Answer Token
Seconds to first answer token received · Accounts for reasoning model 'thinking' time
Reasoning models are indicated by a lightbulb icon
End-to-End Response Time
Seconds to output 500 tokens, including reasoning model 'thinking' time · Lower is better
Reasoning models are indicated by a lightbulb icon