Benchmark multilingüe de modelos de IA Compara LLMs líderes por idioma

Explora cómo rinden los principales modelos de lenguaje grandes (LLMs) en varios idiomas en el Multilingual Index de Artificial Analysis, incluido el benchmark Global-MMLU-Lite. Filtra por idioma y modelo, consulta los trade-offs entre precisión, velocidad y coste, y encuentra el mejor LLM para tu caso de uso multilingüe.

Para detalles sobre datasets y metodología, consulta la página de FAQ.

Resumen

Artificial Analysis Multilingual Index

Higher is better

Multilingual Index por idioma (normalizado)

Las puntuaciones están normalizadas por idioma entre todos los modelos evaluados: el verde representa la puntuación más alta para ese idioma y el rojo la más baja.

Multilingual Index

Multilingual Index: media de todos los idiomas

Artificial Analysis Multilingual Index · Average across all languages · Higher is better

Multilingual Index: media vs. velocidad de salida

Artificial Analysis Multilingual Index · Output speed: output tokens per second
Most attractive quadrant

Multilingual Index: media vs. precio

Artificial Analysis Multilingual Index · Average across all languages
Most attractive quadrant

Global-MMLU-Lite

Global-MMLU-Lite multilingüe: media

Average across all languages · Higher is better

Precios

Pricing: Cache Hit, Input, and Output

Price (USD per M Tokens)

Velocidad y latencia

Output Speed

Output tokens per second · Higher is better

Latency: Time To First Answer Token

Seconds to first answer token received · Accounts for reasoning model 'thinking' time

End-to-End Response Time

Seconds to output 500 tokens, including reasoning model 'thinking' time · Lower is better