Benchmark multilíngue de modelos de IA Compare os principais LLMs por idioma

Explore o desempenho dos principais modelos de linguagem de grande escala (LLMs) em vários idiomas no Multilingual Index da Artificial Analysis, incluindo o benchmark Global-MMLU-Lite. Filtre por idioma e modelo, analise as contrapartidas entre acurácia, velocidade e custo e encontre o melhor LLM para seu caso de uso multilíngue.

Para saber mais sobre os conjuntos de dados e a metodologia, consulte a página de perguntas frequentes.

Visão geral

Artificial Analysis Multilingual Index

Higher is better

Multilingual Index entre idiomas (normalizado)

As pontuações são normalizadas por idioma entre todos os modelos testados. O verde representa a maior pontuação naquele idioma, e o vermelho, a menor.

Multilingual Index

Multilingual Index: média de todos os idiomas

Artificial Analysis Multilingual Index · Average across all languages · Higher is better

Multilingual Index: média vs. velocidade de saída

Artificial Analysis Multilingual Index · Output speed: output tokens per second
Most attractive quadrant

Multilingual Index: média vs. preço

Artificial Analysis Multilingual Index · Average across all languages
Most attractive quadrant

Global-MMLU-Lite

Global-MMLU-Lite multilíngue: média

Average across all languages · Higher is better

Preços

Pricing: Cache Hit, Input, and Output

Price (USD per M Tokens)

Velocidade e latência

Output Speed

Output tokens per second · Higher is better

Latency: Time To First Answer Token

Seconds to first answer token received · Accounts for reasoning model 'thinking' time

End-to-End Response Time

Seconds to output 500 tokens, including reasoning model 'thinking' time · Lower is better