다국어 AI 모델 벤치마크 언어별 주요 LLM 비교
Global-MMLU-Lite 벤치마크를 포함한 Artificial Analysis Multilingual Index에서 주요 대규모 언어 모델(LLM)이 여러 언어에 걸쳐 어떤 성능을 보이는지 살펴보세요. 언어와 모델로 필터링하고 정확도, 속도, 비용의 상충 관계를 확인해 다국어 사용 사례에 가장 적합한 LLM을 찾을 수 있습니다.
데이터 세트와 방법론에 관한 자세한 내용은 FAQ 페이지에서 확인하세요.
🌐전체(평균)
상위 모델#1
Gemini 3.1 Pro Preview93#2
Gemini 3 Pro Preview (high)92#3
Claude Opus 4.6 (max)92#4
Gemini 3 Flash91#5
Claude Opus 4.591
🇬🇧영어
상위 모델#1
Claude Opus 4.6 (max)95#2
Gemini 3.1 Pro Preview95#3
Gemini 3 Flash95#4
Claude Opus 4.594#5
GPT-5.1 (high)94
🇨🇳중국어
상위 모델#1
Claude Opus 4.6 (max)94#2
Gemini 3.1 Pro Preview94#3
Gemini 3 Pro Preview (high)94#4
Gemini 3 Flash93#5
Claude Opus 4.592
🇮🇳힌디어
상위 모델#1
Gemini 3.1 Pro Preview94#2
Claude Opus 4.6 (max)92#3
Gemini 3 Pro Preview (high)91#4
GPT-5 (high)91#5
Claude Opus 4.591
🇪🇸스페인어
상위 모델#1
Gemini 3.1 Pro Preview94#2
Gemini 3 Pro Preview (high)94#3
Gemini 3 Flash94#4
Claude Opus 4.6 (max)94#5
Claude Opus 4.594
🇫🇷프랑스어
상위 모델#1
Gemini 3.1 Pro Preview94#2
GPT-5.1 (high)94#3
Gemini 3 Pro Preview (high)93#4
Claude Opus 4.6 (max)93#5
GPT-5 (high)93
기타 국가
🇸🇦 아랍어
Gemini 3.1 Pro Preview🇧🇩 벵골어
Gemini 3.1 Pro Preview🇵🇹 포르투갈어
Gemini 3.1 Pro Preview🇮🇩 인도네시아어
Gemini 3.1 Pro Preview🇯🇵 일본어
Gemini 3.1 Pro Preview🇰🇪 스와힐리어
Gemini 3.1 Pro Preview🇩🇪 독일어
Gemini 3.1 Pro Preview🇰🇷 한국어
Claude Opus 4.6 (max)🇮🇹 이탈리아어
Gemini 3.1 Pro Preview🇳🇬 요루바어
Gemini 3.1 Pro Preview🇲🇲 버마어
Gemini 3.1 Pro Preview
개요
Artificial Analysis Multilingual Index
Higher is better
Reasoning models are indicated by a lightbulb icon
언어별 Multilingual Index(정규화)
테스트한 모든 모델에서 언어별 점수를 정규화합니다. 초록색은 해당 언어의 최고 점수, 빨간색은 최저 점수를 나타냅니다.
Reasoning models are indicated by a lightbulb icon
Multilingual Index
Multilingual Index: 전체 언어 평균
Artificial Analysis Multilingual Index · Average across all languages · Higher is better
Reasoning models are indicated by a lightbulb icon
Multilingual Index: 평균과 출력 속도
Artificial Analysis Multilingual Index · Output speed: output tokens per second
Most attractive quadrant
Reasoning models are indicated by a lightbulb icon
Multilingual Index: 평균과 가격
Artificial Analysis Multilingual Index · Average across all languages
Most attractive quadrant
Reasoning models are indicated by a lightbulb icon
Global-MMLU-Lite
다국어 Global-MMLU-Lite: 평균
Average across all languages · Higher is better
Reasoning models are indicated by a lightbulb icon
가격
Pricing: Cache Hit, Input, and Output
Price (USD per M Tokens)
Reasoning models are indicated by a lightbulb icon
속도 및 지연 시간
Output Speed
Output tokens per second · Higher is better
Reasoning models are indicated by a lightbulb icon
Latency: Time To First Answer Token
Seconds to first answer token received · Accounts for reasoning model 'thinking' time
Reasoning models are indicated by a lightbulb icon
End-to-End Response Time
Seconds to output 500 tokens, including reasoning model 'thinking' time · Lower is better
Reasoning models are indicated by a lightbulb icon