이미지-동영상 리더보드 (오디오 포함)Artificial Analysis

Added to the leaderboard in the last month:

Minimax H3 Max (post-trained by fal), Agnes-Video-2.5, LTX-2.5 Fast, LTX-2.5 Pro, Wan 3.0

Range
Creator
Model
Elo
95% CI
Samples
출시일
API 가격 1
11-2
Fal logoFal
Minimax H3 Max (post-trained by fal)
1200-9/95,6152026년 8월US$2.40 /분
22-3
ByteDance Seed logoByteDance Seed
Dreamina Seedance 2.0 720p
1192-6/618,1482026년 3월US$9.07 /분
32-4
MiniMax logoMiniMax
MiniMax H3Hugging FaceOpen Weights
1187-8/87,4892026년 7월US$7.80 /분
43-5
Google logoGoogle
Gemini Omni Flash
1181-7/712,7822026년 5월US$6.00 /분
54-5
Alibaba logoAlibaba
Wan 3.0
1176-8/87,8162026년 8월US$12.00 /분
66-7
SpaceXAI logoSpaceXAI
grok-imagine-video-1.5
1110-7/76,4782026년 5월US$8.40 /분
76-8
Alibaba-ATH logoAlibaba-ATH
HappyHorse-1.1
1105-6/614,1832026년 6월US$9.90 /분
87-8
Sand.ai logoSand.ai
MAGI-2 PreviewHugging FaceOpen Weights
1100-7/712,0662026년 8월출시 예정
99-12
Alibaba-ATH logoAlibaba-ATH
HappyHorse-1.0
1087-7/78,9462026년 4월US$13.20 /분
109-12
Google logoGoogle
Veo 3.1
1087-7/78,9432026년 1월US$24.00 /분
119-12
Skywork AI logoSkywork AI
SkyReels V4
1085-7/76,0062026년 3월US$21.00 /분
129-13
Alibaba logoAlibaba
Wan 2.7
1083-7/75,7042026년 4월US$9.00 /분
1312-16
SpaceXAI logoSpaceXAI
grok-imagine-video
1077-6/617,8932026년 1월US$4.20 /분
1413-18
Google logoGoogle
Veo 3.1 Fast
1073-6/616,8252026년 1월US$9.00 /분
1513-18
KlingAI logoKlingAI
Kling 3.0 1080p (Pro)
1072-6/617,2932026년 2월US$20.16 /분
1613-18
Google logoGoogle
Veo 3.1 Lite
1071-7/78,2162026년 3월US$4.80 /분
1714-18
PixVerse logoPixVerse
PixVerse V6
1069-7/710,1982026년 3월US$6.90 /분
1814-18
KlingAI logoKlingAI
Kling 3.0 720p (Standard)
1068-6/617,2562026년 2월US$15.60 /분
1919-20
Vidu logoVidu
Vidu Q3 Pro
1061-6/617,5262026년 1월US$9.60 /분
2019-20
KlingAI logoKlingAI
Kling 3.0 Omni 1080p (Pro)
1060-7/77,9452026년 2월US$16.80 /분
2121
KlingAI logoKlingAI
Kling 3.0 Omni 720p (Standard)
1052-7/77,9132026년 2월US$13.44 /분
2221-22
Lightricks logoLightricks
LTX-2.5 FastHugging FaceOpen Weights
1045-9/92,8382026년 8월US$7.80 /분
2323-24
Sapiens AI logoSapiens AI
Agnes-Video-2.5
1035-8/86,1152026년 8월US$1.50 /분
2423-24
Vidu logoVidu
Vidu Q3 Turbo
1035-8/83,3782026년 2월US$3.90 /분
2525
Lightricks logoLightricks
LTX-2.5 ProHugging FaceOpen Weights
1013-9/92,6692026년 8월US$10.20 /분
2626-27
KlingAI logoKlingAI
Kling 2.6 Pro (January)
1002-7/78,0952026년 1월US$8.40 /분
2727
ByteDance Seed logoByteDance Seed
Seedance 1.5 pro
10000/012,1292025년 12월US$11.86 /분
2828-30
PixVerse logoPixVerse
PixVerse V5.6
960-7/76,5882026년 2월출시 예정
2928-30
Lightricks logoLightricks
LTX-2.3 FastHugging FaceOpen Weights
954-7/711,1862026년 3월US$2.40 /분
3028-30
Lightricks logoLightricks
LTX-2.3 ProHugging FaceOpen Weights
953-7/711,0932026년 3월US$4.80 /분
3131
Lightricks logoLightricks
LTX-2 FastHugging FaceOpen Weights
931-8/86,0662025년 10월US$2.40 /분
3232
Sapiens AI logoSapiens AI
Agnes-Video-V2.0
922-8/85,8402026년 5월US$0.30 /분
3333
Alibaba logoAlibaba
Wan 2.6
894-8/86,4442025년 12월US$9.00 /분
3434
Lightricks logoLightricks
LTX-2 ProHugging FaceOpen Weights
871-9/95,9522025년 10월US$3.60 /분

1 API 가격은 모델 제작자의 API에서 모델 기본 설정으로 1080p 동영상 1분을 생성하는 비용입니다

자주 묻는 질문

Minimax H3 Max (post-trained by fal)은(는) 현재 Artificial Analysis 이미지-동영상 아레나의 오디오 출력 모델 중 Elo 점수 1200로 선두입니다.

Elo 평가 기준 오디오 포함 상위 이미지-동영상 모델은 1. Minimax H3 Max (post-trained by fal)(Elo 1200), 2. Dreamina Seedance 2.0 720p(Elo 1192), 3. MiniMax H3(Elo 1187), 4. Gemini Omni Flash(Elo 1181) 및 5. Wan 3.0(Elo 1176)입니다. 순위는 Artificial Analysis Video Arena의 블라인드 사용자 투표를 기반으로 합니다.

MiniMax H3은(는) 현재 Artificial Analysis 이미지-동영상 아레나의 오디오 포함 오픈 웨이트 모델 중 Elo 점수 1187로 선두이며, 그 뒤를 MAGI-2 Preview(Elo 1100) 및 LTX-2.5 Fast(Elo 1045)이(가) 잇습니다.

Gemini Omni Flash은(는) 현재 Artificial Analysis 이미지-동영상 아레나(오디오 없음)에서 Elo 점수 1363로 선두입니다.

Elo 평가 기준 오디오 없는 상위 이미지-동영상 모델은 1. Gemini Omni Flash(Elo 1363), 2. Wan 3.0(Elo 1358), 3. MiniMax H3(Elo 1346), 4. Dreamina Seedance 2.0 720p(Elo 1339) 및 5. grok-imagine-video-1.5(Elo 1327)입니다. 순위는 Artificial Analysis Video Arena의 블라인드 사용자 투표를 기반으로 합니다.

MiniMax H3은(는) 현재 Artificial Analysis 이미지-동영상 아레나의 오디오 없는 오픈 웨이트 모델 중 Elo 점수 1346로 선두이며, 그 뒤를 Cosmos3-Super-Image2Video-4Step(Elo 1262) 및 Cosmos3-Super-Image2Video(Elo 1242)이(가) 잇습니다.

텍스트-동영상 모델은 텍스트 설명만으로 동영상을 생성하지만, 이미지-동영상 모델은 기존 이미지를 입력으로 받아 애니메이션을 적용하거나 확장하여 동영상으로 만듭니다. 이를 통해 생성된 동영상의 시각적 콘텐츠와 스타일을 더 세밀하게 제어할 수 있습니다.

모델은 블라인드 비교에서 얻은 사용자 투표 기반 Elo 평가 시스템으로 순위가 정해집니다. 사용자는 동일한 입력 이미지로 생성된 동영상을 비교하고 선호하는 결과를 선택합니다. Elo 점수가 높을수록 해당 모델이 더 자주 선호되었음을 의미합니다. Artificial Analysis Video Arena에서 투표