AA-Music-Instrumental v1.1Artificial Analysis
范围 | 模型 | Elo | 样本数 | |
|---|---|---|---|---|
| 1 | 1 | Suno v6 | 1140±1595% 区间 1125 至 1155 | 2,118 |
| 2 | 2 | Suno v6-mini | 1109±1595% 区间 1094 至 1124 | 2,228 |
| 3 | 3-6 | Mureka V9 | 1081±1495% 区间 1067 至 1095 | 2,236 |
| 4 | 3-6 | Mureka V9.5 | 1080±1595% 区间 1065 至 1095 | 2,195 |
| 5 | 3-6 | Lyria 3 Pro | 1078±1495% 区间 1064 至 1092 | 2,227 |
| 6 | 3-6 | Lyria 3.5 | 1076±1495% 区间 1062 至 1090 | 2,214 |
| 7 | 7-9 | Eleven Music | 1021±1495% 区间 1007 至 1035 | 2,106 |
| 8 | 7-10 | Stable Audio 3 Large | 1017±1495% 区间 1003 至 1031 | 2,186 |
| 9 | 7-14 | Eleven Music v2 | 1010±1495% 区间 996 至 1024 | 2,161 |
| 10 | 8-14 | MiniMax Music 2.5+ | 1005±1495% 区间 991 至 1019 | 2,166 |
| 11 | 9-14 | MiniMax Music 2.6 | 1002±1495% 区间 988 至 1016 | 2,162 |
| 12 | 9-15 | Eleven Music v2.5 | 1002±1495% 区间 988 至 1016 | 2,140 |
| 13 | 13 | MiniMax Music 3.0 | 1000锚点固定为 1000,作为本榜单 Elo 刻度的参照点。 | 2,156 |
| 14 | 9-16 | Stable Audio 3 Medium | 998±1495% 区间 984 至 1012 | 2,129 |
| 15 | 11-16 | Melodia v3 | 988±1595% 区间 973 至 1003 | 2,090 |
| 16 | 13-16 | Stable Audio 2.5 | 986±1595% 区间 971 至 1001 | 2,086 |
| 17 | 17 | Stable Audio 3 Small | 948±1595% 区间 933 至 963 | 2,119 |
| 18 | 18 | Lyria 2 | 932±1595% 区间 917 至 947 | 2,045 |
| 19 | 19 | MusicGen | 881±1695% 区间 865 至 897 | 2,024 |
常见问题
Suno v6 以 Elo 分数 1140 领先 AA-Music-Instrumental v1.1。
按 Elo 评分,AA-Music-Instrumental v1.1 上排名前列的模型是:1. Suno v6(Elo 1140)、2. Suno v6-mini(Elo 1109)、3. Mureka V9(Elo 1081)、4. Mureka V9.5(Elo 1080)和5. Lyria 3 Pro(Elo 1078)。排名基于我们招募的人工评审面板的盲测投票。
模型使用基于我们招募的人工评审面板盲测比较的 Elo 评分系统进行排名。面板参与者聆听根据同一提示词生成的成对音乐样本,在不知道由哪个模型创建的情况下选择更偏好的曲目。更高的 Elo 分数表示该模型更常被偏好。 在 Artificial Analysis 音乐竞技场投票
AA-Music-Instrumental v1.1 对生成不含人声音乐的模型进行排名,而 AA-Music-Vocal v1.1 对生成带有演唱或人声元素音乐的模型进行排名。模型在各基准测试中的表现可能不同,因此提供分开的排名。