最良の統制音声テキスト読み上げ(TTS)モデル

すべてのモデルが同じクローン音声で話す条件で、音声生成モデルの品質、速度、料金を比較し、音声選択からモデル品質を切り分けます。

詳細については、方法論ページをご覧ください。

品質

統制音声アリーナの言語別品質ランキング

言語別のアリーナElo順位 · 順位の数値が低いほど良い
6言語以上の結果があるモデルを、正規化順位の平均で上位に並べます: (順位 - 1) / (その言語で順位が付いたモデル数 - 1). 対象言語数と平均の計算には、順位が付いたモデルが2つ以上ある言語のみを含めます。
–:品質順位はまだありません。サンプルがまだ生成されていないか、モデルが現在その言語に対応していない可能性があります。

統制音声アリーナの品質(Japanese / 日本語)vs. 料金

Arena Elo: average Elo rating of the model · Price: USD per 1M characters of text
Most attractive quadrant
Pareto line

料金

料金

Price: USD per 1M characters of text · Lower is better

スループット

1秒あたりの文字数

Characters processed per second: # of characters per second of generation time · Higher is better