Beste Controlled-Voice-Text-to-Speech-(TTS)-Modelle

Vergleichen Sie Qualität, Geschwindigkeit und Preis von Sprachgenerierungsmodellen, wobei alle Modelle dieselben geklonten Stimmen verwenden und so die Modellqualität von der Stimmauswahl getrennt wird.

Weitere Details finden Sie auf unserer Methodikseite.

QualitätUpdated

Präferenzrang der Controlled Voice Arena nach Sprache

Arena-Elo-Rang nach Sprache · Ein niedrigerer Rang ist besser
Modelle mit Ergebnissen für mindestens 6 Sprachen werden zuerst nach ihrem durchschnittlichen normalisierten Rang sortiert: (Rang - 1) / (Anzahl der für diese Sprache bewerteten Modelle - 1). Für die Sprachabdeckung und den Durchschnitt zählen nur Sprachen mit mindestens zwei bewerteten Modellen.
–: Noch kein Präferenzrang. Möglicherweise wurden noch keine Beispiele generiert oder das Modell unterstützt diese Sprache derzeit nicht.

Controlled Voice Arena: Präferenz German / Deutsch vs. Preis

Arena Elo: average Elo rating of the model · Price: USD per 1M characters of text
Most attractive quadrant
Pareto line

Preise

Preis

Price: USD per 1M characters of text · Lower is better

Durchsatz

Zeichen pro Sekunde

Characters processed per second: # of characters per second of generation time · Higher is better