Beste Provider-Voice-Text-to-Speech-(TTS)-Modelle

Vergleichen Sie Qualität, Geschwindigkeit und Preis von Sprachgenerierungsmodellen, wobei jedes Modell – sofern verfügbar – die eigenen Stimmen seines Anbieters verwendet.

Weitere Details finden Sie auf unserer Methodikseite.

Qualität

Qualitäts-Elo der Provider Voice Arena

Arena Elo: average Elo rating of the model · Higher is better

Relative Elo score of the models as determined by responses from users in Artificial Analysis' Speech Arena. Some models may not be shown due to not yet having enough votes.

Preise

Preis

Price: USD per 1M characters of text · Lower is better

Price per 1M characters of text. For detail on how we calculate price for providers which price based on inference time or subscription plans, see our methodology page.

Geschwindigkeitsfaktor

Zeichen pro Sekunde

Characters processed per second: # of characters per second of generation time · Higher is better

Number of characters processed per second of generation time. Higher values indicate faster generation speeds.

Häufig gestellte Fragen

Sonic 3.6 hat derzeit die höchste Qualität im Text-to-Speech-Modellvergleich von Artificial Analysis mit einem Qualitäts-Elo von 1.282. Sonic 3.6 ansehen

Polly Standard ist derzeit das schnellste Text-to-Speech-Modell im Vergleich an repräsentativen API-Endpunkten; Amazon Bedrock liefert 1.209,4 Zeichen pro Sekunde. Anbieter von Polly Standard ansehen

Kokoro 82M v1.0 ist derzeit das günstigste Text-to-Speech-Modell im Vergleich an repräsentativen API-Endpunkten; Replicate kostet 0,65 $ pro 1 Million Zeichen. Anbieter von Kokoro 82M v1.0 ansehen

Sonic 3.6 über Cartesia, Simba 3.2 über SpeechifyAI und Falcon 2 über Murf AI bieten derzeit einige der stärksten Qualität-Preis-Kompromisse im Vergleich. Diese repräsentativen Endpunkte liegen auf der aktuellen Qualitäts-Preis-Grenze, das heißt, nur wenige Alternativen sind gleichzeitig günstiger und qualitativ besser. Anbieter von Sonic 3.6 ansehen