This model is deprecated. We only continue performance benchmarking for the default 10k input token workload. Results for other workloads are historical and no longer updated.
Anthropic has launched a newer model, Claude Sonnet 5 (Non-reasoning). We suggest considering it instead.
For more information, see comparison of Claude Sonnet 5 (Non-reasoning) to other models and API provider benchmarks for Claude Sonnet 5 (Non-reasoning).
Claude Sonnet 4.6 (Non-reasoning, High Effort) Benchmarking und Analyse von API-Anbietern
Analyse der API-Anbieter für Claude Sonnet 4.6 (Non-reasoning, High Effort) anhand von Leistungsmetriken wie Latenz (Zeit bis zum ersten Token), Ausgabegeschwindigkeit (Ausgabetokens pro Sekunde) und Preis. Zu den bewerteten API-Anbietern gehören Amazon Bedrock, Microsoft Azure, Google und Anthropic.
Am schnellsten
Ausgabegeschwindigkeit
Insgesamt 4 Anbieter
Niedrigste Latenz
Zeit bis zum ersten Token
Insgesamt 4 Anbieter
Niedrigster Preis
Mischpreis (pro 1 Mio. Tokens)
Insgesamt 4 Anbieter
Claude Sonnet 4.6 (Non-reasoning) ist über 4 API-Anbieter verfügbar, die jeweils unterschiedliche Leistungsmerkmale und Preise bieten. Im Folgenden werden die wichtigsten Metriken der Anbieter verglichen.
- Bei der Ausgabegeschwindigkeit führen Amazon (46.7 Tokens/s), Google (44.7 Tokens/s) und Azure (43.9 Tokens/s).
- Bei der Latenz bieten Google (1.22 s), Anthropic (1.45 s) und Amazon (1.48 s) die niedrigste Zeit bis zum ersten Token.
- Bei den Preisen bieten Amazon (2.31), Azure (2.31) und Google (2.31) die niedrigsten Mischpreise pro 1 Mio. Tokens.
- Amazon bietet ein hervorragendes Verhältnis von Geschwindigkeit und Kosteneffizienz. Für die niedrigste Latenz ist Google die beste Wahl.
Wichtigste Ergebnisse
Preise
Pricing: Cache Hit, Input, and Output
Pricing: Blended Price
Pricing: Cache Discount
Output Speed vs. Price
Geschwindigkeit
Gemessen anhand der Ausgabegeschwindigkeit (Tokens pro Sekunde)
Output Speed: Claude Sonnet 4.6 (Non-reasoning, High Effort)
Latency vs. Output Speed
Latenz
Gemessen anhand der Zeit (in Sekunden) bis zum ersten Token
Zeit bis zum ersten Token: Anbieter von Claude Sonnet 4.6 (Non-reasoning)
Ende-zu-Ende-Antwortzeit
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
Ende-zu-Ende-Antwortzeit: Anbieter von Claude Sonnet 4.6 (Non-reasoning)
Wichtige Vergleichsmetriken und API-Funktionen
Häufig gestellte Fragen
Häufige Fragen zu den Anbietern von Claude Sonnet 4.6 (Non-reasoning, High Effort)
Claude Sonnet 4.6 (Non-reasoning, High Effort) ist derzeit über 4 API-Anbieter, die wir bewerten und beobachten verfügbar.
Die nach Ausgabegeschwindigkeit schnellsten Anbieter für Claude Sonnet 4.6 (Non-reasoning, High Effort) sind Amazon (46.7 Tokens/s), Google (44.7 Tokens/s) und Azure (43.9 Tokens/s). Die Ausgabegeschwindigkeit misst, wie schnell Tokens erzeugt werden, nachdem das Modell mit der Antwort begonnen hat.
Alle 4 Anbieter von Claude Sonnet 4.6 (Non-reasoning, High Effort) unterstützen Funktionsaufrufe (Tool-Nutzung).
Berücksichtigen Sie bei der Wahl eines Anbieters für Claude Sonnet 4.6 (Non-reasoning, High Effort) die Ausgabegeschwindigkeit für durchsatzintensive Aufgaben, die Latenz für interaktive Anwendungen mit schneller erster Reaktion, den Preis für kostensensible Workloads und API-Funktionen wie den JSON-Modus oder Funktionsaufrufe.
Ja, die Leistung eines Anbieters kann sich durch Änderungen an der Infrastruktur, Lastverteilung und Aktualisierungen im Laufe der Zeit verändern. Wir bewerten alle Anbieter fortlaufend und zeigen historische Leistungstrends in den Diagrammen „Im Zeitverlauf“ an.
Informationen zur Intelligenz, zu den Fähigkeiten und Modalitäten von Claude Sonnet 4.6 (Non-reasoning, High Effort) sowie zum Vergleich mit anderen Modellen finden Sie auf der Modellübersichtsseite. Modellübersicht anzeigen