DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning) APIプロバイダーのベンチマークと分析
DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning)のAPIプロバイダーを、遅延(最初のトークンまでの時間)、出力速度(1秒あたりの出力トークン数)、料金などの性能指標で分析します。ベンチマーク対象のAPIプロバイダーにはが含まれます。
最速
出力速度
プロバイダー合計:0社
最短の遅延
最初のトークンまでの時間
プロバイダー合計:0社
最安料金
ブレンド料金(100万トークンあたり)
プロバイダー合計:0社
現在、DeepHermes 3 - Llama-3.1 8Bを利用できるAPIプロバイダーはありません。
このモデルではプロバイダーのベンチマークを利用できません。
モデルの詳細と他のモデルとの知能比較は、DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning)のモデルページをご覧ください。
ハイライト
更新:本番環境のユースケースをより適切に反映するため、性能ベンチマークのデフォルトワークロードを入力10kトークンに変更しました。上部で別のワークロードを引き続き選択できます。
料金
Pricing: Cache Hit, Input, and Output
Pricing: Blended Price
Output Speed vs. Price
速度
出力速度(1秒あたりのトークン数)で測定
Output Speed: DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning)
Latency vs. Output Speed
遅延
最初のトークンまでの時間(秒)で測定
最初のトークンまでの時間:DeepHermes 3 - Llama-3.1 8Bのプロバイダー
エンドツーエンド応答時間
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
エンドツーエンド応答時間:DeepHermes 3 - Llama-3.1 8Bのプロバイダー
主要な比較指標とAPI機能
| No results. | |||||||||
よくある質問
DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning)のプロバイダーに関するよくある質問
現在、ベンチマーク対象のAPIプロバイダーでDeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning)を利用することはできません。オープンウェイトモデルのため、セルフホストできます。
