このモデルは非推奨です。デフォルトの入力トークン数1万のワークロードでのみ性能測定を継続しています。他のワークロードの結果は過去のデータであり、更新されません。
NVIDIAは新しいリリースであるNemotron 3 Super 120B A12Bを公開しています。こちらの利用をご検討ください。
Llama Nemotron Super 49B v1.5 (Non-reasoning) APIプロバイダーのベンチマークと分析
この分析は、ユースケースに最適なLlama Nemotron Super 49B v1.5 (Non-reasoning)のAPIプロバイダーを選ぶための参考情報です。
最速
出力速度
プロバイダー合計:0社
最短の遅延
最初のトークンまでの時間
プロバイダー合計:0社
最安料金
ブレンド料金(100万トークンあたり)
プロバイダー合計:0社
現在、Llama Nemotron Super 49B v1.5 (non-reasoning)を利用できるAPIプロバイダーはありません。
モデルの詳細と他のモデルとの知能比較は、Llama Nemotron Super 49B v1.5 (Non-reasoning)のモデルページをご覧ください。
料金
料金:キャッシュヒット・入力・出力
Intelligence Index タスクあたりのコスト
出力速度と料金
速度
出力速度(1秒あたりのトークン数)で測定
出力速度: Llama Nemotron Super 49B v1.5 (Non-reasoning)
Intelligence Indexのタスクあたりの時間
タスクあたりの費用とタスクあたりの時間
遅延
最初のトークンまでの時間(秒)で測定
最初のトークンまでの時間
エンドツーエンド応答時間
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
エンドツーエンド応答時間
主要な比較指標とAPI機能
| No results. | |||||||||
よくある質問
Llama Nemotron Super 49B v1.5 (Non-reasoning)のプロバイダーに関するよくある質問
現在、ベンチマーク対象のAPIプロバイダーでLlama Nemotron Super 49B v1.5 (Non-reasoning)を利用することはできません。オープンウェイトモデルのため、セルフホストできます。