このモデルは非推奨です。デフォルトの入力トークン数1万のワークロードでのみ性能測定を継続しています。他のワークロードの結果は過去のデータであり、更新されません。
NVIDIAは新しいリリースであるLlama Nemotron Super 49B v1.5を公開しています。こちらの利用をご検討ください。
Llama 3.3 Nemotron Super 49B v1 (Non-reasoning) APIプロバイダーのベンチマークと分析
この分析は、ユースケースに最適なLlama 3.3 Nemotron Super 49B v1 (Non-reasoning)のAPIプロバイダーを選ぶための参考情報です。
最速
出力速度
プロバイダー合計:0社
最短の遅延
最初のトークンまでの時間
プロバイダー合計:0社
最安料金
ブレンド料金(100万トークンあたり)
プロバイダー合計:0社
現在、Llama 3.3 Nemotron Super 49B (non-reasoning)を利用できるAPIプロバイダーはありません。
モデルの詳細と他のモデルとの知能比較は、Llama 3.3 Nemotron Super 49B v1 (Non-reasoning)のモデルページをご覧ください。
料金
料金:キャッシュヒット・入力・出力
料金:ブレンド料金
出力速度と料金
速度
出力速度(1秒あたりのトークン数)で測定
出力速度: Llama 3.3 Nemotron Super 49B v1 (Non-reasoning)
遅延と出力速度
遅延
最初のトークンまでの時間(秒)で測定
最初のトークンまでの時間
エンドツーエンド応答時間
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
エンドツーエンド応答時間
主要な比較指標とAPI機能
| No results. | |||||||||
よくある質問
Llama 3.3 Nemotron Super 49B v1 (Non-reasoning)のプロバイダーに関するよくある質問
現在、ベンチマーク対象のAPIプロバイダーでLlama 3.3 Nemotron Super 49B v1 (Non-reasoning)を利用することはできません。オープンウェイトモデルのため、セルフホストできます。