gpt-oss-120b (Low) APIプロバイダーのベンチマークと分析
この分析は、ユースケースに最適なgpt-oss-120b (Low)のAPIプロバイダーを選ぶための参考情報です。
最速
出力速度
プロバイダー合計:17社
最短の遅延
最初の回答トークンまでの時間
プロバイダー合計:17社
最安料金
ブレンド料金(100万トークンあたり)
プロバイダー合計:17社
gpt-oss-120b (low)は17社のAPIプロバイダーで利用でき、性能特性と料金はそれぞれ異なります。以下でプロバイダー間の主要指標を比較します。
- 出力速度の上位プロバイダーはCerebras(1,687.8 t/s)、SambaNova(745.7 t/s)、Groq(471.9 t/s)です。 プロバイダー間の速度差は大きく、最速と最遅で4138%の差があります。
- 遅延では、Cerebras(1.59秒)、SambaNova(3.94秒)、Groq(4.95秒)の最初の回答トークンまでの時間が最短です。
- 料金では、CoreWeave(0.04)、DeepInfra(0.05)、Crusoe(0.07)の100万トークンあたりのブレンド料金が最安です。 プロバイダー間で料金に最大8.9倍の差があります。
- Cerebrasは出力速度が最も速く、遅延も最短で、性能が最も優れています。費用を最適化するなら、CoreWeaveの料金が最も競争力に優れています。
更新:本番環境のユースケースをより適切に反映するため、性能ベンチマークのデフォルトワークロードを入力10kトークンに変更しました。上部で別のワークロードを引き続き選択できます。
料金
料金:キャッシュヒット・入力・出力
料金:ブレンド料金
料金:キャッシュ割引
出力速度と料金
速度
出力速度(1秒あたりのトークン数)で測定
出力速度: gpt-oss-120b (Low)
遅延と出力速度
遅延
最初のトークンまでの時間(秒)で測定
最初の回答トークンまでの時間
エンドツーエンド応答時間
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
エンドツーエンド応答時間
主要な比較指標とAPI機能
131k | オープン | -- | -- | -- | -- | -- | |||
131k | オープン | -- | -- | -- | -- | -- | |||
128k | オープン | -- | 242 | 0.98 | 11.30 | 8.26 | |||
131k | オープン | -- | 727 | 1.73 | 5.17 | 2.75 | |||
131k | オープン | -- | 60 | 3.03 | 44.38 | 33.08 | |||
131k | オープン | -- | 185 | 0.38 | 13.91 | 10.82 | |||
131k | オープン | -- | 44 | 0.72 | 56.96 | 44.99 | |||
131k | オープン | -- | 45 | 1.29 | 56.89 | 44.48 | |||
131k | オープン | -- | 1,709 | 0.42 | 1.88 | 1.17 | |||
131k | オープン | -- | 328 | 0.87 | 8.49 | 6.10 | |||
128k | オープン | -- | -- | -- | -- | -- | |||
128k | オープン | -- | 211 | 0.21 | 12.06 | 9.48 | |||
131k | オープン | -- | 88 | 1.11 | 29.56 | 22.76 | |||
131k | オープン | -- | 143 | 0.80 | 18.24 | 13.95 | |||
131k | オープン | -- | -- | -- | -- | -- | |||
131k | オープン | -- | 472 | 0.77 | 6.06 | 4.23 | |||
131k | オープン | -- | 185 | 1.10 | 14.63 | 10.82 | |||
よくある質問
gpt-oss-120b (Low)のプロバイダーに関するよくある質問
gpt-oss-120b (Low)は17社のAPIプロバイダーで利用できます:Snowflake、Hyperbolic、Nebius Base、SambaNova、Google Vertex、Crusoe、DeepInfra、CoreWeave、Cerebras、Azure、Cloudflare、Baseten、Amazon、Parasail、Together AI、Groq、Novita。性能特性と料金はプロバイダーごとに異なります。
現在、ベンチマークと追跡の対象となる17社のAPIプロバイダーでgpt-oss-120b (Low)を利用できます。
gpt-oss-120b (Low)を提供する17社すべてが、構造化出力のJSONモードに対応しています。
17社中16社のプロバイダーがgpt-oss-120b (Low)の関数呼び出しに対応しています:Hyperbolic、Nebius Base、SambaNova、Google Vertex、Crusoe、DeepInfra、CoreWeave、Cerebras、Azure、Cloudflare、Baseten、Amazon、Parasail、Together AI、Groq、Novita。
gpt-oss-120b (Low)のプロバイダーを選ぶ際は、出力速度(高スループットが必要なタスク)、遅延(最初の応答の速さが必要な対話型アプリケーション)、料金(費用を重視するワークロード)、JSONモードや関数呼び出しなどのAPI機能を検討してください。
はい。インフラストラクチャの変更、負荷分散、アップデートにより、プロバイダーの性能は時間とともに変化する場合があります。すべてのプロバイダーを継続的にベンチマークし、「推移」グラフに過去の性能傾向を表示しています。
gpt-oss-120b (Low)の知能、能力、モダリティ、他のモデルとの比較については、モデル概要ページをご覧ください。 モデル概要を表示