Este modelo está obsoleto. Continuamos medindo o desempenho apenas para a carga padrão de 10 mil tokens de entrada. Os resultados de outras cargas são históricos e não são mais atualizados.
NVIDIA lançou uma versão mais recente, Nemotron 3 Super 120B A12B. Sugerimos considerá-la como alternativa.
Llama Nemotron Super 49B v1.5 (Non-reasoning) Benchmarking e análise de provedores de API
Esta análise ajuda você a escolher o melhor provedor de API de Llama Nemotron Super 49B v1.5 (Non-reasoning) para seu caso de uso.
Mais rápido
Velocidade de saída
0 provedor no total
Menor latência
Tempo até o primeiro token
0 provedor no total
Menor preço
Preço combinado (por 1M de tokens)
0 provedor no total
Nenhum provedor de API está disponível atualmente para o Llama Nemotron Super 49B v1.5 (non-reasoning).
Consulte a página do modelo Llama Nemotron Super 49B v1.5 (Non-reasoning) para ver detalhes do modelo e comparar sua inteligência com a de outros modelos.
Preços
Preços: acertos de cache, entrada e saída
Preços: Preço combinado
Velocidade de saída vs. preço
Velocidade
Medida pela velocidade de saída (tokens por segundo)
Velocidade de saída: Llama Nemotron Super 49B v1.5 (Non-reasoning)
Latência vs. velocidade de saída
Latência
Medida pelo tempo (segundos) até o primeiro token
Tempo até o primeiro token
Tempo de resposta de ponta a ponta
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
Tempo de resposta de ponta a ponta
Principais métricas de comparação e recursos da API
| No results. | |||||||||
Perguntas frequentes
Perguntas comuns sobre os provedores do Llama Nemotron Super 49B v1.5 (Non-reasoning)
Llama Nemotron Super 49B v1.5 (Non-reasoning) não está disponível atualmente em nenhum provedor de API que avaliamos. Como é um modelo de pesos abertos, ele pode ser auto-hospedado.