gpt-oss-120b: inteligência, desempenho e preço do lançamento
Resumo do modelo
Verbosidade
O lançamento gpt-oss-120b oferece 2 modelos, cada um com diferentes características de inteligência, desempenho e preço. Abaixo, comparamos as principais métricas dos 2 modelos.
- Em inteligência, o principal modelo do gpt-oss-120b é gpt-oss-120b (High), com 12.
- Em velocidade de saída, o modelo mais rápido é gpt-oss-120b (Low), com 218 tokens/s.
- Em latência, gpt-oss-120b (Low), com 9,95 s oferece o menor tempo até o primeiro token de resposta.
- Em termos de preço, gpt-oss-120b (High), com $0.11 oferece o menor custo por tarefa.
| Raciocínio | Sim Esta página mostra a versão com raciocínio deste modelo. Também pode existir uma variante sem raciocínio. |
|---|---|
| Modalidade de entrada | Compatível com: texto |
| Modalidade de saída | Compatível com: texto |
| Data-limite do conhecimento | 31 de mai. de 2024 |
| Janela de contexto | 131k ~197 páginas A4 em fonte Arial tamanho 12 |
| Parâmetros totais | 117B |
| Parâmetros ativos | 5.1B Número de parâmetros ativos por token durante a inferência |
| Licença | Apache 2.0 |
| Pesos do modelo | Hugging Face |
As métricas são comparadas com modelos da mesma classe:
- Modelos sem raciocínio → comparados apenas com outros modelos sem raciocínio
- Modelos de raciocínio → comparados com modelos com e sem raciocínio
- Modelos de pesos abertos → comparados apenas com outros modelos de pesos abertos da mesma classe de tamanho:
- Muito pequeno: ≤4B parâmetros
- Pequeno: 4B–40B parâmetros
- Médio: 40B–150B parâmetros
- Grande: >150B parâmetros
- Modelos proprietários → comparados com modelos proprietários e de pesos abertos da mesma faixa de preço, usando uma proporção combinada de 3:1 entre os preços de entrada e saída:
- <$0.15 por 1M de tokens
- $0.15–$1 por 1M de tokens
- >$1 por 1M de tokens
Inteligência
Artificial Analysis Intelligence Index
Intelligence Index vs. custo por tarefa do Intelligence Index
Custo
Custo por tarefa do Intelligence Index
Velocidade e latência
Velocidade de saída
Pontuações de capacidades
Índices de capacidades
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Mais lançamentos de OpenAI
Mais detalhes
Pesos | Benchmarks de provedores | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| gpt-oss-120b (High) | 12 | 117B 5,1B ativos durante a inferência | 131k | US$ 0,2 | 196 | +14 | |||
| gpt-oss-120b (Low) | 10 | 117B 5,1B ativos durante a inferência | 131k | US$ 0,2 | 218 | +14 |