Claude 4.1 Opus: inteligência, desempenho e preço do lançamento
Provedores disponíveis
Resumo do modelo
InteligênciaUpdated
* Estimado
Verbosidade
O lançamento Claude 4.1 Opus oferece 2 modelos, cada um com diferentes características de inteligência, desempenho e preço. Abaixo, comparamos as principais métricas dos 2 modelos.
- Em inteligência, o principal modelo do Claude 4.1 Opus é Claude 4.1 Opus (Reasoning), com 23 (estimativa).
| Modalidade de entrada | Compatível com: texto e imagem |
|---|---|
| Modalidade de saída | Compatível com: texto |
| Data-limite do conhecimento | 1 de mar. de 2025 |
| Janela de contexto | 200k ~300 páginas A4 em fonte Arial tamanho 12 |
As métricas são comparadas com modelos da mesma classe:
- Modelos sem raciocínio → comparados apenas com outros modelos sem raciocínio
- Modelos de raciocínio → comparados com modelos com e sem raciocínio
- Modelos de pesos abertos → comparados apenas com outros modelos de pesos abertos da mesma classe de tamanho:
- Muito pequeno: ≤4B parâmetros
- Pequeno: 4B–40B parâmetros
- Médio: 40B–150B parâmetros
- Grande: >150B parâmetros
- Modelos proprietários → comparados com modelos proprietários e de pesos abertos da mesma faixa de preço, usando uma proporção combinada de 3:1 entre os preços de entrada e saída:
- <$0.15 por 1M de tokens
- $0.15–$1 por 1M de tokens
- >$1 por 1M de tokens
Inteligência
Artificial Analysis Intelligence Index
Intelligence Index vs. custo por tarefa do Intelligence Index
Custo
Custo por tarefa do Intelligence Index
Velocidade e latência
Velocidade de saída
Pontuações de capacidades
Índices de capacidades
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better
Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better
Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better
Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better
Mais lançamentos de Anthropic
Mais detalhes
Pesos | Benchmarks de provedores | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| Claude 4.1 Opus (Reasoning) | 23 | - | 200k | US$ 11,6 | - | Não disponível | |||
| Claude 4.1 Opus (Non-reasoning) | 19 | - | 200k | US$ 11,6 | - | Não disponível |