Todos los lanzamientos

Herramienta de comparación de lanzamientos

Compara hasta cinco lanzamientos de modelos lado a lado, con todas las variantes de cada uno, en inteligencia, precios, velocidad de salida, latencia, ventana de contexto y más.

Para más detalles sobre cómo medimos y evaluamos modelos, consulta nuestra página de metodología.

Playground de modelos

Lanzamientos comparados

Claude Opus 5.5 (max with fallback)Claude Opus 5.5 (xhigh with fallback)Claude Opus 5.5 (high with fallback)GPT-6 Astra (max)GPT-6 Astra (xhigh)Claude Opus 5.5 (medium with fallback)GPT-6 Astra (high)GPT-6 Astra (medium)GPT-6 Astra (low)Claude Opus 5.5 (low with fallback)
Índice de Inteligencia
58
56
54
53
52
51
51
50
46
42
Finanzas y contabilidad
61
58
56
55
54
54
53
52
49
46
Estrategia y operaciones
64
62
59
57
57
57
55
54
50
48
Jurídico
63
61
59
59
58
57
58
57
53
52
Salud y medicina
61
--
--
52
--
--
--
--
--
--
Costo por tareaUSD
$5.98
$3.46
$1.82
$3.26
$2.31
$1.34
$1.73
$1.54
$0.82
$0.55
Velocidad de salidaTokens/s
92
79
72
59
55
73
53
51
51
71
Tiempo hasta el primer tokens
710,36
147,01
34,40
276,50
142,98
26,57
67,00
4,50
2,65
4,50
Ventana de contexto
1M
1M
1M
1M
1M
1M
1M
1M
1M
1M
Creador
Anthropic
Anthropic
Anthropic
OpenAI
OpenAI
Anthropic
OpenAI
OpenAI
OpenAI
Anthropic
Licencia
Propietario
Propietario
Propietario
Propietario
Propietario
Propietario
Propietario
Propietario
Propietario
Propietario
Modalidad de entrada

Admite: texto e imágenes

Admite: texto e imágenes

Admite: texto e imágenes

Admite: texto e imágenes

Admite: texto e imágenes

Admite: texto e imágenes

Admite: texto e imágenes

Admite: texto e imágenes

Admite: texto e imágenes

Admite: texto e imágenes

Modalidad de salida

Admite: texto

Admite: texto

Admite: texto

Admite: texto

Admite: texto

Admite: texto

Admite: texto

Admite: texto

Admite: texto

Admite: texto

Proveedores
Anthropic
Anthropic
Anthropic
Microsoft AzureOpenAIAmazon Bedrock
OpenAI
Anthropic
OpenAI
OpenAI
Microsoft AzureOpenAI
AnthropicAmazon BedrockGoogle
Updated
Artificial Analysis Intelligence Index · Higher is better
Output tokens per second · Higher is better
Weighted average cost (USD) per Intelligence Index task · Lower is better

Inteligencia

Índice de inteligencia de Artificial Analysis

Artificial Analysis Intelligence Index v4.3.2 incorporates 10 evaluations: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1
Not publicly available

Índice de Inteligencia vs. costo por tarea del Índice de Inteligencia

Artificial Analysis Intelligence Index · Weighted average cost (USD) per Artificial Analysis Intelligence Index task
Most attractive quadrant
Claude Opus 5.5
GPT-6 Astra
Pareto line

Costo por tarea (USD, escala logarítmica)

Costo

Costo por tarea del Índice de Inteligencia

Weighted average cost (USD) per Artificial Analysis Intelligence Index task, segmented by token type. Lower is better
Not publicly available

Velocidad y latencia

Velocidad de salida

Output tokens per second · Higher is better

Puntuaciones de capacidades

Índices de capacidades

Mide el rendimiento de los modelos en capacidades e industrias específicas
Índice de finanzas y contabilidad

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Índice de estrategia y operaciones

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, AutomationBench-AA, AA-LCR v1.1, GDP.pdf · Higher is better

Índice jurídico

Incorporates 7 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, Humanity's Last Exam, AA-LCR v1.1, GDP.pdf, AutomationBench-AA · Higher is better

Índice de salud y medicina

Incorporates 6 evaluations: AA-Omniscience, GDPval-AA v2.1, AA-Briefcase v1.1, MLCR-AA, Humanity's Last Exam, AutomationBench-AA · Higher is better

Índice de ingeniería

Incorporates 6 evaluations: AA-Omniscience, Humanity's Last Exam, CritPt, GDPval-AA v2.1, AA-Briefcase v1.1, Terminal-Bench 4.0 · Higher is better

Índice de economía

Incorporates 5 evaluations: AA-Omniscience, Humanity's Last Exam, GDPval-AA v2.1, AA-Briefcase v1.1, AA-LCR v1.1 · Higher is better