Análisis independiente de IA
Entiende el panorama de la IA para elegir el mejor modelo y proveedor para tu caso de uso
Destacados
Recomendador de modelos personalizado
Recibe recomendaciones personalizadas según tus prioridades de inteligencia, velocidad y costo
Explora agentes para trabajo general, programación, soporte al cliente y más
Compara agentes de IA por capacidades, precios y soporte de plataforma
Explora planes premium
Accede a datos de benchmarks ampliados, visualizaciones personalizadas, reportes sectoriales y más
Inteligencia
Inteligencia de los principales modelos de IA según nuestras evaluaciones independientes
Artificial Analysis Intelligence Index
Artificial Analysis Intelligence Index by Open Weights / Proprietary
Cost per Intelligence Index Task
Intelligence Index vs. Cost per Intelligence Index Task
Inteligencia de modelos de lenguaje de frontera a lo largo del tiempo
Rendimiento, costo y tiempo de ejecución de los principales agentes de programación en tareas integrales de ingeniería de software
Explorar el índice de agentes de programación de Artificial AnalysisÍndice de agentes de programación de Artificial Analysis
Rankings de imagen y video
Mejores modelos de nuestros rankings Image Arena y Video Arena, con intervalos de confianza del 95%
Ranking de texto a imagen
Rankings de voz
Mejores modelos de nuestras evaluaciones Text to Speech Arena, Speech to Text y Speech to Speech
Text to Speech Arena Leaderboard
Miden el rendimiento de modelos en capacidades e industrias específicas
Artificial Analysis Agentic Index
Intelligence Evaluations
Agentic real-world work tasks, (Elo-500)/2000
Agentic tool use
Agentic coding & terminal use
Coding
Reasoning & knowledge
Scientific reasoning
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Agentic knowledge work, Elo
Agentic SaaS workflows
Legal agentic work, criterion pass rate
Agentic business operations
Instruction following
Long-horizon agentic tasks
Kubernetes incident root-cause analysis
Visual reasoning
AA-Briefcase es una evaluación agéntica de vanguardia para trabajo cognitivo de largo plazo, que prueba agentes en flujos de trabajo empresariales realistas que requieren entregables como hojas de cálculo, presentaciones y memorandos
AA-Briefcase Elo
AA-Omniscience es un benchmark de conocimiento y alucinaciones que premia la precisión, penaliza las respuestas incorrectas y ofrece una vista completa de qué modelos producen resultados fiables en distintos dominios
Índice AA-Omniscience
GDPval-AA v2 evalúa modelos de IA en tareas reales de valor económico en una amplia gama de ocupaciones
GDPval-AA v2 Leaderboard
El índice de apertura de Artificial Analysis evalúa qué tan 'abiertos' son los modelos según su disponibilidad y transparencia en distintos componentes.
Artificial Analysis Openness Index: Components
Artificial Analysis Openness Index vs. Artificial Analysis Intelligence Index
Tokens de salida
Tokens de salida de los principales modelos de IA según nuestras evaluaciones independientes
Output Tokens per Intelligence Index Task
Precio y costo
Precios y costos reales de los principales modelos de IA según nuestras evaluaciones independientes
Cost per Intelligence Index Task
Cost to Run Artificial Analysis Intelligence Index
Pricing: Cache Hit, Input, and Output
Velocidad y latencia
Comparación del rendimiento de API de primera parte