Análise independente de IA
Entenda o cenário da IA para escolher o melhor modelo e provedor para seu caso de uso
Destaques
Recomendação personalizada de modelos
Receba recomendações personalizadas com base em suas prioridades de inteligência, velocidade e custo
Explore agentes para tarefas gerais, programação, atendimento ao cliente e muito mais.
Compare agentes de IA por capacidades, preços e compatibilidade com plataformas
Explore os planos Premium
Acesse dados ampliados de benchmarks, visualizações personalizadas, relatórios setoriais e muito mais
Inteligência
Inteligência dos principais modelos de IA com base em nossas avaliações independentes
Artificial Analysis Intelligence Index
Artificial Analysis Intelligence Index by Open Weights / Proprietary
Cost per Intelligence Index Task
Intelligence Index vs. Cost per Intelligence Index Task
Inteligência dos modelos de linguagem de fronteira ao longo do tempo
Desempenho, custo e tempo de execução dos principais agentes de programação em tarefas de engenharia de software de ponta a ponta
Artificial Analysis Coding Agent Index
Imagem e vídeo
Principais modelos dos rankings da Image Arena e da Video Arena, com intervalos de confiança de 95%
Ranking de texto para imagem
Fala
Principais modelos da Arena de Texto para Fala e das avaliações de fala para texto e fala para fala
Text to Speech Arena Leaderboard
Mede o desempenho dos modelos em capacidades e setores específicos
Artificial Analysis Agentic Index
Intelligence Evaluations
Agentic real-world work tasks, (Elo-500)/2000
Agentic tool use
Agentic coding & terminal use
Coding
Reasoning & knowledge
Scientific reasoning
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Agentic knowledge work, Elo
Agentic SaaS workflows
Legal agentic work, criterion pass rate
Agentic business operations
Instruction following
Long-horizon agentic tasks
Kubernetes incident root-cause analysis
Visual reasoning
AA-Briefcase
O AA-Briefcase é uma avaliação agentiva avançada voltada para tarefas de conhecimento de longo prazo. Ela testa agentes em fluxos de trabalho empresariais realistas, que exigem a produção de entregáveis como planilhas, apresentações e memorandos.
AA-Briefcase Elo
AA-Omniscience
O AA-Omniscience é um benchmark de conhecimento e alucinações que recompensa a acurácia, penaliza palpites errados e oferece uma visão abrangente de quais modelos produzem resultados factualmente confiáveis em diferentes áreas
AA-Omniscience Index
GDPval-AA v2
O GDPval-AA v2 avalia modelos de IA em tarefas reais e economicamente relevantes de uma ampla variedade de profissões
GDPval-AA v2 Leaderboard
O Artificial Analysis Openness Index avalia quanto os modelos são 'abertos' com base em sua disponibilidade e na transparência de diferentes componentes.
Artificial Analysis Openness Index: Components
Artificial Analysis Openness Index vs. Artificial Analysis Intelligence Index
Tokens de saída
Tokens de saída dos principais modelos de IA com base em nossas avaliações independentes
Output Tokens per Intelligence Index Task
Custo
Preços e custos reais dos principais modelos de IA com base em nossas avaliações independentes
Cost per Intelligence Index Task
Cost to Run Artificial Analysis Intelligence Index
Pricing: Cache Hit, Input, and Output
Velocidade e latência
Comparação do desempenho das APIs oficiais