Calculadora de preços de LLMs

Calcule e compare os preços de diferentes LLMs. Escolha entre cálculos baseados em tokens ou prompts para estimar seus custos.

Estima os custos de aplicações típicas de IA conversacional com simultaneidade moderada, como atendimento ao cliente, recuperação de informações e cenários de assistência geral.

Tokens de entrada1,000

Mensagem do usuário + histórico da conversa por turno.

Tokens de resposta2,000

Resposta do chatbot por turno.

Tokens de raciocínio1,000

Raciocínio/processo de pensamento do chatbot por turno.

Chamadas à API10,000

Simulação de uma carga moderada de usuários simultâneos. Cada chamada à API representa um único turno em uma conversa de 8 a 10 mensagens.

Adequado para estimar os custos do desenvolvimento de recursos quando as respostas exigem uma compreensão moderada do contexto. Os valores exibidos correspondem a 1.000 chamadas à API.

Tokens de entrada8,000

Contexto relevante da base de código, especificações da API e principais requisitos.

Tokens de resposta1,000

Alterações de código direcionadas, testes unitários específicos e atualizações pontuais da documentação.

Tokens de raciocínio2,500

Processo de pensamento do modelo para entender o contexto do código, identificar pontos de integração e planejar as alterações.

Chamadas à API1,000

Simulação de um fluxo iterativo de desenvolvimento.

Representa o processamento de documentos muito extensos, semelhante a um livro de 200 páginas ou um manual jurídico abrangente.

Tokens de entrada300,000

Um livro de 200 páginas ou um manual jurídico abrangente.

Tokens de resposta30,000

Um resumo detalhado, as principais conclusões ou uma análise estruturada do documento.

Tokens de raciocínio0

Sem raciocínio neste caso de uso.

Chamadas à API100

Processamento de vários documentos extensos ao longo do tempo.

Somente modelos de raciocínio