This model is deprecated. We only continue performance benchmarking for the default 10k input token workload. Results for other workloads are historical and no longer updated.
Kimi has launched a newer model, Kimi K3 (max). We suggest considering it instead.
For more information, see comparison of Kimi K3 (max) to other models and API provider benchmarks for Kimi K3 (max).
Análise de inteligência, desempenho e preço do Kimi K2.6
Resumo do modelo
Inteligência
Velocidade
Preço
Preço de acerto do cache
Verbosidade
Kimi K2.6 está entre os modelos líderes em inteligência, mas tem preço um pouco alto em comparação com outros modelos de pesos abertos de tamanho semelhante. Também é especialmente lento e muito verboso. O modelo aceita entrada em texto, imagem e vídeo, gera saída em texto e tem uma janela de contexto de 256k tokens.
Kimi K2.6 alcança 44 pontos no Artificial Analysis Intelligence Index, ficando bem acima da média entre os modelos comparáveis (mediana: 25). Na avaliação do Intelligence Index, gerou 170M tokens, um resultado muito verboso em comparação com a mediana de 100M.
O preço do Kimi K2.6 é de $0.95 por 1M de tokens de entrada (preço alto, mediana: $0.43) e $4.00 por 1M de tokens de saída (preço alto, mediana: $1.20). No total, a avaliação do Kimi K2.6 no Intelligence Index custou $840.64.
Com 39 tokens por segundo, Kimi K2.6 é especialmente lento (65).
| Raciocínio | Sim Esta página mostra a versão com raciocínio deste modelo. Também pode existir uma variante sem raciocínio. |
|---|---|
| Modalidade de entrada | Compatível com: texto, imagem e vídeo |
| Modalidade de saída | Compatível com: texto |
| Janela de contexto | 256k ~384 páginas A4 em fonte Arial tamanho 12 |
| Parâmetros totais | 1000B |
| Parâmetros ativos | 32B Número de parâmetros ativos por token durante a inferência |
| Licença | Modified MIT |
| Pesos do modelo | Hugging Face |
As métricas são comparadas com modelos da mesma classe:
- Modelos sem raciocínio → comparados apenas com outros modelos sem raciocínio
- Modelos de raciocínio → comparados com modelos com e sem raciocínio
- Modelos de pesos abertos → comparados apenas com outros modelos de pesos abertos da mesma classe de tamanho:
- Muito pequeno: ≤4B parâmetros
- Pequeno: 4B–40B parâmetros
- Médio: 40B–150B parâmetros
- Grande: >150B parâmetros
- Modelos proprietários → comparados com modelos proprietários e de pesos abertos da mesma faixa de preço, usando uma proporção combinada de 3:1 entre os preços de entrada e saída:
- <$0.15 por 1M de tokens
- $0.15–$1 por 1M de tokens
- >$1 por 1M de tokens
Destaques
Inteligência
Artificial Analysis Intelligence Index
Artificial Analysis Intelligence Index by Open Weights / Proprietary
Intelligence Evaluations
Agentic real-world work tasks, (Elo-500)/2000
Agentic tool use
Agentic coding & terminal use
Coding
Reasoning & knowledge
Scientific reasoning
Physics reasoning
Knowledge
1 - hallucination rate
Long context reasoning
Agentic knowledge work, Elo
Agentic SaaS workflows
Legal agentic work, criterion pass rate
Agentic business operations
Instruction following
Long-horizon agentic tasks
Kubernetes incident root-cause analysis
Visual reasoning
AA-Briefcase
AA-Briefcase Elo
AA-Omniscience
AA-Omniscience Index
Openness Index
Artificial Analysis Openness Index: Score
Comparações do Intelligence Index
Intelligence Index vs. Cost per Intelligence Index Task
Uso de tokens
Output Tokens per Intelligence Index Task
Custo
Cost per Intelligence Index Task
Cost to Run Artificial Analysis Intelligence Index
Pricing: Cache Hit, Input, and Output
Janela de contexto
Context Window
Velocidade
Medida pela velocidade de saída (tokens por segundo)
Output Speed
Time per Intelligence Index Task
Latência
Medida pelo tempo (segundos) até o primeiro token
Latency: Time To First Answer Token
Tempo de resposta de ponta a ponta
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
End-to-End Response Time
Tamanho do modelo (somente modelos de pesos abertos)
Model Size: Total and Active Parameters
Perguntas frequentes
Perguntas comuns sobre o Kimi K2.6
O Kimi K2.6 foi lançado em 20 de abril de 2026.
Kimi criou o Kimi K2.6.
Kimi K2.6 alcança 44 pontos no Artificial Analysis Intelligence Index, ficando bem acima da média entre outros modelos de pesos abertos de tamanho semelhante (mediana: 25).
Kimi K2.6 gera a saída a 38.7 tokens por segundo (com base na API de Kimi), um resultado na faixa inferior em comparação com outros modelos de pesos abertos de tamanho semelhante (mediana: 65.0 t/s).
Kimi K2.6 tem um tempo até o primeiro token (TTFT) de 2.80s (com base na API de Kimi), um resultado na faixa superior em comparação com outros modelos de pesos abertos de tamanho semelhante (mediana: 1.82s).
Kimi K2.6 custa $0.95 por 1M de tokens de entrada (um pouco acima da média, mediana: $0.58) e $4.00 por 1M de tokens de saída (na faixa superior, mediana: $2.20), com base na API de Kimi.
Kimi K2.6 custa $0.95 por 1M de tokens de entrada e $4.00 por 1M de tokens de saída (com base na API de Kimi). Considerando uma tarifa combinada (proporção de 7:2:1 entre acerto do cache, entrada e saída), o preço é de $0.70 por 1M de tokens. O preço pode variar conforme o provedor. Comparar preços dos provedores
Na avaliação do Intelligence Index, Kimi K2.6 gerou 170M tokens de saída, um resultado na faixa superior em comparação com outros modelos de pesos abertos de tamanho semelhante (mediana: 100M).
Sim, o Kimi K2.6 é um modelo de raciocínio. Ele usa reflexão prolongada ou raciocínio em cadeia para resolver problemas complexos antes de fornecer uma resposta.
Kimi K2.6 aceita entrada em texto, imagem e vídeo.
Kimi K2.6 permite saída em texto.
Sim, o Kimi K2.6 aceita imagens como entrada e pode analisá-las, descrevê-las e responder a perguntas sobre elas.
Sim, o Kimi K2.6 é multimodal. Ele consegue processar entrada em texto, imagem e vídeo e gerar saída em texto.
Kimi K2.6 tem uma janela de contexto de 260k tokens. Isso determina quanto texto e histórico da conversa o modelo consegue processar em uma única solicitação.
Sim, o Kimi K2.6 é um modelo de pesos abertos. Os pesos estão disponíveis publicamente e podem ser baixados para auto-hospedagem.
Kimi K2.6 tem 1 trilhões parâmetros (32 bilhões ativos).
Kimi K2.6 é um modelo de mistura de especialistas (MoE) com 1 trilhões parâmetros no total, mas apenas 32 bilhões parâmetros ativos são usados durante a inferência.
Kimi K2.6 foi lançado sob a licença Modified MIT. Essa licença permite o uso comercial. Ver licença
Kimi K2.6 alcança 44 pontos no Artificial Analysis Intelligence Index. Esse benchmark composto avalia os modelos em raciocínio, conhecimento, matemática e programação.
Sim, o Kimi K2.6 está disponível por API em 13 provedores. Comparar provedores de API
Kimi K2.6 está disponível em 13 provedores de API. Comparar provedores
