此模型已弃用。我们仅继续对默认的 10k 输入 token 工作负载进行性能测试。其他工作负载的结果为历史数据,不再更新。
Xiaomi 已推出更新版本 MiMo-V2-Flash (Feb 2026)。我们建议考虑使用该版本。
MiMo-V2-Flash (Non-reasoning) API 服务商基准测试与分析
本分析旨在帮助你根据使用场景,选择 MiMo-V2-Flash (Non-reasoning) 的最佳 API 服务商。
速度最快
输出速度
共 0 家服务商
延迟最低
首 Token 延迟
共 0 家服务商
价格最低
每 100 万 token 的混合价格
共 0 家服务商
目前没有可用的 MiMo-V2-Flash (non-reasoning) API 服务商。
该模型暂无服务商基准测试数据。
有关模型详情及其与其他模型的智能比较,请参阅 MiMo-V2-Flash (Non-reasoning) 的模型页面。
价格
价格:缓存命中、输入和输出
Price (USD per M Tokens) · Lower is better · 10,000 input tokens
No data available
价格:混合价格
Blended at 7:2:1 (cache-input-output) · USD per 1M tokens (blended) · Lower is better
No data available
输出速度与价格
Blended at 7:2:1 (cache-input-output) · Output speed: output tokens per second · USD per 1M tokens (blended)
Most attractive quadrant
No data available
速度
按输出速度(每秒 token 数)衡量
输出速度: MiMo-V2-Flash (Non-reasoning)
输出速度:每秒输出 token 数 · 10,000 input tokens
No data available
延迟与输出速度
Latency: seconds to first token received · Output speed: output tokens per second · 10,000 input tokens
Most attractive quadrant
No data available
延迟
按首 Token 延迟(秒)衡量
首 Token 延迟
Seconds to first token received · Lower is better · 10,000 input tokens
No data available
端到端响应时间
Seconds to output 500 tokens, calculated based on time to first token, 'thinking' time for reasoning models, and output speed
端到端响应时间
Seconds to output 500 tokens, including reasoning model 'thinking' time · Lower is better · 10,000 input tokens
No data available
关键比较指标与 API 功能
| No results. | |||||||||
常见问题
关于 MiMo-V2-Flash (Non-reasoning) 服务商的常见问题
目前我们进行基准测试的 API 服务商均未提供 MiMo-V2-Flash (Non-reasoning)。该模型为开放权重模型,可以自行托管。