最后更新:2026-07-20 · 在 GitHub 报告过期数据

MiMo API Token 成本计算器

实时估算小米 MiMo V2.5-Pro 和 V2.5 标准版费用 — 带缓存命中率滑块,对比 Claude Opus 4.5、Claude Haiku 3.5、GPT-4o mini、DeepSeek V4 Pro、Qwen3 Max。无需注册,浏览器内运行。

为什么缓存命中滑块重要:MiMo 的 $0.0035/M 缓存命中输入价(V2.5-Pro,较发布价降 99%)意味着重复发送同一前缀的负载(system prompt、RAG 文档、聊天历史)缓存部分基本免费。把滑块拖到 70-90% 模拟典型生产智能体负载的真实成本。
仅 MiMo 生效:0% = 纯列表输入(V2.5-Pro ¥3/M),100% = 纯缓存命中输入(¥0.025/M)。Claude / GPT / DeepSeek / Qwen 全部按列表价计算输入。
每日估算费用(MiMo)

$0.45

≈ ¥3.24 人民币 / 每日

≈ $13.50 / 月 · $162 / 年(按当前规模)

横向对比:相同工作负载下主流 API

列表价截至 2026 年 7 月 20 日。不包含批量折扣、批量 API 价、厂商特定缓存细节。MiMo 行用上方滑块的缓存命中率;竞品行输入全部按列表价计。

厂商 模型 列表输入 / 1M 列表输出 / 1M 每日费用 vs MiMo

开始使用 MiMo API

FAQ

MiMo API 每百万 Token 多少钱?

截至 2026 年 7 月,MiMo-V2.5-Pro 列表价 $0.42/M 输入 + $0.83/M 输出,缓存命中输入 $0.0035/M(较 2025 年发布价降 99%)。MiMo-V2.5 标准版 $0.14 输入 / $0.28 输出列表价,缓存命中输入 $0.0028/M。V2-Flash 已于 2026-06-30 随 V2 全系列下线。MiMo-7B 在 MIT 开源协议下完全免费。看完整定价中心 →

什么是缓存命中率,怎么估?

缓存命中率是指能从 prompt 缓存中受益的输入 token 占比。请求时,API 服务端把你的 prompt 前缀与已缓存 token 匹配,匹配上的按缓存命中价计费。生产参考:

  • 单次摘要 / RAG(无重复 prompt):0-20%
  • 多轮对话:50-80%(大部分输入是历史消息)
  • 带持久 system prompt + 工具文档的智能体:70-95%
  • 固定文件语料库上的代码审查:80-95%
MiMo 比 Claude Opus 4.5 便宜吗?

便宜。MiMo-V2.5-Pro 列表输入比 Claude Opus 4.5 便宜 约 97%($0.42 vs $15.00/M),缓存命中输入便宜 约 99%($0.0035/M)。对编码智能体和长上下文工作负载,差距更大——因为 MiMo 的 1M 上下文窗口无需切分文档。

在哪买 MiMo API?

三个官方渠道:(1) 小米 MiMo 平台,(2) OpenRouter,(3) HuggingFace Pro。三家都暴露 OpenAI 兼容端点。

Token 怎么算?

MiMo 1 Token ≈ 0.75 个英文单词 ≈ 1.5 个中文字符(BPE tokenizer)。计算器默认 3:1 输入输出比,仅作为聊天负载的初始估算;生产规划请用你的实际 Token 数。

这个计算器准确吗?

价格取自官方定价页,反映 2026 年 7 月 20 日的列表价。批量折扣、批量 API 折扣、厂商特定缓存细节不包含。关键预算场景请以厂商定价页为准。

相关页面

非官方社区资源,与小米公司无关联。价格最后于 2026 年 7 月 20 日根据 2026-05-27 官方公告和各家定价页核对。计算器完全在浏览器内运行 — 不会向我们的服务器发送任何输入。