最后更新:2026-07-20 · 在 GitHub 报告过期数据
MiMo API Token 成本计算器
实时估算小米 MiMo V2.5-Pro 和 V2.5 标准版费用 — 带缓存命中率滑块,对比 Claude Opus 4.5、Claude Haiku 3.5、GPT-4o mini、DeepSeek V4 Pro、Qwen3 Max。无需注册,浏览器内运行。
$0.45
≈ ¥3.24 人民币 / 每日
≈ $13.50 / 月 · $162 / 年(按当前规模)
横向对比:相同工作负载下主流 API
列表价截至 2026 年 7 月 20 日。不包含批量折扣、批量 API 价、厂商特定缓存细节。MiMo 行用上方滑块的缓存命中率;竞品行输入全部按列表价计。
| 厂商 | 模型 | 列表输入 / 1M | 列表输出 / 1M | 每日费用 | vs MiMo |
|---|
开始使用 MiMo API
- 官方直供:platform.xiaomimimo.com — V2.5 标准版和 V2.5-Pro 公开 API
- OpenRouter(推荐原型阶段):openrouter.ai/models?q=XiaomiMiMo — 一个 key 跑所有变体,OpenAI 兼容
- HuggingFace:huggingface.co/XiaomiMiMo — 开源权重 + Inference Endpoints + Pro 版 SLA
- 自托管:MiMo-7B INT4 量化(3.5 GB)可跑在手机、智能音箱、车机 — 单 Token 零成本
FAQ
MiMo API 每百万 Token 多少钱?
截至 2026 年 7 月,MiMo-V2.5-Pro 列表价 $0.42/M 输入 + $0.83/M 输出,缓存命中输入 $0.0035/M(较 2025 年发布价降 99%)。MiMo-V2.5 标准版 $0.14 输入 / $0.28 输出列表价,缓存命中输入 $0.0028/M。V2-Flash 已于 2026-06-30 随 V2 全系列下线。MiMo-7B 在 MIT 开源协议下完全免费。看完整定价中心 →
什么是缓存命中率,怎么估?
缓存命中率是指能从 prompt 缓存中受益的输入 token 占比。请求时,API 服务端把你的 prompt 前缀与已缓存 token 匹配,匹配上的按缓存命中价计费。生产参考:
- 单次摘要 / RAG(无重复 prompt):0-20%
- 多轮对话:50-80%(大部分输入是历史消息)
- 带持久 system prompt + 工具文档的智能体:70-95%
- 固定文件语料库上的代码审查:80-95%
MiMo 比 Claude Opus 4.5 便宜吗?
便宜。MiMo-V2.5-Pro 列表输入比 Claude Opus 4.5 便宜 约 97%($0.42 vs $15.00/M),缓存命中输入便宜 约 99%($0.0035/M)。对编码智能体和长上下文工作负载,差距更大——因为 MiMo 的 1M 上下文窗口无需切分文档。
在哪买 MiMo API?
三个官方渠道:(1) 小米 MiMo 平台,(2) OpenRouter,(3) HuggingFace Pro。三家都暴露 OpenAI 兼容端点。
Token 怎么算?
MiMo 1 Token ≈ 0.75 个英文单词 ≈ 1.5 个中文字符(BPE tokenizer)。计算器默认 3:1 输入输出比,仅作为聊天负载的初始估算;生产规划请用你的实际 Token 数。
这个计算器准确吗?
价格取自官方定价页,反映 2026 年 7 月 20 日的列表价。批量折扣、批量 API 折扣、厂商特定缓存细节不包含。关键预算场景请以厂商定价页为准。
相关页面
- MiMo 定价中心 — 完整 V2.5 阵容定价 + 5 家竞品对比
- MiMo vs DeepSeek — 最热门横评
- MiMo vs Claude Haiku — 预算前沿模型对比
- MiMo-V2.5 系列深度 — 架构、基准、部署
- 基准研究 — SWE-Bench、AIME、MMLU 分数
非官方社区资源,与小米公司无关联。价格最后于 2026 年 7 月 20 日根据 2026-05-27 官方公告和各家定价页核对。计算器完全在浏览器内运行 — 不会向我们的服务器发送任何输入。