小米大模型杀疯了!最高降 99%,API 进入“厘”时代,开发者白嫖指南来了
💥 就在昨天凌晨,雷军亲自下场官宣:小米 MiMo-V2.5 全系列 永久降价,缓存命中输入价格 暴跌 99%!

每百万 Token 的输入成本直接压到 2.5 分钱(0.025 元),输出价格更是低到让友商沉默——MiMo-V2.5 标准版输出仅需 2 元/百万 Token,Pro 版也只要 6 元。
更狠的是,小米还顺手做了一件事:取消上下文窗口分档计价,再也不用来回计算 256K 还是 1M 的账单了。
一、降价有多猛?一张表看明白
| 模型版本 | 输入(命中缓存) | 输入(未命中) | 输出 | 最高降幅 |
|---|---|---|---|---|
| MiMo-V2.5 | ¥0.020/M | ¥1.00/M | ¥2.00/M | 98% |
| MiMo-V2.5-Pro | ¥0.025/M | ¥3.00/M | ¥6.00/M | 99% |
换算成人话:处理一部《三体》三部曲(约 90 万字),缓存命中场景下只需几分钱。
二、永久降价 + 套餐加量:Token Plan 直接起飞
Token Plan 月费套餐 价格不变,但 Credits 额度暴增 5~8 倍:
| 套餐 | 价格 | 调整后 Credits |
|---|---|---|
| Lite | ¥39 | 41 亿(原 0.6 亿) |
| Standard | ¥99 | 110 亿(原 2 亿) |
| Pro | ¥329 | 380 亿(原 7 亿) |
| Max | ¥659 | 820 亿(原 16 亿) |
⚠️ 所有仍在有效期内的 Token Plan 用户,Credits 额度已于 5 月 27 日零点 全量重置!官方还预告,已过期用户也将有“惊喜好礼”。
三、为什么要降?不是慈善,是技术突破
这次降价靠的不是芯片降价,而是 推理工程优化 带来的实质性突破:
- 基于 SGLang HiCache 框架,KV Cache 数据搬运量降至优化前的 近 1/7
- 可缓存 Token 量提升至原来的 近 5 倍
- 专家并行策略 + 输入长度分桶优化,大幅提升集群吞吐
小米敢于喊出“永久性翻新价格体系”,底气来自底层工程能力。
四、对标 DeepSeek,国产大模型进入“成本定价”时代
MiMo-V2.5-Pro 的最终定价——缓存命中 0.025 元、未命中 3 元、输出 6 元——与 DeepSeek V4-Pro 刚刚敲定的永久价格 完全一致。
这不是巧合。大模型 API 的定价逻辑,正在从“能力溢价”转向“成本导向”。谁的推理效率更高,谁就能把价格压得更低。国产大模型的价格战,已经从参数榜单打到了 推理框架和集群调度 的层面。
五、开源 + 1M 上下文 + 顶级 Agent 能力,这才是完全体
很多人不知道,MiMo-V2.5 系列早已 全面开源,支持商用部署和自由微调。MiMo-V2.5-Pro 拥有 1T 超大参数、100 万 Token 上下文窗口,在通用智能体和复杂软件工程维度上,正面对标 Claude Opus 4.6、GPT-5.4 等国际顶尖模型。
如今价格打到“白菜价”,对于 AI Agent、代码助手、长文档处理、知识库问答 等场景来说,正是批量落地的最佳时机。
🎁 新用户专属福利
扫描下方二维码注册小米 MiMo 开放平台,在控制台侧边栏输入下方邀请码,即可 免费获得 ¥10 API 体验金,零成本体验 MiMo-V2.5 系列的顶级性能!

📋 邀请码:GXX44R
📍 入口:注册后进入控制台 → 左侧菜单栏「邀请码」输入框 → 填入 GXX44R → 额度即时到账
🔥 降价窗口刚开,现在入场就是最佳时机。用 MiMo-V2.5 搞出你的第一个爆款 AI 应用吧!
参考资料:小米 MiMo 官方公告、IT之家、观察者网、西部e网、站长之家等。
(本文含作者邀请码,通过该码注册新用户双方均可获得 ¥10 额度,感谢支持!)
本文来自博客园,作者:Athenavi,转载请注明原文链接:https://www.cnblogs.com/Athenavi/p/20197447

浙公网安备 33010602011771号