小米大模型杀疯了!最高降 99%,API 进入“厘”时代,开发者白嫖指南来了

💥 就在昨天凌晨,雷军亲自下场官宣:小米 MiMo-V2.5 全系列 永久降价,缓存命中输入价格 暴跌 99%

641

每百万 Token 的输入成本直接压到 2.5 分钱(0.025 元),输出价格更是低到让友商沉默——MiMo-V2.5 标准版输出仅需 2 元/百万 Token,Pro 版也只要 6 元

更狠的是,小米还顺手做了一件事:取消上下文窗口分档计价,再也不用来回计算 256K 还是 1M 的账单了。


一、降价有多猛?一张表看明白

模型版本 输入(命中缓存) 输入(未命中) 输出 最高降幅
MiMo-V2.5 ¥0.020/M ¥1.00/M ¥2.00/M 98%
MiMo-V2.5-Pro ¥0.025/M ¥3.00/M ¥6.00/M 99%

换算成人话:处理一部《三体》三部曲(约 90 万字),缓存命中场景下只需几分钱


二、永久降价 + 套餐加量:Token Plan 直接起飞

Token Plan 月费套餐 价格不变,但 Credits 额度暴增 5~8 倍

套餐 价格 调整后 Credits
Lite ¥39 41 亿(原 0.6 亿)
Standard ¥99 110 亿(原 2 亿)
Pro ¥329 380 亿(原 7 亿)
Max ¥659 820 亿(原 16 亿)

⚠️ 所有仍在有效期内的 Token Plan 用户,Credits 额度已于 5 月 27 日零点 全量重置!官方还预告,已过期用户也将有“惊喜好礼”。


三、为什么要降?不是慈善,是技术突破

这次降价靠的不是芯片降价,而是 推理工程优化 带来的实质性突破:

  • 基于 SGLang HiCache 框架,KV Cache 数据搬运量降至优化前的 近 1/7
  • 可缓存 Token 量提升至原来的 近 5 倍
  • 专家并行策略 + 输入长度分桶优化,大幅提升集群吞吐

小米敢于喊出“永久性翻新价格体系”,底气来自底层工程能力。


四、对标 DeepSeek,国产大模型进入“成本定价”时代

MiMo-V2.5-Pro 的最终定价——缓存命中 0.025 元、未命中 3 元、输出 6 元——与 DeepSeek V4-Pro 刚刚敲定的永久价格 完全一致

这不是巧合。大模型 API 的定价逻辑,正在从“能力溢价”转向“成本导向”。谁的推理效率更高,谁就能把价格压得更低。国产大模型的价格战,已经从参数榜单打到了 推理框架和集群调度 的层面。


五、开源 + 1M 上下文 + 顶级 Agent 能力,这才是完全体

很多人不知道,MiMo-V2.5 系列早已 全面开源,支持商用部署和自由微调。MiMo-V2.5-Pro 拥有 1T 超大参数100 万 Token 上下文窗口,在通用智能体和复杂软件工程维度上,正面对标 Claude Opus 4.6、GPT-5.4 等国际顶尖模型。

如今价格打到“白菜价”,对于 AI Agent、代码助手、长文档处理、知识库问答 等场景来说,正是批量落地的最佳时机。


🎁 新用户专属福利

扫描下方二维码注册小米 MiMo 开放平台,在控制台侧边栏输入下方邀请码,即可 免费获得 ¥10 API 体验金,零成本体验 MiMo-V2.5 系列的顶级性能!

GXX44R

📋 邀请码:GXX44R
📍 入口:注册后进入控制台 → 左侧菜单栏「邀请码」输入框 → 填入 GXX44R → 额度即时到账

🔥 降价窗口刚开,现在入场就是最佳时机。用 MiMo-V2.5 搞出你的第一个爆款 AI 应用吧!


参考资料:小米 MiMo 官方公告、IT之家、观察者网、西部e网、站长之家等。
(本文含作者邀请码,通过该码注册新用户双方均可获得 ¥10 额度,感谢支持!)

posted @ 2026-05-28 10:59  Athenavi  阅读(83)  评论(0)    收藏  举报