DeepSeek降价没几天,小米MiMo V2.5也掀桌子了:国内AI大模型卷进“分厘时代”

DeepSeek降价没几天,小米MiMo V2.5也掀桌子了:国内AI大模型卷进“分厘时代”
最近几天,AI圈连爆重磅消息——

5月22日,DeepSeek官宣旗舰模型V4-Pro的API价格在2.5折优惠结束后不恢复了,直接永久降为原价的1/4。

仅仅过了五天,5月27日零点,小米MiMo官方也宣布,旗下MiMo-V2.5系列大模型API永久降价,最高降幅直接拉到99%

两连炸。国内的AI大模型厂商,这是彻底卷起来了。

DeepSeek:一记重锤,砸出全球最低价

先把目光放到DeepSeek身上。

5月22日,DeepSeek官方宣布:旗舰模型V4-Pro的2.5折优惠活动在5月31日结束后,不再恢复原价,而是正式将API价格永久调整为原定价的1/4

调整后是什么价格?

  • 输入(缓存命中):0.025元/百万Tokens
  • 输入(缓存未命中):3元/百万Tokens
  • 输出:6元/百万Tokens

这是什么概念?每百万Tokens输入只需2.5分钱。

在全球范围内,这个价格已经低到了“离谱”的程度。同样是国产大模型的Minimax M2.7,缓存读取价格约为0.06美元/百万Tokens(约合人民币0.43元),DeepSeek的价格比它还低超过一个数量级。

有第三方评估机构的数据更直接——在同等任务复杂度下,DeepSeek-V4-Pro的平均执行成本大约是OpenAI GPT-5.5的十分之一、Anthropic Claude Opus 4.7的十一分之一。

消息一出,社区炸了。网友的评论很有意思:“Codex、Claude定上限,DeepSeek定斩杀线——跟它持平没溢价,落后它就出局。”

还有人调侃DeepSeek的定价“说白了就是收个电费”。

行业涨价,它独降

这波降价之所以让人震惊,关键在于——它完全逆着行业大势来的。

2026年以来,全球AI大模型行业普遍在涨价。HBM(高带宽内存)价格半年暴涨超500%,高端GPU供不应求,推理端Token调用量激增。国内市场上,腾讯混元大模型输入价格最高涨幅达463%,智谱更是在数月内连续三次调价。

在几乎所有人都在涨价的时候,DeepSeek不仅不涨,反而直接把价格打到了地板价。背后的底气是什么?

核心在于技术降本。DeepSeek V4-Pro采用了自研的混合注意力架构,大幅压缩了KV缓存占用——在百万Token上下文场景下,单Token推理计算量降至前代的27%,KV缓存占用仅为原先的10%。再加上全流程适配华为昇腾算力,摆脱了对海外高端GPU的依赖,软硬件协同进一步摊薄了成本。

技术红利,让DeepSeek有了逆市降价的底气。

效果立竿见影

价格一降,数据马上就来了。

全球最权威的AI中转站之一OpenRouter数据显示,降价后DeepSeek V4-Flash模型的周调用量达到3.43万亿Token,首次登顶全球调用榜。这是DeepSeek系列模型历史上的第一次。

在AI大模型的世界里,OpenRouter的霸榜逻辑非常简单粗暴——在API够用的情况下,调用成本越低廉,调用总量排名就越高。 低价,就是硬通货。

小米MiMo V2.5:五天之后,再补一刀

DeepSeek的降价余波未平,小米就出手了。

5月27日零点,小米旗下MiMo大模型正式宣布对V2.5系列模型API进行永久性降价,全球同步生效。

这次降价有多狠?看几个数字:

  • MiMo-V2.5 Pro:输入缓存命中价格降至0.025元/百万Tokens,最高降幅99%;输出价格降至6元/百万Tokens,最高降幅86%
  • MiMo-V2.5:输入缓存命中价格降至0.02元/百万Tokens,最高降幅98%;输出价格降至2元/百万Tokens,最高降幅93%

注意看,MiMo-V2.5 Pro输入缓存命中的定价和DeepSeek V4-Pro一模一样,都是0.025元/百万Tokens——这不是巧合,这是直接对标。

而且小米还做了一件很贴心的事:不再区分上下文窗口长度,统一一口价。以前开发者用长上下文要多掏钱,现在统统一个价。

不止降价,还“加量”

除了API单价跳水,小米还同步升级了Token Plan计费体系。在价格不变的前提下,用户可用Token总量直接提升到原来的5到8倍

降价叠加加量,这波诚意可以说拉满了。

技术是降价的底气

和DeepSeek一样,小米的降价也不是“赔本赚吆喝”。

小米技术团队基于SGLang HiCache框架,完整实现了滑动窗口注意力机制,将KV缓存数据在GPU显存、CPU内存、SSD之间的搬运量降至优化前的近七分之一,同时将可缓存Token数量提升至优化前的近5倍

翻译成人话就是:推理效率大幅提升,单Token服务成本大幅下降。

此外,通过改进专家并行策略与输入长度分桶机制,集群的输入吞吐能力也进一步增强。

技术降本→成本摊薄→降价让利——这条逻辑链,在DeepSeek和小米身上都成立。

卷入“分厘时代”,大模型厂商都在拼什么?

把时间线拉长,你会发现这两次降价并非孤立事件。

2024年5月,字节跳动豆包率先打响价格战第一枪,定价0.0008元/千Token,较行业均价低99.3%。随后阿里云通义千问降价97%,百度两款主力模型直接免费,腾讯混元降幅最高达87.5%。

2026年4月,DeepSeek又在两天内两次降价,最终将V4 Pro输入缓存命中价格锁定在0.025元/百万Tokens。大模型API市场正式进入“分厘时代”。

从“元级计价”到“角级计价”再到“分厘计价”,整个行业只用了两年多时间。

涨价的归涨价,降价的归降价

但有意思的是,市场并没有一边倒地降价,而是出现了明显的两极分化

一边是DeepSeek和小米这种技术驱动型玩家,靠技术降本把价格打到最低;另一边是部分云厂商和模型公司,在算力成本压力下选择了涨价。

2026年以来,腾讯云、阿里云、百度智能云三大云服务商及智谱等头部模型公司已集体上调服务价格,部分涨幅超过400%。

涨价派的核心逻辑是:算力是硬通货,当成本持续攀升,维持低价不可持续。

降价派的核心逻辑则是:技术突破带来了真正的成本下降,低价可以换取更大规模的用户数据和生态份额,最终形成正向循环。

两条路线,各有各的道理。但一个事实是确定的:大模型行业已经从“拼参数”转向了“拼成本、拼落地”

留在牌桌上的玩家不多了

这场价格战,对创业公司来说尤其残酷。

当DeepSeek把价格打到“收个电费”的水平,没有技术护城河和成本优势的模型公司,生存空间被急剧压缩。

今年第一季度,已有超过10家AI应用初创公司停止运营或转型。“AI六小虎”中,零一万物停止了超大基模训练业务转向垂直应用,百川智能也扎进了更为聚焦的AI应用赛道。

资本和市场的目光正在快速向头部集中。DeepSeek首轮融资估值约450亿美元,Kimi完成20亿美元融资,阶跃星辰也在冲刺IPO——钱没有消失,只是换了个流向。

留在牌桌上、还能参与价格博弈的企业,已经越来越少了。

对开发者和用户意味着什么?

对于普通开发者和企业用户来说,这一波降价潮,是实实在在的利好。

一个开发者算过一笔账:现在的主流大模型,处理一本《三体》80万字的成本不到两块钱——还不够买一瓶农夫山泉。

在DeepSeek和小米的带动下,调用大模型的成本门槛正在被急速拉低。对于中小企业和个人开发者来说,“Token自由”正在成为现实。

但硬币也有另一面。大厂在利用价格优势加速市场洗牌,当独立模型公司因无力竞争退出或转型,市场的选择空间可能会收窄。

小米MiMo负责人罗福莉此前在社交媒体上曾将Token价格战比喻为“陷阱”,提醒大模型公司不应该盲目参与价格战。

价格战打到最后,看的是谁真正拥有技术壁垒和成本优势——能“降价又赚钱”的,才是最后的赢家。

写在最后

从DeepSeek永久降价到小米MiMo V2.5跟进,前后只隔了五天。

两个事件叠加在一起,释放了一个清晰的信号:国内大模型市场的定价体系正在被彻底重构。

过去那种靠高定价覆盖高昂算力成本的模式,正在被技术驱动的成本革命所取代。谁能把单Token服务成本压到更低,谁就能掌握定价权。

而对于普通用户和开发者来说,最好的时代可能才刚刚开始。毕竟,当AI大模型调用比买瓶水还便宜的时候,想象力的空间才真正被打开了。

📌 你怎么看这波大模型降价潮?欢迎在评论区聊聊~

posted @ 2026-05-27 09:42  丿似锦  阅读(89)  评论(0)    收藏  举报