从双雄到三强:Kimi K3暂停注册、DeepSeek V4满血回归,中国AI正在改写全球游戏规则

如果AI行业有"地震周"这种东西,那刚刚过去的这一周绝对是9.0级。

Kimi K3开源发布后72小时内,全球注册量飙升到服务器直接"扛不住"。Moonshot AI不得不在7月20日宣布暂停新用户注册,发公告说使用量"逼近现有算力容量极限",新注册名额将分批开放。这在AI行业是从未有过的事——一个开源模型,因为太受欢迎而被迫关门。一家中国AI创业公司做了一个比Fable 5更开放的产品,然后全世界的人涌进来,把它挤爆了。

而今天,7月21日,DeepSeek V4"满血版"预定发布。带着业界首创的"峰谷计费"模式——推理价格根据时段动态调整,V4 Pro百万输出token平时0.87美元高峰期1.74美元,V4 Flash便宜到0.28美元。"价格屠夫"回来了,而且这次带来的是一套整个AI行业从未见过的定价逻辑。

加上上周阿里Qwen3.8紧随K3发布——被The Verge称为"仅次于Fable 5的模型"——2026年7月的第三周,中国AI完成了从"追赶"到"推动"的核心转变。

这不是一个模型超越了另一个模型的简单故事。这是一个关于"规则被重写"的故事。

AI concept

先看Kimi K3这边发生了什么。

7月18日,Moonshot发布Kimi K3——2.8万亿参数,开源,在多个基准上正面挑战Anthropic Fable 5。The Verge发了一篇题为"China delivers a one-two punch to America's AI dominance"的头条,把K3和Qwen3.8并列称为中国AI对美国主导地位的"双重打击"。TechCrunch发文"Kimi: Threat or menace?",CNBC的标题更直接:"Chinese AI has leveled up"。

然后两天后,服务器撑不住了。

这不是"营销式告罄"——Moonshot根本没有准备好应对这种量级的需求。K3的开源意味着任何开发者都能下载模型在本地跑,但API调用依然要经过Moonshot自己的服务器,而Moonshot显然在发布前没有想到一个开源模型的API需求会炸到这种程度。

这个细节本身就足够说明问题:中国AI模型的API调用需求正在以一种连创始团队自己都猝不及防的速度增长。它不是缓慢爬坡,是瞬间爆发。就像K3在OpenRouter上的排名——发布几小时内就冲到了Top 3,把多个美国模型挤下榜单。全球开发者用脚投票,比任何跑分都诚实。

Anthropic的反应也耐人寻味。在K3发布后不到24小时,Anthropic宣布Fable 5从限量测试改为永久可用。这不是"我们本来就计划这么做"——这是被逼的。当一个开源的中国模型在多个基准上逼近你的付费旗舰,你再不把旗舰放开让大家用,就没人等了。市场上已经有几乎一样好、而且免费的选择。

DeepSeek V4今天回归:峰谷计费到底在下一盘什么棋

就在K3的爆炸式增长把算力焦虑推到台前的时候,DeepSeek V4"满血版"选在今天(7/21)发布。这不是巧合,是精准卡位。

V4的定价逻辑最值得细看。V4 Pro:百万输出token平时0.87美元,高峰1.74美元。V4 Flash:平时0.28美元,高峰0.56美元。这个定价结构在整个AI行业找不到任何先例——它不是固定价格,也不是简单的订阅制,而是像电力市场一样的动态计价。

这件事背后藏着一个更大的信号:AI推理正在从"奢侈品"变成"基础设施"。电力区分峰谷电价的原因是它已经成了社会的必需品——当一座城市的用电量可以精确预测、用户已经离不开电的时候,动态计价就比统一定价更能优化资源分配。DeepSeek现在把同一套逻辑套在AI推理上,说明它认为AI推理已经到了"谁都不能不用"的阶段。

而且峰谷计费天然利好"中国时区"。全球开发者的API调用高峰集中在美西时区的白天工作时间,对东亚用户来说正好是深夜——DeepSeek的低谷时段。一个北京团队在晚上12点跑批量评测,花的是Fable 5一个零头都不到的钱。这不是定价策略那么简单的商业手段,这是在用汇率之外另一种方式为中国开发者争取结构性优势。

V4性能方面,目前流出的首批评测显示整体接近Opus 4.8级别,编码能力直追GPT-5.6 Sol。虽然比Fable 5仍有一定差距,但Fable 5的定价是50美元/百万输出——V4 Flash是它的0.5%。性价比的多米诺骨牌,V4推倒了第一张。

Server room

阿里Qwen3.8:那个被低估的第三个玩家

当所有人的注意力都在Kimi和DeepSeek身上的时候,阿里Qwen3.8悄无声息地发布,然后悄无声息地在多个排行榜上拿到了"仅次于Fable 5"的位置。

它没有K3那样的爆炸式传播,也没有V4的商业创新故事,但它有一个K3和V4都没有的东西:阿里云。中国最大的公有云基础设施,意味着Qwen不需要像Kimi那般担心算力瓶颈,也不需要用峰谷计费来调度资源。只要阿里云在扩容,Qwen的API容量就在扩容。

这可能是未来格局中最被低估的变量。中国AI三强——Moonshot(颠覆性技术)、DeepSeek(极致性价比)、阿里(基础设施规模)——各自走了一条完全不同的路,但这三条路恰好覆盖了AI大模型商业化的所有维度。一家做标杆,一家做价格,一家做分发。三家组合起来,硅谷面对的就不是"一个中国公司追上来了"的问题,而是"一个完整的中国AI生态已经成型了"。

硅谷在回应,但回应本身暴露了问题

Anthropic宣布Fable 5永久可用。OpenAI下调ChatGPT Works额度门槛。微软CEO Satya Nadella公开批评Anthropic Fable 5"编辑控制过多"。Google被曝加速自研推理芯片。

但所有这些回应的共同点是——它们都是被动反应。没有人预料到中国AI会在同一周内用三个模型打出一套组合拳。美银分析师在K3发布后的研报中写了一段话值得反复读:"尽管存在持续的硬件限制,K3证明预训练规模扩展配合架构创新,仍能带来旗舰模型的阶跃式提升。"

翻译成白话就是:美国一直认为GPU禁售可以延缓中国AI进步,但事实证明,只要有足够聪明的架构设计,硬件限制并非不可逾越。K3用2.8万亿参数的体量证明了这个观点,V4用峰谷计费从商业侧给了它新一轮佐证,Qwen用云基础设施的规模效应封上了第三个口子。

开发者赢了

对普通人——特别是开发者——来说,这一周是最好的时代。

三个中国AI模型,一个打性能上限、一个打性价比下限、一个打基础设施规模。夹在两个美国旗舰(Fable 5和GPT-5.6 Sol)之间。选择权第一次真正回到了用户手里。深夜用V4 Flash跑批量评测把成本压到几乎为零,白天用K3写代码追平Fable 5的质量——两个月前这是科幻,今天这是标准操作。

The Verge问"美国正在失去AI主导权吗?"这个问题的答案不重要。真正的问题是:当AI模型从"顶尖实验室里的秘密武器"变成"谁都能下载、谁都能部署、谁都能用得起的公共资源",胜利的就不再是任何一个国家——胜利的是所有用它的人。

*文中所用图片来源于网络,仅供技术学习与交流。如权利人认为存在侵权,请联系我们,我们将在24小时内处理。*

posted @ 2026-07-21 09:42  老猿AI洞察  阅读(456)  评论(3)    收藏  举报