Kimi暂停C端新用户订阅,AI行业再次面临算力供给考验
7月19日晚,月之暗面Kimi发布通知称,由于当前算力资源紧张,即日起暂停C端新用户订阅,并将已有算力优先投入已订阅用户的服务,以保障现有订阅用户的相关权益不受影响。
根据Kimi方面的说明,自Kimi K3发布以来,用户请求量明显超过此前预估。过去48小时内,请求规模已经逼近现有计算集群的承载上限。为避免新增订阅进一步影响服务体验,Kimi决定暂时停止接受C端新用户订阅。
需要注意的是,此次调整针对的是C端新用户订阅,并不等于Kimi停止提供全部服务,也不代表已有订阅用户的权益被取消。Kimi表示,目前正在推进算力扩容。随着新增算力陆续到位,将逐步开放订阅名额,直至恢复正常订阅。
这一情况再次反映出,大模型产品面临的挑战已经不只是模型研发。模型发布后,如果短时间内出现大量用户请求,企业还需要处理服务器容量、芯片资源、网络带宽和推理成本等问题。即使模型本身已经完成训练,日常向用户提供回答同样会持续消耗计算资源。
大模型的使用过程通常以Token,也就是“词元”作为处理和计量单位。用户输入问题、模型理解上下文以及生成答案,都会产生Token消耗。若用户集中使用长文本、代码生成、文件分析等功能,单次请求所消耗的计算资源也会进一步增加。
中国信通院披露的数据显示,我国日均Token调用量已经从2024年初的约1000亿次,增长至2026年3月的140万亿次,两年增长超过千倍。这一变化说明,大模型正在从早期体验工具逐步进入办公、编程、客服和智能体等实际场景。
不过,用户调用量增长越快,对算力供给和服务稳定性的要求就越高。企业不仅要增加计算设备,还要优化模型推理效率、请求调度和不同用户之间的资源分配。
Kimi此次暂停C端新用户订阅,可以看作是在算力容量有限的情况下,优先保证已有用户体验的临时措施。后续何时全面恢复订阅,仍要以新算力的实际部署进度和Kimi官方通知为准。

浙公网安备 33010602011771号