问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年7月19日深夜,国内大模型产品Kimi发布公告称,因过去48小时用户请求量大幅超出预期,现有算力集群接近承载极限,即日起暂停C端新用户订阅。本次调整期间Kimi将优先保障现有订阅用户权益,全速推进算力集群扩容,同时后续将对新用户权益进行拆分,实现算力资源更精准匹配。
7月19日深夜,不少准备开通Kimi付费订阅的用户发现,官方订阅入口已经临时关闭,相关公告很快在AI用户社群、职场社交平台刷屏。作为国内最早主打长文本处理能力的大模型产品,Kimi的用户规模近半年来始终保持高速增长,本次突然暂停新订阅也被不少业内人士视为大模型C端爆发期算力缺口的典型信号。
根据Kimi官方披露的信息,此次暂停新订阅的直接诱因是过去48小时用户请求量大幅超出此前预估,现有算力集群已经逼近承载极限。为了避免服务出现卡顿、响应延迟等影响体验的问题,团队最终决定暂时切断新用户订阅入口,将所有算力资源向现有订阅用户倾斜,优先保障现有订阅用户的服务稳定性。
事实上,Kimi的用户增长并非个例。2026年上半年,国内C端AI工具的付费渗透率持续攀升,不少用户已经养成了用大模型处理文档、撰写方案、生成代码的日常习惯,峰值时段的请求量往往是平日的3-5倍,对大模型服务商的算力弹性供给能力提出了极高要求。
除了全速推进算力集群扩容之外,Kimi也同步公布了长期的算力优化方案:后续恢复新订阅后,将对用户权益进行拆分,实行“Kimi主权益”和“Kimi Code权益”分别管理的模式。
据了解,Kimi主权益将覆盖网页端、移动端、企业协作工具Kimi Work等全场景的通用对话、长文档处理需求,Kimi Code权益则专门面向代码生成、调试等专业开发场景。这种拆分模式本质上是对不同算力消耗的需求进行分层调度,避免普通用户的通用请求和开发者的高算力代码请求抢占资源,能够在现有算力条件下大幅提升服务的整体稳定性。
此次Kimi暂停新订阅的事件,也将大模型行业普遍面临的算力焦虑摆到了台面上。随着多模态交互、实时推理等功能的普及,大模型单次请求的算力消耗还在持续上升,仅2026年上半年,国内头部大模型服务商的算力采购规模就已经超过了2025年全年的总和。
业内人士指出,未来算力的竞争将不再是单纯的采购规模比拼,而是“采购-调度-分配”全链条的效率竞争。如何通过权益分层、动态调度等方式最大化现有算力的使用效率,同时快速扩容算力集群应对爆发式需求,将成为未来1-2年大模型服务商比拼的核心能力。
Kimi官方表示,目前扩容工作已经在全速推进,待新增算力陆续部署到位后,将逐步放开新用户订阅名额,直至完全恢复正常服务。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。