深夜十一点,Kimi突然发布一则紧急公告,迅速引发AI圈用户广泛关注——7月19日深夜,Kimi宣布暂停面向C端用户的新增订阅服务,原因在于用户请求量激增远超预期,现有算力集群已接近承载极限,团队决定立即启动算力扩容方案。
具体而言,过去48小时内,用户请求量大幅超过预期水平,算力资源已逼近集群最大承载能力的临界点。为避免影响老用户的服务体验,Kimi优先调配现有算力,全力保障已订阅用户的权益不受损害;与此同时,团队正加速推进扩容工作,待新增算力逐步到位后,再有序开放新订阅名额,直至恢复正常服务状态。
在订阅体系方面,Kimi还透露了一项重要调整:未来新用户的权益将进行拆分,将“Kimi主权益”与“Kimi Code权益”分开管理。主权益涵盖Kimi Web、Kimi APP以及Kimi Work等产品,而Kimi Code则专注于代码相关场景。这一举措使算力资源能够更精准地匹配不同应用场景,从而提升整体服务的稳定性。
此次暂停新增订阅,实际上折射出一个更深层次的问题:随着AI应用快速增长,模型服务商正面临严峻的算力供给压力。在大模型应用规模持续扩张的背景下,算力基础设施、资源调度能力与用户增长三者之间的平衡,已成为AI企业商业化运营中必须攻克的难题。

