7月19日晚间,Kimi突然发布了一封《致用户信》,内容颇具深意——并非推出新功能,而是主动暂停了C端新用户的订阅服务。
原因十分直接:K3上线后,用户热情高涨,直接导致服务器承受巨大压力。公告原文明确表示:“过去48小时内,用户请求量已大幅超出我们的预期,并逼近现有集群的承载极限。”因此,为保障已有用户的体验,月之暗面决定暂停新用户订阅,将有限的算力资源全部倾斜给老用户。
这背后折射出一个典型的供需失衡故事。就在几天前,7月16日,月之暗面在世界人工智能大会前夕正式发布了Kimi K3——一个参数规模高达2.8万亿的大模型,这也是目前全球参数最大的开源模型,更是全球首个开源的3万亿级别模型。K3基于KDA混合线性注意力机制与注意力残差技术,原生支持视觉理解,拥有100万token的上下文窗口,专门针对软件工程、知识工作、深度研究、多模态理解等复杂场景进行了深度优化。

在测试中,K3的表现确实令人惊艳。其长程编程能力已能自主完成GPU内核优化,甚至从零开始构建GPU编译器,还独立设计了一款面向自身架构的芯片。结合软件工程与视觉推理能力,它能根据代码运行结果、实时截图和视觉反馈不断迭代优化。整体扩展效率相较上一代提升了约2.5倍。
发布后,K3迅速成为行业焦点。其综合智能水平接近全球前沿的闭源模型,仅次于Claude Fable 5和GPT-5.6 Sol。在AI代码工具评测榜单Arena上,上线仅数小时便登顶榜首,成为首个拿下该榜单榜首的中国大模型。
不少网友将K3的发布称为“中国的Fable 5时刻”。海外开发者社区也高度关注,云平台Vercel创始人公布的权威评测结果显示,Kimi K3综合表现位列第一,代码任务成功率达92%。
然而,用户远超预期的热情也带来了始料未及的挑战。针对暂停C端新用户订阅一事,Kimi团队在公告中向未能获得预期体验的用户郑重致歉,同时也向给予理解和支持的用户表达了诚挚感谢。
好消息是,团队正在全力推进算力扩容,随着新算力陆续到位,订阅名额将逐步开放。同时,针对后续新用户,Kimi计划拆分主权益(涵盖Kimi Web、Kimi APP、Kimi Work)与Kimi Code权益,以便更精准地匹配算力需求。
Kimi K3的完整模型权重计划于2026年7月27日前发布,届时全球开发者均可下载运行这套2.8万亿参数的国产大模型。这或许才是真正令人期待的部分。
