游乐游手机版
首页/AI热点日报/热点详情

下一个模型发布前你必须知道的几件事

类型:热点整理2026-07-21
“AI 一天,人间一年”,这句话在月之暗面创始人杨植麟口中,大概是最贴切的注脚。对于刚发布的 Kimi K3 来说,过去三年的积累,可能真的比不上这三天带来的轰动效应。 自 ChatGPT 问世以来,中国 AI 行业有过不少“震惊世界”的时刻。有些是实打实的技术突破,有些则更像是媒体和厂商的狂欢。但

“AI 一天,人间一年”,这句话在月之暗面创始人杨植麟口中,大概是最贴切的注脚。对于刚发布的 Kimi K3 来说,过去三年的积累,可能真的比不上这三天带来的轰动效应。

自 ChatGPT 问世以来,中国 AI 行业有过不少“震惊世界”的时刻。有些是实打实的技术突破,有些则更像是媒体和厂商的狂欢。但这一次,Kimi K3 的发布,似乎成了唯一能与“DeepSeek 时刻”相提并论的事件。

上周,以英伟达、博通和美光为首的费城半导体指数暴跌 10%,创下自 2025 年 4 月以来的最大单周跌幅,直接跌入技术性熊市。媒体一盘算,72 小时内,美股 AI 板块合计蒸发了 4700 亿美元,折合软妹币超过 3 万亿。这场景,像极了去年年初 DeepSeek-R1 发布后,美国芯片产业集体滑坡的翻版。

海外媒体和机构几乎一边倒地用“DeepSeek 2.0”来形容 Kimi K3。《财富》杂志称之为“第二次 DeepSeek 冲击”,《华尔街日报》强调 Kimi 加剧了华尔街芯片股的抛售,而彭博社则直言“Kimi 碘伏了美国领先中国的传统认知”。

恐慌情绪甚至蔓延到了 OpenAI 和 Anthropic 头上。一家中国开源模型的性能,居然逼近了顶级的闭源模型,这让本就处于上市关键节点的它们备受质疑——模型性能领先,可是它们获取高估值和高定价的核心筹码。已经有美国开发者开始质疑,为什么还要为 Claude 和 GPT 支付那么高的价格。

过去几天,Anthropic 宣布为所有 Max 及 Team Premium 用户开放 Claude Fable 5,但限额 50%,这背后是算力吃紧的老问题。OpenAI 则在上周多次重置 Codex 限额,甚至一度取消了 5 小时的用量限制。当然,很难说这些完全归咎于 Kimi K3 的冲击。在这之前,半导体产业已经连续承压数周,华尔街的分析师们迫切需要一个足够醒目、也容易理解的借口来为这轮下跌背锅——境外势力,自然是万能法宝。更何况,OpenAI 和 Anthropic 本就处于激烈竞争中,价格战早已打得不可开交。

但这并不妨碍美国科技行业对 Kimi K3 表现出惊讶。即便 Kimi 自己承认,总体性能仍落后于 Claude Fable 5 和 GPT-5.6 Sol,但诸多海外评测机构在测评中还是毫不吝惜赞美之词,K3 的排名往往稳居前列。

比如,Arena.ai 就称 Kimi K3 以 1679 分的成绩拿下了前端代码竞技场的榜首,超越了 Claude Fable 5。这家机构还特意提到,上次中国模型如此接近领先,还是 2025 年的 DeepSeek-R1。

Arena 统计中美 AI 对比

市场热情高涨,连杨植麟本人都成了美国科技圈热议的新偶像。大洋彼岸的群众很不解,为什么他当年没留在美国,而是选择回到中国。搞得杨植麟的博士生导师不得不专门发文解释,澄清他回国不是签证或移民问题,而是他自己坚定要回去创业。

大模型行业的法则很简单:性能领先,价格就不是问题。即便 K3 模型的输入和输出价格均较上代 K2.6 上涨了 3 倍有余,显著高于 GLM-5.2 和 DeepSeek V4 Pro,成为目前市面上最贵的国产模型,但 Kimi 依然遭遇了算力紧缺。

7 月 19 日晚,Kimi 宣布由于算力紧缺,自即日起暂停 C 端新用户订阅。同时调整了会员权益,将原本覆盖网页版、App 和 Kimi Work 的通用会员与 Kimi Code 会员拆分销售。Kimi 总裁张予彤透露,K3 发布次日,公司 ARR 创下了历史最大单日增幅。

Kimi 官方推文

算力紧缺,一定程度上或许也与 K3 模型自身的 Token 效率有关。在 Artificial Analysis 的评测中,K3 完成整套测试输出了 1.3 亿个 Token,接近同类模型平均水平的两倍。更长的输出意味着更高的推理成本,这无疑会进一步加重 Kimi 的算力压力。社交媒体上,也有不少开发者吐槽 Kimi K3 是 Token 消耗大户,有人跑了 15 分钟就耗尽了 5 小时的限额。

K3 的出圈,再一次证明了 AI 时代模型的脆弱性。仅仅两周前,中国大模型市场最被看好的还是已经上市的智谱。上半年发布的 GLM-5.2 模型被称为国产开源模型的骄傲,几次大幅上调价格依然供不应求。上市半年来,智谱股价翻了 24 倍有余,总市值一度突破 1.3 万亿港元。但上周,智谱的神话似乎出现松动。上周五股价下跌 28.49%,本周一再跌 19.56%,两个交易日股价累计下跌超 4 成,市值跌破 5000 亿港元。

Kimi K3 的领先地位,恐怕也维持不了多久。7 月 19 日,阿里巴巴发布了 Qwen3.8 Max 预览版,参数规模达 2.4 万亿,宣称综合能力在全球范围内仅次于 Claude Fable 5。马斯克也对外放话,拥有 2 万亿参数量的 Grok 新模型即将完成初步训练,可能在保持较高运行效率的同时超越 Kimi。

K3 发布当天,萨姆·奥尔特曼则对外表示,他知道过去 12 个月他们并非最佳,这主要归咎于他,但即将迎来迄今为止最好的 12 个月。“团队正在做非常出色的工作,我相信你会对他们为你准备的惊喜感到非常满意。”

芯片行业多年来奉行摩尔定律,性能大约每 18 至 24 个月翻一倍。但到了 AI 时代,模型性能的提升,是以周甚至天来计算的。去年谷歌的 Gemini 模型一度让萨姆·奥尔特曼在公司内拉响红色警报,但现在 Gemini 更流行的称谓是“北美豆包”。彭博社称,Gemini 3.5 Pro 的发布时间已经推迟数月,原因是模型在编程及代码生成能力上未达预期。

两个交易日的重挫后,市场消息称智谱可能跳过 GLM-5.3,直接推出 GLM-5.5,预计最快将于 8 月发布,据称将具备万亿以上的参数规模。智谱的员工们已经开始在推特上放出小道消息,称现在可能是订阅 GLM Coding Plan 的最佳时机。刚刚完成首轮融资的 DeepSeek 也被曝即将推出 DeepSeek-V4 模型的正式版,外界称性能将逼近 GPT-5.6,且继续保持极高性价比的优势。

过去的时代总在反复证明时间的价值。无论是 PC 互联网还是移动互联网,一家公司只要起步早、反赌,就有机会在窗口关闭前建立先发优势。随着用户和市场规模扩大,领先非但不会被稀释,反而会持续放大,令后来者望尘莫及。但在 AI 时代,优势并不总是站在时间这一边。所有的领先都建立在模型性能的迭代上,总有后来者不断推出更新的模型,缩短差距。如果说互联网时代最难追赶的是规模,那么 AI 最醒目的优势就是模型。只是,这种优势的保质期,往往只有一个版本。

两个交易日内股价连跌 4 成的智谱,今日盘中涨幅一度超 35%。市场消息称,智谱已落地 1GW 级国产 AI 算力数据中心建设。

竞争,仍在继续。

来源:https://36kr.com/p/3905045028095105

相关热点

继续查看同栏目近期热点。

延伸阅读

补充最近整理过的热点入口。