梁文锋上一次站在舆论的聚光灯下,还是去年年初DeepSeek R1发布的时候。
这一次,缘起于一场内部交流会的录音被公开——近四个小时的对话,整理出来足足有三万多字。内容量之大,几乎覆盖了梁文锋对技术、组织、商业以及DeepSeek未来定位的全部思考。
对于外界来说,这确实是一个难得的机会,可以近距离触碰到梁文锋的一手思考。他的表达方式,往往带着第一性原理的底色,干净、直接,且不乏洞见。
比如,他提到AI智能的发展呈现出一种阶梯式上升的态势:去年是COT(思维链)的突破,今年是Agent的落地,再往后,需要解决的是AI的长时间持续学习能力与自我迭代能力,最终通向真正的AGI——那些人类能做的事,机器都能做。
他还说,无论是C端用户还是B端用户,本质上都是通往AGI路上的副产品,优先级并不靠前。DeepSeek的初心,始终是AGI。
用一句话概括那四个小时的录音,就是梁文锋既坚定地表达了对AGI路线的执着,也清晰地勾勒出行业未来的趋势。这无疑为外界提供了一扇观察他思维方式的窗口,很多过去看似难以理解的选择,也因此有了更清晰的答案。
可以说,公众对梁文锋的想象,经由这次交流会的释放,达到了一个精彩处。
值得玩味的是,这场交流会发生在今年5月20日,正值DeepSeek融资的关键阶段。而录音的流出,却是在DeepSeek V4正式版延期发布之后。
要知道,当下国内模型圈的焦点,原本集中在Kimi K3,以及智谱接下来几个月将如何追赶K3。但随着这份录音的流出,行业的目光又迅速拉回到了DeepSeek和梁文锋身上。
很难不让人怀疑,这是模型激烈竞争之下的一步棋。
甚至,一些梳理出来的内容,已经明显带有将梁文锋个人神话化的倾向。这或许偏离了梁文锋的本意,也与他低调的行事风格不太相符,甚至可能给他带来不必要的麻烦。
梁文锋不是神,他也不想当神。他只是一个平凡的创业者,克制地输出观点,谨慎地回应问题。
01
克制与张力
梁文锋很少公开发表讲话,在媒体报道中,他大多呈现出低调神秘的一面。这次交流会是私下场合,反而展现出了他最真实的状态。
看完四个小时的交流实录,最大的感受,除了信息量密度惊人之外,就是梁文锋身上那种独特的张力。
他的表达里没有“遥遥领先”式的营销话术,也没有煽动性的口号。他只是从底层技术到产业落地,勾勒出一幅清晰且务实的DeepSeek发展蓝图。
他的话语中,频繁流露出DeepSeek在商业边界上的克制。比如,会一直坚持开源,追求API定价成本的下降,只赚取合理的利润,不会把B端收入当作优先级。
然而,在回应投资人时,他也提到,DeepSeek其实“顺带”完成了C端和B端的商业化。
2025年DeepSeek走红后,某种程度上重新证明了AI应用增长的另一种路径:不依赖大规模商业投放,仅凭模型能力就能实现用户自传播。凭借模型出圈,DeepSeek仅用一个月时间,C端用户规模便增长数倍,达到1.3亿,成为仅次于豆包的第二大AI应用。
即便到了2026年3月,在没有像大厂一样持续投入市场推广的情况下,DeepSeek的月活用户依然维持在亿级规模,排名国内第三。
在B端收入上,梁文锋称,如果今年DeepSeek的需求继续扩大,能买到更多的显卡,其ARR可能有数亿美金。而一旦达到十亿美金,DeepSeek的现金流就有可能回正。
这一速度,在基模公司的“御三家”中,无疑是最亮眼的。梁文锋的态度很明确:DeepSeek不是不要商业化,而是真正的商业化时机还未到来。现在去做商业化,无异于捡了芝麻丢了西瓜。
在商业化路径上,他的表达既带有一种儒家式的克制,又透露出一种不易察觉的张力。一方面,DeepSeek并不希望将用户、流量、场景和生态全部纳入自身体系,不想成为下一个超级App。
相反,它更倾向于站在模型和智能能力的核心位置,将应用层和商业机会开放给合作伙伴、开发者以及各行业参与者,共同分享AI时代的增长红利。
另一方面,他也会提到,没有哪家创业公司像DeepSeek一样追求模型的计算效率,因为这有些违背商业常识——模型效率一高,可能会带来收入的下降。
但DeepSeek能做到API价格降低的底气,在于他们的API定价能做到十个月回本。“到市场上买一批设备回来,十个月收回成本,V3.2 Flash跟其他的模型,都是十个月收回设备的成本。”梁文锋说,这一点会给竞争对手带来直接的压力。
梁文锋的这种张力,与其说是对竞争边界的感知,不如说是一种对终极目标的清醒。他在传达一个信息:DeepSeek不是没有商业化能力,如果想要商业化,随时可以做得更好。
对于核心问题,梁文锋也十分果决地表明态度。DeepSeek虽然在商业化上追求克制,但只在一个问题上绝不退让——那就是团队的稳定性。
曾长期坚持不融资,让DeepSeek在人才争夺战中处于相对被动的位置。此前已有多位研究人员离开,最近一次引发关注的是,字节跳动以高额薪酬吸引了深度参与DeepSeek代码、推理等全链路研发的研究员郭达雅加盟。
毕竟,在这场大模型竞赛中,失去一个投资方,还有其他投资方;但失去了人才,很可能会失去一切。
02
梁文锋需要回答的
当下DeepSeek的处境,并不容易。
如果说DeepSeek V3的出现,是一次对行业共识的冲击,那么V4的迟迟未至,则暴露出一家依靠效率和技术路线突围的公司,正进入一个更复杂的竞争阶段。
过去一年,DeepSeek最成功的叙事,是“用更少的资源,做出接近顶级水平的模型”。从R1到V3,都证明了这一点。
它让行业意识到,在大模型的赛道上,算法效率、工程能力、训练方法,同样可以改变竞争格局。但现在,DeepSeek V4需要回答的问题是:当所有玩家都瞄准下一代模型竞争,DeepSeek如何继续保持领先?
外界既是在等待一个新模型,也是在等待DeepSeek下一阶段路线的验证。
从时间线来看,DeepSeek在过去几个月经历了一系列变化。
最初,行业普遍期待DeepSeek V4能够延续V3的突破,在推理、多模态、Agent能力等方向再次制造惊喜。
去年12月左右,DeepSeek V4计划在春节前后发布。到了大年三十,智谱的GLM-5和Kimi-k2.5接连发布,V4仍未被端上桌。
有接近DeepSeek的人士透露,临到发布当天,团队内部对模型效果仍不满意,于是临时改变了发布计划,V4发布被推迟。
4月,DeepSeek V4终于发布了,但端上来的仍是preview版,1.6T的抢先版并没有带来类似R1发布时的震撼效果。本来计划在7月中旬推出的DeepSeek V4正式版,同样再次临时跳票。
短短半年,DeepSeek V4已经两次跳票。
与此同时,竞争对手比半年前追赶得更快。半年前,国产模型厂商的每一次模型发布,都会在测评横比时着重强调与DeepSeek R1、V3系列模型的对比分数。半年后,Coding成为生产力的第一大场景,模型厂商的对照组变成了GPT-5.6-sol、Fable 5。
近几个月,智谱glm系列在海外引发震动,公司市值一度超过万亿。Kimi K3发布后迅速成为“当红炸子鸡”,获得马斯克点赞,更是将国产模型的参数推到了2.8万亿的量级。
海淀区“御三家”中,唯独DeepSeek的V4依旧难产。
因此,很难说这次DeepSeek内部交流录音外泄,不是资方在有意释放信息,以提振士气。毕竟,谁会甘愿自己投资的大模型落后于别人呢?
如果是这样,梁文锋的处境似乎有些被动。
DeepSeek最大的资产,是一群相信长期技术探索的研究者。在梁文锋的表述里,这群人很平凡,但一起做出了不平凡的事。高专注力的团队,也帮助DeepSeek摆脱了商业化的压力,在模型能力上实现了快速突破。
如今,融资刚刚落地,模型稍稍延期发布,就要受到资方的强行干预。这也意味着,资方比梁文锋更焦虑。
大模型行业过去已经证明,延期并不一定意味着失败。真正的问题是,DeepSeek能否再次创造一个改变行业认知的技术突破?
所有人都在等梁文锋用V4进行一场公开答辩。
