GPT-5性能虽强却缺乏情感温度,用户纷纷怀念GPT-4o的贴心陪伴,OpenAI最终妥协恢复旧版模型。
核心内容:
1. GPT-5性能提升但失去情感表达能力,引发用户广泛不满
2. 用户与AI建立情感连接的独特需求被厂商忽视
3. 技术路线与用户需求失衡,为行业带来深刻反思

GPT-5 正式发布,然而围绕它的争议从未停止。
OpenAI 在推出 GPT-5 之后,直接下架了包括 GPT-4o、GPT-o3 在内的旧版模型。用户尝试体验 GPT-5 后发现,这款模型在编码、数学等领域的性能显著提升,但同时也变得非常生硬,文字创作能力大幅下降,缺乏以往那种通晓人性、富有温度的表达。
在 Reddit 上,一张广为流传的对比图生动展现了两者的差异:GPT-4o 像一位热心的老朋友,懂得提供情绪价值;而 GPT-5 则更加理性,回答冷冰冰,缺乏人情味。
为此,国内外网友纷纷通过各种方式表达不满。Reddit 上与 GPT-4o 相关的帖子比比皆是,讨论热度持续攀升。
当然,有些人可能并不清楚 GPT-4o 的具体角色。简单来说,许多用户使用 GPT-4o 并非为了做数学题或写代码,而是将其当作朋友——聊天、对话、倾诉困惑,更多是一种角色扮演式的陪伴。而 GPT-5 的冰冷理智显然不适合担当朋友的角色。
当然,那些只拿 GPT 写代码、写论文,或者只用 Gemini 和 Claude 的用户,可能感受不到这种落差,甚至觉得这些抱怨有些无病呻吟。但即便是不用 GPT-4o、不搞角色扮演的用户,也能理解这种心情:假如 Claude 5 发布后,告诉你代码能力大幅削弱、写作变强,并且拒绝你使用 Claude 4,大概大家都会产生同样的失落感。
在这种背景下,矛盾彻底爆发。Sam Altman 最终承认错误,并对付费用户重新开放了 GPT-4o 的使用权限。
然而,这件事并未就此结束。GPT-5 只是一个缩影,未来很难保证不会出现下一个类似的模型。这也促使我们思考:模型本身被忽略的情绪价值,是否会成为模型和厂商真正的护城河。
这次 GPT-5 的“翻车”,很可能是训练数据配比出现调整所致——过度增加了代码和数学方面的数据,而忽视了情感、写作类语料的补充。原因显而易见:在 Claude 和 Gemini 纷纷发力 AI 编程赛道时,OpenAI 急需一个强有力的模型,向 VC 证明自身在该领域的潜力,从而获取更多融资。而付出的代价,就是原本偏文科的 GPT-4o 被训练成了理科生,性格发生了根本性变化。
尽管用户之前积累了大量提示词,但模型本身的改变,再强大的提示词也无能为力。今天是 GPT-5,明天或许是 Claude 5,一切都在厂商的一念之间。
厂商维护模型需要成本,下架老模型本属正常操作。但 OpenAI 在未提前通知的情况下,直接下架所有老模型,足以看出其决策流程的糟糕。即便他们恢复了 GPT-4o 的访问权限,仍然在 X 上表示:我们认为 GPT-5 在大多数方面表现更好。
尽管情绪陪伴属于隐形且潜在的价值,但或许正是厂商更深层的护城河。比如在 AI 编程赛道,用户只认第一——第一可以是 Claude 4、Qwen3、GLM-4.5,也可以是任何模型,只要足够强大、能解决用户问题。但陪伴不是:它涉及更多维度,也更难评价,因为你很难用一句话或一项指标来衡量人类的情感和感受。
遗憾的是,目前的 AI 公司无法做到这一点。难道非要停止发布更强模型,眼睁睁看着对手超越自己?或许 OpenAI 在发布 GPT-4o 时,也没有预料到有一天会面临这样的困境。
因此,值得认真思考的是:不必纠结于过去,模型的迭代更新是必然趋势——今天可以是 GPT,明天也可能是 Gemini。厂商应该把模型的选择权交给用户,而不是一刀切直接下线。因为没有一个模型能同时满足所有人的需求,总会有人被牺牲。当然,在被牺牲之前,至少能提前告知一声,好让我们缅怀一下这位老朋友。
