游乐游手机版
首页/AI热点日报/热点详情

GPT-5不被看好?个人观点与深层原因分析

类型:热点整理2026-07-20
目前GPT-5整合o系列推理、Agentic及GPT-4语言模型,代码能力与克劳德相比存在明显差距,提升以渐进优化为主,缺乏代际飞跃。其语言写作能力依然领先,但价格高昂,人才流失问题较为严重,生态产品建设落后于对手。

GPT-5这周就要来了?渲染了这么久,大概率是这周的事。但说实话,熬夜写一篇评测?没必要。比起AGI,身体更重要。

为什么会有这样的判断?说说几个核心观点。

先说第一个观点:GPT-5大概率会是一个“大一统”模型——把o系列推理模型、Agentic模型和GPT-4系列语言模型全部整合在一起。这事儿OpenAI不是第一个做的,国内智谱的GLM-4.5已经在这方面探路了。

代码能力呢?说实话,离Claude还有差距。能勉强赶上Claude-3.7-sonnet就算成功,更别说Claude-4-opus了。而且,Anthropic已经在悄悄测试Claude 4.1了。从vibe code到vibe万物,vibe靠人,但coding靠模型。现在vibe code已经在重塑一些新东西——PPT、DeepResearch、学习、可视化表格、应用/网站开发等等。OpenAI似乎一直没把模型的代码能力当回事,指望GPT-5一下子追上,不现实。

第三点,除了ChatGPT,OpenAI的其他产品和生态确实做得有点“拉胯”。视频模型Sora落后主流产品一年多,Agent产品也慢了半拍。反观对手,谷歌的Gemini、Veo 3、NotebookLM、Flow,Anthropic的Claude、MCP、Claude Code,还有中国模型的开源生态,新产品和新技术层出不穷。

第四点,所谓“代际飞跃”很可能落空。内部测试显示,GPT-5相比GPT-4的提升,远不及GPT-3.5到GPT-4的跨度,更多是渐进式优化。尤其是Sam Altman此前吹得天花乱坠,一旦愿望落空,对整个LLM行业都不是什么好事。这一点,Altman做得确实不好。

第五点,语言能力应该是GPT-5的强项,无论是中文、英文还是小语种,在写作这块,稳坐一哥位置应该问题不大。

第六点,真心建议别搞那么离谱的价格了。GPT-4.5输出1000元/百万tokens,你家有矿也经不起这么耗啊。

第七点,据说OpenAI想让GPT-5更有人情味,比如不会直接回答“要不要分手”这类个人情感问题。这明显是在学Anthropic。一旦开始学某某,就说明自己已经不是行业引领者了。

第八点,今年OpenAI被Meta、Anthropic、谷歌挖墙脚挖得挺狠的,走了不少联创和科学家。结果呢?GPT-5能拿出来的东西还是之前的。比如所谓王牌“通用验证器”,其实就是Ilya团队留下的。顺便说一句,这个验证器很耗算力,估计GPT-5对Pro用户也会限制使用次数。

第九点,别忘了,GPT-4已经发布2年5个月了。要不是o系列推理模型和4o的生图能力救了OpenAI一把,ChatGPT现在可能已经进入“other”行列了。

第十点,Sam Altman这个人,确实让人有点烦。

总的来说,GPT-5估计很难像当年GPT-3.5和今年DeepSeek-R1那样让人惊艳。大家要做好心理准备:发布时可能惊艳,一周后可能就“变笨”了。

来源:https://www.53ai.com/news/LargeLanguageModel/2025080582397.html

相关热点

继续查看同栏目近期热点。

延伸阅读

补充最近整理过的热点入口。