GPT-5这回是真的要来了,而且大有全面铺开的架势。
现在,全网都在“偶遇”GPT-5——不仅在ChatGPT上一度留下过踪迹,MacOS应用的模型列表中也被人扒出了它的名字。Cursor、微软Copilot,就连OpenAI的API平台上,都已经被网友抓住悄悄接入或测试的信号。这一波接一波的泄露,直接把大家对GPT-5的热情和好奇心又拉回到了高点。不得不说,节奏拿捏得确实到位。
连向来怼天怼地的马库斯这次都认真了:不开玩笑,GPT-5真的要来了。
从已经流出的信息来看,GPT-5的能力提升相当显著。它将整合GPT系列和o系列,实现多模态和推理能力的大一统。编程能力被反复提及,接近人类水平,支持百万tokens的上下文,MCP协议也安排上了。最关键的是,最快下周就会发布。
有消息称,微软Copilot上的GPT-5将向所有人开放,不受订阅限制。再加上今年3月奥特曼在采访中表示GPT-5会免费向用户开放——这一波,显然是要大规模铺开了。
两款模型,编程能力都是重头戏
根据OpenAI内部的消息,GPT-5真正的亮点在于实现了推理能力(o系列)与多模态交互能力(4o及GPT系列)的统一,以后用户不再需要手动切换模型。整个体系包含多个版本:GPT-5主模型(代号“nectarine”或“o3-alpha”)、GPT-5 mini(代号“lobster”),以及GPT-5 nano(代号“starfish”)。
技术亮点也相当扎实:输入上下文窗口高达100万tokens,输出可达10万tokens;支持MCP(模型上下文协议)与并行工具调用;能够动态处理短时与长时推理,集成Code Interpreter及其他工具;性能更快、更可靠、幻觉更少,长期对话记忆与逻辑处理能力也有明显提升。
其中,GPT-5(o3-alpha)被曝在高级编程方面表现尤为突出,接近人类程序员的水平,能做到“更快、更精准的软件开发”。它可以自动生成高质量的游戏原型,支持大量定制化应用场景,还能根据特定要求进一步细化。此外,在物理领域也有不错的表现,一些zero-shot的demo效果同样可圈可点。
Lobster(mini版本)被描述为一个专用的编程模型,在精度和功能上都优于Claude 4等竞品,尤其在复杂的编码任务上。它只需极少的输入就能快速生成结构完整、功能准确的代码,特别适合处理凌乱的遗留代码,可以自动优化结构、清除冗余,同时管理大型软件项目中的依赖关系。
举个例子,有用户让Lobster和另一个模型同时创建交互式神经网络动画。Lobster一次性就生成了带彩色节点的完整方案,而另一个模型在运行代码时直接报错。
据说Lobster还集成了o3系列的高级推理能力,能够在简单任务中使用快速响应模式,在复杂任务中触发深层推理模块,逻辑推理与数学能力都更加强大。它支持文本、图像、工具调用等多模态,具备类似Agent的多步骤组合执行能力,可以同时完成解释图像、编写代码和使用工具等任务,不再像GPT-4那样一次只能处理一类输出。
简单来说,Lobster是编码、推理、多模态理解的融合体,把OpenAI过去相互独立的模型集合到了一起,让用户直接拥有一个功能更全面的工作助手,轻松执行复杂的多步骤任务。
至于starfish(nano版本),前些天已经悄悄出现在了大模型竞技场上。
从测试结果来看,这个版本目前只能做静态的小游戏界面,无法启动完整的游戏。
除了模型本身,微软和Cursor也已曝出将火速接入GPT-5。微软正在试行新版本Copilot的“Smart 模式”(或称“magic mode”),能够智能判断何时调用GPT-5的深度推理与多模态能力,让用户无需手动选择模型。这项功能暗示,微软极可能在GPT-5发布后第一时间将其集成到Copilot及Microsoft 365生态中,Azure也在为集成做准备。与此同时,有人发现Cursor团队正在内部测试GPT-5的Alpha版本。
但这次,大家没那么好忽悠了
从各方泄露的信息来看,GPT-5确实如奥特曼所说,强得有些吓人。不过,比起前几次,现在的行业和社区变得冷静得多,也更不容易被情绪带着走了。
有人说,那又怎样?GPT-5可能在刚发布时表现抢眼,但一周后就会开始“变笨”——就像此前所有模型一样。也有人认为,这可能是因为模型发布后出于安全考量,会ban掉一部分能力,才让大家觉得是炒作出来的幻象。
“泼冷水专业户”马库斯这次更是直接给出了7个悲观预测:
即便GPT-5在能力上远超GPT-4,它仍然是难以控制的,会继续犯一些不可预测的低级错误,甚至不会完全听从指令操作。
GPT-5仍然难以应对一些复杂的物理、心理和数学推理任务。
幻觉依旧普遍,且误导性更高,更容易生成看起来正确但实际内容错误的输出。
自然语言输出仍然无法可靠地链接到下游系统(如数据库、虚拟助手等),自然语言指令难以准确映射到用户意图上。
GPT-5不会是通用人工智能,仍然需要其他工具协助完成复杂场景的任务。
系统仍将无法稳定地遵循“有用无害”的人类价值观,输出时可能隐含部分偏见。
GPT-5只是规模的扩展,未来的AGI将朝向更结构化、具备显性知识与规划能力的方向发展,与更广泛的技术集成,而这些恰恰是GPT系列所缺乏的。
社区里弥漫着类似的声音。毕竟被“溜”了太多次,再不发布,大家确实都累了。天天真假混杂的爆料,一些泄露的基准测试也被证实是fake news。有网友表示,现在除了官方,谁的话都不能全信。当然,也有人坚持认为,这些“不经意间的”泄漏,本身就是OpenAI的炒作手段。
不管怎么说,模型到底有没有宣传里说的那么强,答案很快就会揭晓。但有一点是共识——赶紧发布吧,别吊着大家了。
