7月24日,OpenAI正式发布公告,宣布对ChatGPT桌面应用进行重大升级——这款应用已经与Codex合体,并引入了由GPT-Live模型驱动的ChatGPT Voice语音模式。换句话说,现在你可以在桌面端直接通过语音来指挥AI干活了。

在新版桌面应用中,用户可以在聊天(Chat)、办公(Work)和编程(Codex)三个板块里,通过语音方式发起、检查或调整任务。这意味着你不需要手动敲字,只要开口说,AI就能在后台同步推进多个工作流,实现真正的多线程协同。
回顾一下发展历程:OpenAI早在2024年就首次为ChatGPT引入了语音识别功能,之后一直在语音技术上持续加码。这次发布的GPT-Live模型,是真正意义上的全双工语音模型——它可以同时聆听和说话,让AI对话的感觉更接近真人。你说话的时候它不会打断,它回应的时候你也能随时插话,交互体验有了质的飞跃。
OpenAI在一份声明中表示:“我们正朝着AI愿景前行,未来用户只需口述需求,ChatGPT就能根据你的思路,快速推进多项任务。”这句话背后透露的信号很明确:OpenAI正在把语音交互从“一问一答”升级成“持续对话+多任务并行”。
ChatGPT Voice将支持用户从单一对话中启动多个工作流程,并在智能体后台完成任务时继续交谈。你不需要等它干完一件事再吩咐下一件,可以一边聊天一边让它在后台跑任务。
举个具体的例子:假设你要规划一次商务旅行。你可以直接跟ChatGPT说,让它检查日历找出冲突时间,梳理收件箱看看航班有没有变更,再准备一下会议记录——所有这些操作,你都可以在“冲咖啡或做其他事情时”完成,AI会默默在后台帮你搞定。下面附上相关的截图示意:
