
2026年7月24日,OpenAI正式推送ChatGPT桌面端重大升级,整合Codex编程能力后上线由GPT-Live模型驱动的ChatGPT Voice语音模式,支持全双工真人口吻交互,覆盖聊天、办公、编程三大场景,用户可通过语音直接发起、检查、调整任务,将多线程协同操作从传统键盘输入转向语音控制。

不少用户期待的“动嘴就能让AI同时推进多份工作”的场景,如今已经正式落地。新版ChatGPT桌面端的语音交互跳出了此前“你说一句、AI答一句”的单轮对话限制,用户在口述需求的过程中,AI就能同步启动任务执行,甚至可以随时插话调整要求,无需等待上一轮交互结束。
本次升级并非OpenAI在语音赛道的临时布局。早在2024年,OpenAI就首次为ChatGPT加入语音识别功能,允许用户通过语音输入替代打字发起对话,但彼时的交互仍停留在“用户说完、AI再处理应答”的半双工模式,响应延迟高、中途无法修改需求的痛点明显,难以适配复杂的多任务场景。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录