返回热力追踪
关键模型发布

OpenAI发布GPT-Live原生全双工语音模型 支持AI边听边说

OpenAI于2026年7月正式发布新一代语音模型GPT-Live,升级ChatGPT语音交互体验。该模型支持边听边说的全双工交互,可灵活判断对话状态,集成GPT-5.5支持复杂推理与联网搜索。

编辑视角

GPT-Live解决了传统AI语音对话交互不自然的痛点,将语音打造成ChatGPT新的统一交互入口,对语音交互产品形态有重大影响,值得AI从业者关注

深度解读

OpenAI发布GPT-Live新一代语音模型,替代此前的回合制语音交互方案,实现了原生全双工边听边说交互,能通过简短回应传递倾听信号,每秒多次判断对话状态,支持打断、抗背景噪音,还支持实时翻译、可视化信息卡片,集成GPT-5.5可在对话同时完成联网搜索、复杂推理。已有官方页面、百度百科及多家媒体报道验证事件真实性,面向全球ChatGPT用户已分版本推送体验。

当前信息边界:目前暂不支持ChatGPT内语音通话与屏幕共享,相关功能仍在开发中,尚未公开模型训练细节与完整技术论文,产品实际用户体验稳定性仍需实际使用验证。

后续需要观察该模型对行业语音交互方向的影响,以及OpenAI后续功能迭代进度。

核心要点
  • OpenAI正式发布GPT-Live,为目前其最智能的语音模型
  • 支持原生全双工边听边说,对话交互更接近真人
  • 集成GPT-5.5,支持复杂推理、联网搜索与实时翻译
  • 分两个版本向不同等级ChatGPT用户开放体验
延伸阅读
  • 商汤升级推出“商汤小浣熊 Raccoon Work”桌面智能体同为2026年AI产品重要发布事件
  • 字节跳动正式发布独立AI办公产品豆包工作同为近期头部企业AI产品重磅发布