返回热力追踪
关键模型发布
OpenAI发布GPT-Live原生全双工语音模型 支持AI边听边说
OpenAI于2026年7月正式发布新一代语音模型GPT-Live,升级ChatGPT语音交互体验。该模型支持边听边说的全双工交互,可灵活判断对话状态,集成GPT-5.5支持复杂推理与联网搜索。
编辑视角
GPT-Live解决了传统AI语音对话交互不自然的痛点,将语音打造成ChatGPT新的统一交互入口,对语音交互产品形态有重大影响,值得AI从业者关注
深度解读
OpenAI发布GPT-Live新一代语音模型,替代此前的回合制语音交互方案,实现了原生全双工边听边说交互,能通过简短回应传递倾听信号,每秒多次判断对话状态,支持打断、抗背景噪音,还支持实时翻译、可视化信息卡片,集成GPT-5.5可在对话同时完成联网搜索、复杂推理。已有官方页面、百度百科及多家媒体报道验证事件真实性,面向全球ChatGPT用户已分版本推送体验。
当前信息边界:目前暂不支持ChatGPT内语音通话与屏幕共享,相关功能仍在开发中,尚未公开模型训练细节与完整技术论文,产品实际用户体验稳定性仍需实际使用验证。
后续需要观察该模型对行业语音交互方向的影响,以及OpenAI后续功能迭代进度。
核心要点
- OpenAI正式发布GPT-Live,为目前其最智能的语音模型
- 支持原生全双工边听边说,对话交互更接近真人
- 集成GPT-5.5,支持复杂推理、联网搜索与实时翻译
- 分两个版本向不同等级ChatGPT用户开放体验
延伸阅读
- 商汤升级推出“商汤小浣熊 Raccoon Work”桌面智能体 — 同为2026年AI产品重要发布事件
- 字节跳动正式发布独立AI办公产品豆包工作 — 同为近期头部企业AI产品重磅发布