全球资源网科技频道讯:8月3日,OpenAI发布文章《How we built a realtime system for responsive voice AI in six months》,公开了其语音模型的技术框架。

OpenAI披露,第三代语音系统GPT‑Live已取消传统的独立“轮次检测器”,改用全双工语音模型,使系统可以同时听和说。当任务需要搜索、复杂推理或工具调用时,GPT‑Live可在不中断语音交流的情况下,把任务异步交给GPT‑5.5等前沿模型处理。
这意味着,语音AI竞争正在从语音识别准确率,转向“不中断交流的任务执行能力”。未来客服、销售、采访助手、桌面控制和个人助理可能由同一条实时语音链路完成。




