OpenAI 重写 GPT-Live 语音栈,边说边听成为新的基线
OpenAI 把 GPT-Live 的语音栈整体重写。原帖给出的核心卖点:这个新架构下,GPT-Live 可以边说边听,而不是等一轮说完再听一轮。
实现路径按原帖说法,是从客户端到模型整条重建。目标是让音频流持续不断,这样一来哪怕模型在做比较深的推理或者调用工具,语音对话也不会被切断。
对一直在用 ChatGPT 语音模式做长时间思考类协作的团队来说,这条的实际影响是:边想边说 + 边说边听的连续性不再依赖停顿换气,长任务里能不能打断模型继续追也不会出现音频断裂。
原帖没给具体的延迟数字、底层用的是哪一档模型,或者是流式接口的具体行为——这些细节要看 OpenAI 后续 release notes / API 文档。但从工程方向看,把语音栈从客户端到模型整条重建是一条相对少见的大动作,通常意味着不只是修 bug,而是给后续高强度语音任务打了个底。
话题来源 @OpenAI
1.3M阅读 ❤️1.1万 x.com/…↗ 已改写,非原文转载
20 浏览 0 评论
0 反应











