OpenAI 重写 GPT-Live 语音栈,边说边听成为新的基线 OpenAI…

OpenAI 重写 GPT-Live 语音栈,边说边听成为新的基线 OpenAI 把 GPT-Live 的语音栈整体重写。原帖给出的核心卖点:这个新架构下,GPT-Live 可以边说边听,而不是等一轮说完再听一轮。 实现路径按原帖说法,是从客户端到模型整条重建。目标是让音频流持续不断,这样一来哪怕模型在做比较深的推理或者调用工具,语音对话也不会被切断。 对一直在用 ChatGPT 语音模式做长时间思考类协作的团队来说,这条的实际影响是:边想边说 + 边说边听的连续性不再依赖停顿换气,长任务里能不能打断模型继续追也不会出现音频断裂。 原帖没给具体的延迟数字、底层用的是哪一档模型,或者是流式接口的具体行为——这些细节要看 OpenAI 后续 release notes / API 文档。但从工程方向看,把语音栈从客户端到模型整条重建是一条相对少见的大动作,通常意味着不只是修 bug,而是给后续高强度语音任务打了个底。
话题来源 @OpenAI 1.3M阅读 ❤️1.1万 x.com/…↗ 已改写,非原文转载 OpenAI (@OpenAI) on X GPT-Live can listen while it speaks. To make that feel natural at ChatGPT scale, we rebuilt the voice stack from client to model. This new architecture keeps audio flowing continuously, so deeper re X (formerly Twitter)
20 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单