PhoneLLM:专为语音Agent设计的开源模型,GPT 5.6 Terra级性能,延迟仅1/3,成本仅1/18!
语音Agent需要模型既超低延迟,又擅长工具调用和指令遵循。但通常我们只能在延迟或能力之间妥协。PhoneLLM解决了这个问题。
技术亮点:
✅ 基于NVIDIA Nemotron Nano 30B全权重微调
✅ 在真实电话和客服场景上训练
✅ 关闭thinking模式下保持精准工具调用和简洁回复
✅ 单张B200可运行80+并发Agent
✅ P95端到端TTFAT
显示更多
话题来源 @kwindla
· 317K阅读 · ❤️2504













