Dograh 今日发布
开源语音智能体平台,可视化工作流构建器,支持 MCP 驱动和自托管
Dograh 是一款开源语音智能体平台,可视化工作流构建器,支持 MCP 驱动和自托管。它是 Vapi 和 Retell 的开源替代方案,帮助开发者快速构建和部署生产级语音智能体。
Dograh 完全开源,采用 BSD 2-Clause 许可证,代码完全透明,用户可自由查看、修改和部署。它支持一键 Docker 部署,从零到可用的语音机器人的搭建时间不到 2 分钟。平台提供直观的拖放式可视化工作流构建器,内置 QA 节点,开发者无需编写代码即可编排复杂的语音对话流程,并支持 MCP 协议,可通过 Model Context Protocol 直接驱动语音工作流。
在技术架构上,Dograh 采用模块化设计,将语音处理链路拆分为 STT(语音转文本)、LLM(大语言模型)和 TTS(文本转语音)三大独立层,每一层都支持灵活替换。用户可以自带 OpenAI、Deepgram、ElevenLabs 等主流服务商的 API Key,也可以完全使用 Dograh 提供的默认方案。电话线路方面,平台内置了 Twilio、Vonage、Telnyx、Cloudonix 等主流运营商的集成,并支持人工转接功能。
Dograh 的核心竞争力在于消除按分钟收费的壁垒。传统 Vapi、Retell 等平台按通话分钟数计费,在大规模外呼场景下成本迅速膨胀。Dograh 支持完全自托管,部署在用户自有基础设施上,不存在平台分钟费,数据完全保留在本地,满足金融、医疗等对数据隐私有严格要求的行业合规需求。
每个通话都会生成完整的链路追踪(Trace),记录每一次 STT 识别结果、LLM 推理结论、工具调用、延迟数据和 TTS 语音输出,让开发者能够精准定位对话失败的具体原因,而不是面对一个黑盒 transcript 束手无策。平台内置测试模式,开发者在正式部署前即可通过仪表盘直接与机器人对话,快速验证对话设计效果。
评论与建议
登录 后参与评论或提建议