Egma
# Egma:语音智能体的自动化测试与监控平台 ## 产品简介 Egma 是一款开源的语音智能体测试与监控平台
产品简介 Egma 是一款开源的语音智能体测试与监控平台,帮助开发者在发布前通过仿真测试验证智能体行为,并在上线后持续监控其表现。平台支持自托管或使用 Egma Cloud,兼容多种 STT、LLM 和 TTS 提供方,并提供 0% 加价的推理服务。测试用例以 Markdown 文件形式保存在代码仓库中,与代码同行演进。
核心功能 仿真测试:自动运行大量语音对话仿真,无需人工反复拨测,一个脚本可覆盖上百个场景
监控与漂移检测:生产环境运行时检测已知行为退化,同时主动发现未曾预设的问题
Bring Your Own Keys:支持自带 OpenAI、Anthropic 等 API Key,平台不在推理成本上加价
Markdown 测试用例:测试文件是纯文本,与代码一起 review、一起版本化,成为团队共享上下文
自托管支持:一行命令完成部署,数据不出自己的基础设施,满足敏感行业合规需求
多角色支持:支持接入多种语音智能体类型(客服机器人、AI 前台、健康顾问等),灵活配置测试场景
技术实现 测试层面,Egma 从 Anthropic 的 Evals 设计中汲取灵感,将评测方法扩展到语音场景。每个测试是一个 Markdown 文件,描述场景、输入和期望行为。平台支持用编码智能体(如 Claude Code)来辅助编写和运行测试,实现自动化迭代。
监控层面,Egma 不只做固定清单的 LLM 评判——它同时检测已知行为的漂移和未知的问题模式。平台将每次对话的转录文本、结构化事件和评分结果持久化到 ClickHouse,支持时序分析和异常告警。
快速上手 在语音智能体项目目录下,向编码智能体发送提示:「Set up Egma simulation testing in this repo. Install the skills with: npx skills add egma/egma」
智能体自动下载 integrate-egma 和 write-egma-tests 两个技能插件,并引导完成智能体注册
编写测试用例(Markdown 文件),定义场景和期望行为
运行测试:npx egma run,或通过 Web UI 实时观察仿真过程
查看测试报告:npx egma report,结合 CI/CD 流水线实现自动化质量门禁
应用场景 语音客服机器人发布前的质量验证:覆盖常见咨询场景、退款流程、异常转人工等,确保发布前无重大缺陷
健康顾问 / AI 前台的上线前测试:在医疗、理发店、律所等场景中测试对话路径,避免答非所问或循环
消费电子语音交互的持续监控:产品上市后持续追踪用户对话质量,发现新问题及时告警
特色优势 零推理加价:自带主流模型供应商 Key,平台不在 token 成本上加收费用
测试即文档:Markdown 测试文件同时是团队对智能体行为的共同理解,降低人员交接成本
监控不只是打分:同时覆盖已知问题回归和未知问题发现,不只是"评分高就过关"
MIT 许可开源:代码完全开放,可审计、可分叉、可商业使用
适用人群 语音智能体开发者、AI infra 工程师、对话式 AI 研究人员、需要数据合规的医疗和金融行业。
评论与建议
登录 后参与评论或提建议