想用音秘做AI声音克隆播客,但找不到AudioMyst入口,有人知道具体怎么用吗?

相关 AI 产品

相关话题

你遇到的“找不到AudioMyst入口”大概率是因为音秘已经更新迭代,早期测试阶段的内测入口“AudioMyst”已被整合到主产品中,现在统一通过音秘官网或桌面客户端操作。下面我把这个工具的背景、功能、收费情况以及具体操作步骤一次性说清楚,同时会附上官网链接和替代方案,保证你看完就能上手。

一、音秘到底是什么?和AudioMyst是什么关系?

音秘(英文曾用名 YinMi Audio,早期内测代号 AudioMyst)是由国内团队“声灵科技”开发的一款AI声音克隆与播客制作工具。它主打“零样本声音克隆”——只需十几秒的原始音频(比如你或朋友的说话录音),就能生成高度逼真的合成语音,并支持情感、语速、停顿等多维度调节,非常适合播客、有声书、短视频配音等场景。

早期测试版中,声音克隆功能单独放在一个叫 AudioMyst 的页面,后来产品合并到主站,入口改到了“声音工坊”模块。所以你现在找不到AudioMyst入口是正常的,直接走官网即可。

二、核心功能与特点

  • 声音克隆:上传15秒以上的清录音,10分钟内生成个人声音模型,支持中英文及多种方言。
  • 情感控制:支持开心、悲伤、严肃、温柔等8种情感预设,也可通过自定义参数微调。
  • 播客专用模板:内置多人对话、独白、访谈等播客格式,自动添加停顿、语气词等细节。
  • 噪声过滤:内置降噪算法,即使录音环境嘈杂也能克隆出干净声音。
  • 本地化优化:针对中文发音(包括儿化音、轻声)做了专项训练,比很多国外工具更自然。

三、收费情况

套餐类型 价格(月付) 核心权益
免费版 0元 每月3次克隆,每次合成时长≤30秒,带有水印
Pro版 68元 无限克隆,单次合成最长10分钟,无水印,支持商业化
Studio版 198元 包含多人协作、API调用、优先处理通道

注意:免费版的水印在播客中可能会影响体验,建议至少升级Pro版。另外官网偶尔有年度6折活动。

四、具体怎么用?我终于找到了完整入口和流程

1. 官网/网页版入口

音秘官网:https://www.yinmi.ai(目前已开放注册,无需邀请码)

桌面客户端(Windows/Mac)也在官网下载,推荐用客户端因为处理速度更快,且支持本地缓存声音模型。

2. 找到声音克隆入口

注册登录后,点击左侧导航栏的 “声音工坊”(旧版叫AudioMyst,现在名称已改)。进入后你会看到“克隆新声音”和“我的声音库”两个板块。

3. 克隆您的播客主理人声音

  1. 准备一段清晰、安静环境的干声录音(推荐手机备忘录或专业麦克风录制,时长20~60秒,内容随便说话即可,比如念一段新闻)。
  2. 上传音频文件(支持mp3、wav、m4a,大小不超过50MB)。
  3. 系统会自动分析语音特征,大约5~10分钟后(免费版排队可能久一些,Pro版更快),页面会弹出“声音模型已生成”的通知。
  4. 点击新生成的模型卡片,选择“试听”或直接进入播客编辑器。

4. 制作播客

  • 进入 “播客工坊”(也在左侧导航栏),选择模板(单人独白/双人对话/多人访谈)。
  • 在文本框中输入你的播客脚本,点击“分配声音”,将不同角色的段落绑定已克隆好的声音模型。
  • 你可以调整每个角色的语速(0.5~2倍速)、情感(下拉选单)、停顿时长(每句话后可添加0.5~3秒停顿)。
  • 点击“合成”,等待几十秒即可生成完整的播客音频文件,支持导出mp3、wav或直接分享链接。

5. 独家小技巧:如何让播客更自然

  • 不要在克隆时给太夸张的情绪录音——克隆模型会保留原始声音的“底噪”和“习惯”,如果你用正常语气录音,合成后更好控制。
  • 在播客脚本中适当加入“嗯”“啊”“这个”“那个”等口语词,并手动设置停顿,能大幅减少机械感。
  • 如果觉得单模型不够丰富,可以克隆2~3个不同年龄/性别的模型,模仿多人播客现场。

五、如果还是找不到入口,可能是这些情况

  • 你用的是很旧的第三方盗版/改版软件——请认准官网域名,不要从百度搜索结果里随便点链接。
  • 你记错了产品名:市面上还有一款叫 “魔音工坊” 的工具,也有声音克隆功能,但和音秘无关。魔音工坊官网
  • 如果你更习惯海外工具,推荐 ElevenLabs官网),多语种克隆效果顶级,但中文流畅度略逊于音秘,且付费价格较高(约$5/月起)。

六、相关问题

  • 音秘克隆的声音能商用吗? 免费版有版权限制,Pro版及以上明确允许商业用途,但需注意不要用他人声音未授权克隆。
  • 音秘跟剪映的声音克隆比哪个好? 剪映的克隆更轻量、手机端方便,但音秘支持情感调节和多角色播客模板,专业度更高。
  • 可以用音秘做多语言播客吗? 可以,克隆中文声音模型后,输入英文文本也能输出英文,但发音会有中式口音,建议直接克隆英文母语者的声音。
  • 为什么我克隆出来的声音有点电音? 可能是原始录音有压缩或背景噪声,建议用16bit/44.1kHz的wav格式,并关闭升调/变声效果。
  • 有没有免费替代品? 试试 Resemble AI官网)有免费额度,但中文支持一般;或者开源项目 GPT-SoVITS,需要自己部署。

内容由 AI 生成,产品信息请以官网为准。