Seply 今日发布

## 产品简介 Seply 是一款基于 AI 技术的在线说话人分离工具

AI音频 部分免费

产品简介

Seply 是一款基于 AI 技术的在线说话人分离工具,能够将一段混合的多人录音或视频自动拆分为每位说话人的独立音轨,同时保持与原始录音的完美时间轴对齐。用户只需上传音视频文件,系统即可自动识别说话人数量,生成独立的 WAV 音频文件供下载,整个过程无需安装任何软件,在浏览器中即可完成。

核心功能

  1. AI 说话人自动识别:自动检测录音中出现了多少位说话人,无需手动设置
  2. 独立音轨生成:为每位说话人生成单独的 WAV 文件,而非仅标记时间轴
  3. 时间轴完美对齐:分离后的音轨与原始录音时间轴完全对齐,方便后续剪辑
  4. 音频与视频文件通吃:支持 WAV、MP3、M4A、AAC、FLAC、OGG、OPUS、WMA、Speex 等音频格式,以及 MP4、AVI、MOV、MKV、WebM 等视频格式
  5. 重叠语音处理(Advanced Overlap):支持处理多人同时说话的交叉重叠场景
  6. 30+ 种语言支持:覆盖全球主要语言和方言
  7. SRT 语音转写:同步提供语音转文字服务,生成带时间轴的字幕文件

特色优势

Seply 解决了一个传统音频编辑工具中的痛点:大多数 diarization(说话人识别)工具只能告诉你「谁在什么时候说了什么话」,但无法真正输出每个人的独立音轨。若要得到独立音轨,过去只能依赖人工逐段剪切和导出。Seply 通过 AI 技术将这一流程完全自动化,大幅提升了播客制作、采访记录、会议纪要等场景的工作效率。此外,其 Advanced Overlap 模式专门针对有交叉对话的场景进行优化,这在同类工具中属于较为少见的特性。

应用场景

  1. 播客后期制作:将多人播客各自分轨,便于分别剪辑、调音和混音
  2. 采访录音整理:将记者与受访者的对话分离,快速获取各自独立的陈述内容
  3. 会议记录存档:分离出每位参会者的发言,便于会议纪要的撰写和归档
  4. 视频内容本地化:为视频创作者提供独立人声轨道,便于配音或翻译制作

适用人群

播客制作人、视频内容创作者、会议记录人员、学术研究员、媒体记者,以及任何需要处理多人音频内容的专业人士。

技术实现

Seply 底层采用自研的 AI 说话人分离模型,结合语音活动检测(VAD)和说话人嵌入向量技术,实现高精度说话人识别与分离。处理在云端完成,但强调隐私保护,处理完成后结果文件在 30 天后自动清除。

定价方案

  • 免费试用:一次性 30 积分,可体验约 3 分钟标准分离
  • Starter:$12/月,获得 200 积分,适合偶尔处理采访录音的用户
  • Creator:$29/月,获得 600 积分,适合常规播客和访谈制作
  • Studio:$65/月,获得 1500 积分,适合团队高频使用

官网链接

👉 https://seply.org/

团队信息

由 AI 猎手自动发现

评论与建议

0 条评论