语音合成/识别、音乐生成、播客工具类产品
12MB本地Mac听写,Whisper+Parakeet双引擎,离线可用无账户
macOS 原生 AI 语音输入应用,将自然语音实时转化为结构化、流畅的书面文本,插入到当前光标所在位置
AI 内容生成平台,专注于将任意主题快速转化为 60 秒的播客片段
## 产品简介 Lyria 3.5 是 Google DeepMind 于 2026 年 9 月推出的最新音乐生成模型
免费AI声音克隆工具,上传30秒语音即可创建私人声音档案
面向 Windows 用户的 AirPlay 2 音频串流工具
专为 macOS 打造的本地语音转文字应用,核心亮点是完全离线的 AI 增强模型 Fluid-1
开源跨平台语音转文字应用
免费浏览器AI音乐分轨工具,支持人声/鼓点/贝斯/其他乐器四轨分离
## 产品简介 Free Local Transcription 是一款完全基于本地算力运行的免费音频转文字工具
本地化的 macOS/Windows 语音转文字工具
话音刚落,字已应声而下——中英混说精准的 AI 语音输入法
将 Windows PC 音频无线串流至 AirPlay 设备的桌面工具,由独立开发者使用 Rust 从零重写协议栈实现
AI 漫画翻译工具,日文漫画一键翻译并自动排版
## 产品简介 Seply 是一款基于 AI 技术的在线说话人分离工具
面向 macOS 的开源语音转文字听写工具,集成设备端 AI 增强模型,可在离线状态下完成高精度语音输入
完全免费的在线文字转语音工具,无需注册账号即可使用,每日提供 5000 个免费字符额度,生成结果可自由用于商业目的
给 AI Agent 装上语音的 MCP 服务器
MIDI驱动AI生成的数字音频工作站
4.7亿参数实现12,600 RTFx吞吐量,一秒转录3.5小时音频的极速语音识别模型
QWERTY MIDI是由开发者Pedro Tacla Yamada创建的实验性AI辅助项目,通过同构键盘布局将普…
本地 AI 语音克隆与视频配音开源工具
开源可自托管的语音 AI 平台,Vapi/Retell 的开源替代方案
无需注册,用文字或歌词生成完整歌曲
免费 AI 语音内容创作平台
上海人工智能公司 MiniMax 于 2026 年 8 月 14 日发布的全新音乐生成大模型
Google DeepMind推出的新一代语音转写模型,基于Gemini 3 Pro架构
AI 实时语音翻译工具,为会议、课堂和直播打造双语字幕
**产品简介** VoiceStudio 是一款完全本地化运行的开源语音合成与语音克隆工具
完全免费的在线音乐识别与音频处理工具,无需注册即可使用
用语音代替打字,让 AI 帮你读长文
国内首个一站式AI语音生产力平台
## 产品简介 MAI-Transcribe-2 是微软 AI 部门于 2026 年 9 月 3 日正式发布的 AI
上传聊天截图,AI 生成一首歌来回复
超简单的 AI 配音翻译工具,支持角色音色分离
开源多语种语音合成:12种语言,B200上32ms首音频延迟
将 Windows 音频无线投送到 AirPlay 设备
超好用的AI设计,社媒图文、AI换装、一键P图改图工具