# Suno发Speech 一轨出语音配乐
## 时间
2026年10月2日(北京时间10月3日)
## 地点
美国马萨诸塞州剑桥市(Suno总部)
## 人物
- Suno首席产品官 Jack Brody
- Suno CEO Mikey Shulman
## 事件详情
Suno于2026年10月2日面向Web和移动端全平台推出Speech功能公开测试版。Speech是首个将人声与背景音乐作为单一音轨同时生成的音频模型。
用户既可输入一段想法或脚本,也可直接描述想要的嗓音和音乐风格,由模型一次性合成语音与配乐。Speech提供Simple(描述式)和Advanced(自定义脚本)两种模式,单次生成时长上限约8分钟,相当于一段播客片段或一场长篇讲演。
高级设置支持调整AI嗓音的性别、说话风格以及每代生成的变化幅度,背景配乐可独立开关。Suno团队此前一个月小范围内测了该功能,目前测试阶段仍存在英式口音偶尔漂移到澳大利亚口音、戏剧性停顿过于夸张等小瑕疵。
## 背景
Suno以AI音乐生成闻名,但自2023年底上线以来一直面临环球音乐、索尼音乐等大型唱片公司的版权诉讼。今年9月中旬环球追加了6.02万件作品至诉讼主张,按法定赔偿上限150,000美元/件计算,最高理论赔偿金达90.3亿美元,远超此前华纳音乐约5亿美元和解金额。
面对核心音乐业务的高诉讼风险,Suno被迫加速产品多元化,将语音生成纳入产品矩阵。Speech的核心差异化在于"语音+配乐一轨同步生成",区别于ElevenLabs、Adobe、DeepMind等单一语音合成产品。Suno同时披露,目前订阅用户已突破200万,年化经常性收入突破3亿美元,估值超50亿美元。
## 影响
Speech使Suno从AI音乐生成扩展至更广泛的音频创作领域,目标用户覆盖播客制作人、独立游戏工作室和独立内容创作者等需要人声+配乐一体的群体。
该功能与ElevenLabs、Adobe、DeepMind等语音产品形成直接竞争,但通过与背景音乐引擎深度整合的工作流优势,可能成为Suno抵御音乐版权诉讼风险的战略对冲。
## 总结
Suno以Speech扩展音频创作边界,是其面对版权诉讼围剿的关键多元化举措。"语音+配乐一轨生成"的工作流差异化能否兑现为长期用户增长,将决定Suno能否在50亿美元估值之上继续讲出更大故事。
## 参考来源
- https://suno.com/blog/introducing-speech-beta
- https://the-decoder.com/ai-music-generator-suno-can-now-create-spoken-audio-with-matching-background-music/
- https://www.theverge.com/tech/ai-music-suno-speech-spoken-audio
- https://aidailypost.com/news/suno-ai-music-generator-adds-integrated
- https://wpnews.pro/news/suno-launches-speech-tool-that-adds-background-music-to-spoken-word-audio
- https://intokened.com/en/news/suno-speech-beta-voice-music-one-track
- https://tldrocket.com/story/ai-music-maker-suno-now-generates-spoken-words







