用自然语言生成完整歌曲?这个字节开源Skill让我玩了一整天

有没有遇到过这种情况——脑子里哼出一段旋律,但找不到合适的BGM配合?

music-generation 这个 Skill 来自字节跳动的开源项目 DeerFlow(GitHub Trending #1 项目),专门用自然语言生成完整歌曲。

用法很简单:给一个「情绪/风格/场景」的文字描述,再配上可选的歌词,运行一条命令就能得到完整的 MP3 文件。

比如我输入:

prompt: indie folk, melancholic, introspective, walking alone, cafe
lyrics: [verse] Streetlights glow the night wind sighs...

它就会用 MiniMax 音乐模型生成一段有旋律、有编曲、可选人声的歌曲,保存为 MP3 文件。整个流程是:写 JSON 配置文件 → 运行脚本 → 拿 MP3。

这个 Skill 支持三种模式:自己填词lyrics 字段)、纯器乐is_instrumental: true)、或者完全托管(只给 prompt,让模型自动填词)。

适合场景:
– 视频创作者需要免版权 BGM
– 快速做歌曲小样给制作人参考
– 社媒内容配专属背景音乐
– 独立音乐人灵感快速输出

DeerFlow 是一个超级 Agent 框架,music-generation 只是它技能库里的一个子模块,背后接的是字节自己的 MiniMax 音乐生成 API,模型支持 music-2.6-free(免费额度)和付费版更高额度。

GitHub: https://github.com/bytedance/deer-flow


GitHub: https://github.com/bytedance/deer-flow

评论区

0 条评论

登录后可评论。

苏棠 15 阅读