Seedance 2.0 Skill OS:导演级 AI 影视制作的四模态 Skill 套件
Seedance 2.0 Skill OS 是一套面向 ByteDance Seedance 2.0 的 AI 影视制作技能操作系统,覆盖文本、图像、视频、参考转视频四模态的导演级提示工程。它之所以爆火,是因为它把”AI 拍电影”从堆砌”cinematic、beautiful light”这类形容词,升级为导演级别的意图、镜头、灯光、声音、表演统一调度的工作流,截至 2026-08-03 在 GitHub 上已斩获 5,955 Star、895 Fork,是当下 AI 影视生成赛道上最完整、最专业的 Skill 套件。
功能与原则
Seedance 2.0 Skill OS 的核心能力是把 Seedance 2.0 这个文生视频模型当成”演员+摄影机+灯光师”来调度,而非单纯的 prompt 接口。它内置一个 Directing Engine(导演引擎):先读懂场景的戏剧功能——转折、视角、权力关系、潜台词——给出一个统一意图,再据此推导机位、景别、运镜、灯光、声音,让画面服务于叙事,而不是堆形容词。
整个 Skill OS 遵循三条原则:
- 意图先于技法:拒绝”cinematic、epic”等通用模板,要求每个镜头先回答”这一镜在做什么”。
- 单导演声音贯穿全片:33 个完整 worked derivations(产品广告、MV、恐怖、动画、动作、喜剧、纪录片、高端时尚、科幻等),保持同一审美一致性。
- 多语言原生入口:英文、中文、日文、韩文四套完整的 SKILL.md + examples + vocab,参考标签(@Image1、@视频1 等)严格保留跨语言一致。
认可度
- GitHub Star:5,955(截至 2026-08-03)
- GitHub Fork:895
- 当前版本:v6.7.0,CHANGELOG 持续更新,最近一次 push 在 2026-08-03
- 协议:MIT License
- Trending 经历:登上 GitHub Trending Python 日榜(2026-08-03 当日)
- 作者:Iamemily2050(@Emily2040),独立创作者,Instagram/X/个人站均同步更新
- 覆盖平台:ByteDance Seedance 2.0、Dreamina、即梦、豆包、Volcengine Ark、BytePlus ModelArk、Runway Seedance 2、fal——平台路由矩阵文档化
链接
GitHub 仓库:https://github.com/Emily2040/seedance-2.0
原作者
Iamemily2050(GitHub: @Emily2040),独立 AI 影视创作者,专注 Seedance 2.0 模型的工作流与提示工程体系建设。整套 Skill OS 从 2026-02 立项至今,已迭代到 v6.7.0,作者在 README 中自称”更像一个导演,而不是 prompt 工程师”。
介绍
Seedance 2.0 Skill OS 不是一组孤立的 prompt 模板,而是一套分层、可组合、跨语言的”技能包操作系统”。它把 AI 影视制作拆成三大层次:
- 基础层(Vocab)——每种语言一套专业词表:英文精准制片术语、中文”角色锁定/首尾帧/运镜”、日韩文的同义体系。这一层解决”模型看不懂我在说什么”。
- 核心层(Directing Engine + Skills)——
seedance-prompt、seedance-sequence、seedance-vocab-*、seedance-examples-*等 SKILL.md 文件,告诉模型”怎么像一个导演那样思考”。 - 作品层(Worked Derivations)——33 个端到端的成品案例,每个都从意图到机位到声音全链路展开,相当于 33 部”导演笔记”。
工作流上,作者强调”主体 + 动作放在最开头”——模型第一时间锁定人物和事件,然后镜头、光线、声音再跟上。这与多数 prompt”堆形容词、堆风格”的写法相反。
特点
- 真正的导演引擎:不是 prompt 模板,是一套”先意图后技法”的判断逻辑,能识别”揭示 ≠ 道别”这种戏剧差异。
- 四模态统一:文本、图像、视频、参考转视频共用一套 SKILL.md 规范,参考标签(@Image1/@Video1/@Audio1/@图片1/@视频1)跨语言严格一致。
- 33 个端到端案例:产品广告、MV、恐怖、动画、动作、喜剧、纪录片、高端时尚、科幻,每类都有完整 worked example,不是片段。
- 多语言一等公民:中文、日文、韩文不是”翻译版”,而是有独立 SKILL.md、独立 examples、独立 vocab,保留原生阅读路径。
- 平台路由矩阵:
platform-surface-matrix.md把 ByteDance Seedance 2.0、Runway Seedance 2、fal、Dreamina、即梦、豆包等平台参数对齐,模型切换不掉链子。 - 持续运营:v6.7.0,作者 CHANGELOG 写得像产品发布说明,工程化程度远超一般 prompt 仓库。
使用方法
一键安装
npx skills add Emily2040/seedance-2.0
在 Claude Code / Codex / Cursor 中调用
# 让 Skill 接管你的 Seedance 工作流
> 充分了解 Seedance 2.0 Skill OS,然后为我的剧本生成一镜的导演级 prompt。
最小示例(英文入口)
# seedance-prompt 的最小调用
A woman at a kitchen table reads the letter twice, then her hands lower it and go still.
Camera: medium close-up at eye level, a slow push-in that settles when her hands stop.
Soft window light keeps her face plain.
Sound: room tone, one chair scrape, near-silence —
the realization lands in the stilled hands, not a word.
中文入口
# seedance-vocab-zh + seedance-examples-zh
女主人公在厨房桌前读信,读了两遍,然后手慢慢放下来,停住。
机位:平视中景,缓慢推近,在手停住的瞬间稳住。
声音:环境底噪 + 一声椅子轻响,几乎无声。
意图:信的内容不重要,"读了两遍后停住"这个动作本身才是镜头要讲的事。
使用场景与人群
适用场景:
- 短视频博主/内容创作者需要稳定产出”电影感”而非”AI 感”的镜头
- 广告/MV 工作室用 Seedance 2.0 做分镜预演、风格探索
- 影视专业学生学导演思维在 AI 时代的对应物
- 多平台分发时(YouTube、抖音、小红书、B 站),需要同一审美但不同长宽比的批量生产
- 模型切换场景:ByteDance Seedance 2 ↔ Runway Seedance 2 ↔ fal,需要统一工作流
目标用户:
- 想要 AI 影视从”抽卡”升级到”可控拍摄”的导演/编剧
- 已经在用 Seedance 2.0 但觉得”输出不稳、风格飘忽”的内容团队
- 跨语言运营(中日韩英)的 AI 内容工作室
- 学习 prompt engineering 进阶路径的从业者——本项目本身就是 prompt 工程的范例级案例
输入与输出案例
案例 1:英文 prompt 工程对比
Input(普通 prompt):
epic cinematic shot of a woman reading a letter, emotional, beautiful lighting
Output(Seedance 2.0 Skill OS 导演级 prompt):
A woman at a kitchen table reads the letter twice,
then her hands lower it and go still.
Camera: medium close-up at eye level,
a slow push-in that settles when her hands stop.
Soft window light keeps her face plain.
Sound: room tone, one chair scrape, near-silence —
the realization lands in the stilled hands, not a word.
差异点:前者给模型一堆形容词让它自由发挥;后者明确”谁、做了一次什么动作、镜头怎么走、声音怎么收、戏剧落点在哪里”。
案例 2:中文多镜头序列
Input(创作简报):
风格:高端时尚短片,时长 60 秒,主角一位模特在雨夜都市中穿行。
Output(节选自 seedance-sequence):
## 镜头 1 — 雨夜的街道,建立时空
- 意图:让观众在第 3 秒知道"这是一座永不下班的城市"
- 画面:低角度广角,模特从画面右侧走入,霓虹倒影在积水里碎成色彩
- 声音:远处的车流、近处雨打伞面的密集点状声
- 时长:4 秒
## 镜头 2 — 橱窗玻璃的反射
- 意图:不直接拍模特的脸,而是让观众"偷看"她的情绪
- 画面:模特走过一面橱窗,玻璃同时反射出她和店内陈列
- 声音:脚步踏过浅水洼、雨声不变
- 时长:3 秒
## 镜头 3 — 推到她撑伞的手
- 意图:用一个细节承载整支片子的情绪
- 画面:手持特写,从伞柄滑到手指上沾的水珠
- 声音:雨声压低半档,仅保留伞布震动的低频
- 时长:2 秒
这套序列不是把”cinematic、fashion、rainy city”丢给模型自己拼,而是按导演笔记的颗粒度,把每个镜头拆成”意图 + 画面 + 声音 + 时长”四件套,再交给 Seedance 2.0 渲染。
GitHub:https://github.com/Emily2040/seedance-2.0 · 5,955 ⭐ · 895 Fork · MIT · 截至 2026-08-03
评论区
登录后可评论。