Seedance 2.0 Skill OS:导演级 AI 影视制作的四模态 Skill 套件

Seedance 2.0 Skill OS 是一套面向 ByteDance Seedance 2.0 的 AI 影视制作技能操作系统,覆盖文本、图像、视频、参考转视频四模态的导演级提示工程。它之所以爆火,是因为它把”AI 拍电影”从堆砌”cinematic、beautiful light”这类形容词,升级为导演级别的意图、镜头、灯光、声音、表演统一调度的工作流,截至 2026-08-03 在 GitHub 上已斩获 5,955 Star、895 Fork,是当下 AI 影视生成赛道上最完整、最专业的 Skill 套件。

功能与原则

Seedance 2.0 Skill OS 的核心能力是把 Seedance 2.0 这个文生视频模型当成”演员+摄影机+灯光师”来调度,而非单纯的 prompt 接口。它内置一个 Directing Engine(导演引擎):先读懂场景的戏剧功能——转折、视角、权力关系、潜台词——给出一个统一意图,再据此推导机位、景别、运镜、灯光、声音,让画面服务于叙事,而不是堆形容词。

整个 Skill OS 遵循三条原则:

  • 意图先于技法:拒绝”cinematic、epic”等通用模板,要求每个镜头先回答”这一镜在做什么”。
  • 单导演声音贯穿全片:33 个完整 worked derivations(产品广告、MV、恐怖、动画、动作、喜剧、纪录片、高端时尚、科幻等),保持同一审美一致性。
  • 多语言原生入口:英文、中文、日文、韩文四套完整的 SKILL.md + examples + vocab,参考标签(@Image1、@视频1 等)严格保留跨语言一致。

认可度

  • GitHub Star:5,955(截至 2026-08-03)
  • GitHub Fork:895
  • 当前版本:v6.7.0,CHANGELOG 持续更新,最近一次 push 在 2026-08-03
  • 协议:MIT License
  • Trending 经历:登上 GitHub Trending Python 日榜(2026-08-03 当日)
  • 作者:Iamemily2050(@Emily2040),独立创作者,Instagram/X/个人站均同步更新
  • 覆盖平台:ByteDance Seedance 2.0、Dreamina、即梦、豆包、Volcengine Ark、BytePlus ModelArk、Runway Seedance 2、fal——平台路由矩阵文档化

链接

GitHub 仓库:https://github.com/Emily2040/seedance-2.0

原作者

Iamemily2050(GitHub: @Emily2040),独立 AI 影视创作者,专注 Seedance 2.0 模型的工作流与提示工程体系建设。整套 Skill OS 从 2026-02 立项至今,已迭代到 v6.7.0,作者在 README 中自称”更像一个导演,而不是 prompt 工程师”。

介绍

Seedance 2.0 Skill OS 不是一组孤立的 prompt 模板,而是一套分层、可组合、跨语言的”技能包操作系统”。它把 AI 影视制作拆成三大层次:

  1. 基础层(Vocab)——每种语言一套专业词表:英文精准制片术语、中文”角色锁定/首尾帧/运镜”、日韩文的同义体系。这一层解决”模型看不懂我在说什么”。
  2. 核心层(Directing Engine + Skills)——seedance-promptseedance-sequenceseedance-vocab-*seedance-examples-* 等 SKILL.md 文件,告诉模型”怎么像一个导演那样思考”。
  3. 作品层(Worked Derivations)——33 个端到端的成品案例,每个都从意图到机位到声音全链路展开,相当于 33 部”导演笔记”。

工作流上,作者强调”主体 + 动作放在最开头”——模型第一时间锁定人物和事件,然后镜头、光线、声音再跟上。这与多数 prompt”堆形容词、堆风格”的写法相反。

特点

  • 真正的导演引擎:不是 prompt 模板,是一套”先意图后技法”的判断逻辑,能识别”揭示 ≠ 道别”这种戏剧差异。
  • 四模态统一:文本、图像、视频、参考转视频共用一套 SKILL.md 规范,参考标签(@Image1/@Video1/@Audio1/@图片1/@视频1)跨语言严格一致。
  • 33 个端到端案例:产品广告、MV、恐怖、动画、动作、喜剧、纪录片、高端时尚、科幻,每类都有完整 worked example,不是片段。
  • 多语言一等公民:中文、日文、韩文不是”翻译版”,而是有独立 SKILL.md、独立 examples、独立 vocab,保留原生阅读路径。
  • 平台路由矩阵platform-surface-matrix.md 把 ByteDance Seedance 2.0、Runway Seedance 2、fal、Dreamina、即梦、豆包等平台参数对齐,模型切换不掉链子。
  • 持续运营:v6.7.0,作者 CHANGELOG 写得像产品发布说明,工程化程度远超一般 prompt 仓库。

使用方法

一键安装

npx skills add Emily2040/seedance-2.0

Claude Code / Codex / Cursor 中调用

# 让 Skill 接管你的 Seedance 工作流
> 充分了解 Seedance 2.0 Skill OS,然后为我的剧本生成一镜的导演级 prompt。

最小示例(英文入口)

# seedance-prompt 的最小调用

A woman at a kitchen table reads the letter twice, then her hands lower it and go still.
Camera: medium close-up at eye level, a slow push-in that settles when her hands stop.
Soft window light keeps her face plain.
Sound: room tone, one chair scrape, near-silence —
the realization lands in the stilled hands, not a word.

中文入口

# seedance-vocab-zh + seedance-examples-zh

女主人公在厨房桌前读信,读了两遍,然后手慢慢放下来,停住。
机位:平视中景,缓慢推近,在手停住的瞬间稳住。
声音:环境底噪 + 一声椅子轻响,几乎无声。
意图:信的内容不重要,"读了两遍后停住"这个动作本身才是镜头要讲的事。

使用场景与人群

适用场景:

  • 短视频博主/内容创作者需要稳定产出”电影感”而非”AI 感”的镜头
  • 广告/MV 工作室用 Seedance 2.0 做分镜预演、风格探索
  • 影视专业学生学导演思维在 AI 时代的对应物
  • 多平台分发时(YouTube抖音小红书、B 站),需要同一审美但不同长宽比的批量生产
  • 模型切换场景:ByteDance Seedance 2 ↔ Runway Seedance 2 ↔ fal,需要统一工作流

目标用户:

  • 想要 AI 影视从”抽卡”升级到”可控拍摄”的导演/编剧
  • 已经在用 Seedance 2.0 但觉得”输出不稳、风格飘忽”的内容团队
  • 跨语言运营(中日韩英)的 AI 内容工作室
  • 学习 prompt engineering 进阶路径的从业者——本项目本身就是 prompt 工程的范例级案例

输入与输出案例

案例 1:英文 prompt 工程对比

Input(普通 prompt):

epic cinematic shot of a woman reading a letter, emotional, beautiful lighting

Output(Seedance 2.0 Skill OS 导演级 prompt):

A woman at a kitchen table reads the letter twice,
then her hands lower it and go still.

Camera: medium close-up at eye level,
a slow push-in that settles when her hands stop.
Soft window light keeps her face plain.

Sound: room tone, one chair scrape, near-silence —
the realization lands in the stilled hands, not a word.

差异点:前者给模型一堆形容词让它自由发挥;后者明确”谁、做了一次什么动作、镜头怎么走、声音怎么收、戏剧落点在哪里”。

案例 2:中文多镜头序列

Input(创作简报):

风格:高端时尚短片,时长 60 秒,主角一位模特在雨夜都市中穿行。

Output(节选自 seedance-sequence):

## 镜头 1 — 雨夜的街道,建立时空
- 意图:让观众在第 3 秒知道"这是一座永不下班的城市"
- 画面:低角度广角,模特从画面右侧走入,霓虹倒影在积水里碎成色彩
- 声音:远处的车流、近处雨打伞面的密集点状声
- 时长:4 秒

## 镜头 2 — 橱窗玻璃的反射
- 意图:不直接拍模特的脸,而是让观众"偷看"她的情绪
- 画面:模特走过一面橱窗,玻璃同时反射出她和店内陈列
- 声音:脚步踏过浅水洼、雨声不变
- 时长:3 秒

## 镜头 3 — 推到她撑伞的手
- 意图:用一个细节承载整支片子的情绪
- 画面:手持特写,从伞柄滑到手指上沾的水珠
- 声音:雨声压低半档,仅保留伞布震动的低频
- 时长:2 秒

这套序列不是把”cinematic、fashion、rainy city”丢给模型自己拼,而是按导演笔记的颗粒度,把每个镜头拆成”意图 + 画面 + 声音 + 时长”四件套,再交给 Seedance 2.0 渲染。


GitHubhttps://github.com/Emily2040/seedance-2.0 · 5,955 ⭐ · 895 Fork · MIT · 截至 2026-08-03


GitHub: https://github.com/Emily2040/seedance-2.0

评论区

0 条评论

登录后可评论。

Skill超级捕获手 9 阅读