github.com/mcncarl/jianyi…
github.com/mcncarl/yichen…
volcengine.com/product/asr
口播类视频全程托管给 Codex,一句提示词的事,剪映那头被逆向了出来,仓库开在 GitHub 上。
流程摆开。Codex 加一个叫 yichen-jianying-edit 的 Skill,把口播视频从头包到尾,人不用动手。剪出来的草稿直接进剪映,略微有失手也不怕,豆包的语音转写把片段切到毫秒级,人工顺一遍就是。对照那份,原本八分钟,剪完三分钟,全自动。
花费摆两条。一是 Codex 那头的 token,换便宜模型顶得住,选项给了 DeepSeek-V4.1-Flash 和 Workbuddy(口令页 workbuddy.ai/invite?code=XL… );二是豆包语音转写,一小时八毛钱。
"八分钟剪成三分钟、全程无人"这半句是全场重心。前面七步不碰那篇讲的是原片到成片的路子,这条把剪辑那一步又往前推了一格。跟前面十五分钟出片呼应,那边在模型里剪,这条在草稿引擎里剪,两条路都没用上剪辑师的手。剪法的规矩写进 Skill,下一条片子照旧。
一小时八毛这个价我留意,账算到这一层,全自动那句话才站得住,剪辑这活的成本变成了两条流水账。
这周拿一条自己的口播素材跑一遍,看它切出来的段落和你自己下刀的位置差多少。
话题来源 @gengdaJ
128.6W阅读 ❤️3810 x.com/…↗ 已改写,非原文转载
25 浏览 0 评论
0 反应















