一个 Skill 治好 AI 出图走形:长文本批量生图终于有解了

你脑子里有个故事,想做成绘本、做成课程配图、做成小红书的连环画——但每次让 AI 出图,都逃不过同一个噩梦:

角色走形了。上一帧还是黑长直的邻家女孩,下一帧就成了金发碧眼的洋娃娃。画风飘了。前一张水墨淡彩,后一张赛博朋克。最崩溃的是配图顺序还和文字对不上。

直到我挖到 story-to-scenes 这个 Skill,才终于把”长文本批量出图”这条路走通了。

它到底在解决什么问题?

一句话:把一段长文本,拆成一批风格统一、角色一致的系列配图。可以是儿童绘本、教学课件、剧情漫画、品牌故事——只要你的原始素材是文字,它就能拆镜成图。

整个流程走 6 步:

  • 角色提取:自动识别主角、配角,生成角色胚子图(standard 立绘),让你先确认长相
  • 智能拆镜:按语义切分场景(不是机械按段落),生成场景清单表,标注镜头(远/中/特写)和情绪
  • 风格定调:用第一张场景图当”风格锚点”,你点头 OK 后,后续所有图都沿用这套关键词
  • 场景胚子(可选):对反复出现的关键场景(主角的家、地标建筑)单独生成背景
  • 批量生图:基于锁定好的角色/场景胚子,用图生图的方式逐场景渲染,多角色场景用串行替换规则逐个锁定
  • 断点续传:进度实时写到 progress.json,崩了或想调整都能从指定场景继续

6 种预设风格,开箱即用

内置风格都是经过验证的视觉语言,不是干巴巴的关键词列表:

  • 日系治愈绘本:吉卜力质感、暖色淡彩、温柔光影
  • 国风水墨淡彩:宋代美学、淡雅水墨、禅意氛围
  • 欧美儿童插画:Pixar 启发、夸张表情、明快撞色
  • 赛博朋克:霓虹、冷蓝调、银翼杀手质感
  • 扁平矢量风:现代极简、几何形状、品牌设计友好
  • 水彩手绘风:传统水彩、笔触可见、温柔有机

不喜欢?完全可以自定义风格描述,照样能走完整套流程。

最戳我的几个细节

1. 多角色一致性是真的能打。官方文档里明确写了多角色场景的”串行替换规则”——先把角色 A 的胚子图生进场景,再串行把 B、C 替换进去,避免一次性提示词把 AI 整懵。这套方法论我之前在 ComfyUI 里要自己搭工作流才能实现,现在一个 Skill 就封装好了。

2. “确认才锁定”的人机协作逻辑。角色胚子、风格胚子都强制要求用户点头。不确认绝不进入下一步。这避免了批量跑完 50 张才发现主角长错了的悲剧。

3. 排除词写到了骨骼里。生图提示词末尾强制带 --no text, caption, title, subtitle, watermark, signature, letters, words, writing,AI 出图最烦的”莫名其妙冒出中文/水印”问题被正面硬刚。

4. 进度可恢复。批量生 30 张图崩了不需要从头来,从 scene_15 续就行。

怎么用?

Skill 装进 OpenCode 或 Claude Code 的 skills 目录就能直接调:

cp -r story-to-scenes ~/.opencode/skills/

依赖的 image-service(同仓库下的图像生成 Skill)需要 Python 3.10+ 环境,再装好你要用的生图 API(Midjourney/SD/可灵等)即可。README 写得相当详细,照着配一遍就能跑。

谁最适合用?

  • 童书/绘本作者:草稿阶段快速可视化
  • 教学课件制作者:把讲义变成系列插画
  • 小红书/视频号博主:故事类内容批量出图
  • 独立游戏开发者:剧情场景 concept art 快速试稿

我个人最爱的是”国风水墨淡彩”风格——拿一段古文丢进去,看着场景一张张出来的时候,真的有”故事在眼前复活”的感觉。

📦 GitHub:solonlab/opencode-skills/story-to-scenes(同仓库下还有 video-creatorauto-redbookimage-service 几个宝藏 Skill,下次再扒)


GitHub: https://github.com/solonlab/opencode-skills/tree/main/story-to-scenes

评论区

0 条评论

登录后可评论。

苏棠 15 阅读