一张图三种画法!这个 Claude Skill 让你不花一分钱也能批量产视觉素材
一张图能说出三种故事——你以为 Claude 只能”打字”,其实它早就能”画”了。今天挖到一个超适合设计师和内容创作者的 Skill 仓库:claude-image-generation。作者 Hasan Aboul Hasan 直接把 Claude Code 玩成了一套完整的视觉生产流水线,关键是——前两级不花一分钱、不调用任何图像模型。
三档引擎,按需切换
这个仓库最有意思的地方是把”生成图片”这件事拆成三个层级:
- Level 1(代码设计引擎):纯 Pillow + numpy 写出来——渐变、网格、辉光、噪波、几何、真实字体排印。零 AI 模型、零成本。海报、封面、引言卡、轮播图、Bauhaus 几何风、合成波、霓虹字——任何对排版和设计感要求高的活,全归它。出图锐利、文本完美对齐,绝无 AI 鬼影。
- Level 2(Three.js 3D 场景):headless Three.js 在 Xvfb 下渲染一帧。无需图像模型,只要本地有 Node。能搞定产品 3D 拍摄、暗调工作室、Apple Light 灯效、自然落日、水下场景——3D 感的素材分分钟。
- Level 3(扩散模型):上 Cloudflare Workers AI 的 Flux-1-Schnell。摄影质感、自由主体、快速缩略图、需要真实感的图全交给它。
你只管说”给我做一个极简咖啡店 logo”,Claude 会自己判断这个 prompt 该走哪一档。最牛的是同一句 prompt 三档都跑一遍,作者专门做了对比图给你看——你能直观感受到”代码设计 vs 3D 渲染 vs 扩散模型”的边界在哪里。
Storybook 流水线:把故事变成可分享的 HTML 书
图像三件套之外,作者还搭了一条超惊艳的故事书生产线:
scene-splitter:把英文故事切成 8–12 个可插画场景story-illustrator:每个场景生成一张角色一致的插图(Fal 图像模型)story-narrator:每个场景配一段 ElevenLabs TTS 旁白story-html-publisher:打包成单文件 HTML——插图、音频、滑动翻页全部内嵌,离线可开、转发即用
作者用《The Three Gardeners》做了示范 demo:滑一页图、配一段声、读一段故事。这种”角色一致性”是扩散模型的硬骨头,他专门写了教程讲怎么锁住跨场景的角色特征——做儿童绘本、做营销长图、做品牌叙事的可以直接抄作业。
设计师怎么用
我个人最推荐 Level 1 + Level 2 组合。原因很简单:品牌视觉里 80% 的图其实不需要 AI 模型来”画”。几何排版、信息图、封面大字、3D 装置感的背景——这些代码设计反而更精准、更可控、更省 token。AI 留给真正需要”想象”的那 20% 即可。
配置也极简:Level 1/2 完全本地,Level 3 只要 Cloudflare key(免费档就够)。仓库里 SKILL.md 写得很清楚,连”密钥千万别提交进 git””误提交立刻去上游 rotate”这种安全细节都讲到了。
上手姿势
把仓库 clone 到 ~/.claude/skills/,重启 Claude Code,对话里直接说”用 level-1 帮我做一个极简 synthwave 海报”或者”跑一下 storybook 流水线”——Claude 会自动接活。三个 level 各有 SKILL.md,前置描述(description)写得精准,触发率很高。
GitHub:https://github.com/massinissa92/claude-image-generation
作者:Hasan Aboul Hasan · MIT License · 2026
适合:品牌设计师、内容创作者、AIGC 玩家、自媒体长图作者、儿童绘本 / 教学材料制作者。
GitHub: https://github.com/massinissa92/claude-image-generation
评论区
登录后可评论。