让 Claude Code 替你画图!这个 Skill 把 Gemini 和 GPT-Image 全打包了

AI 画图这件事,门槛早就不是「会不会画」了——而是「选什么模型、怎么调参数、怎么管理一堆 Prompt」。今天挖到一个 Claude Code Skill,叫 image-gen,把 Google Gemini 和 OpenAI gpt-image 全家桶打包到一个脚本里,还自带模型自动选择,真的很懂创作者的需求。

一个脚本,搞定所有 AI 画图场景

image-gen 本质上是一个 Python 脚本,装进 Claude Code 的 skills 目录后,你只要用自然语言描述想要什么,它就能调对应模型生成。具体支持这些模型:

  • Gemini 2.5 Flash Image(nano-banana)——速度快、批量出图首选
  • Gemini 3 Pro Image(nano-banana-pro)——4K 分辨率,复杂场景
  • GPT-Image-1 / 1.5 / 2 / Mini(OpenAI 全家桶)——各有所长,1.5 最稳,2 文字渲染最强

最戳我的三个功能

1. 模型自动选择,不用你想
脚本会根据你的 Prompt 关键词自动判断用哪个模型:提到「透明背景」→ 选 gpt-image-1.5;提到「4K/海报」→ 选 Gemini 3 Pro;提到「快速/草图」→ 选 Gemini 2.5 Flash。你不需要记模型名字,说人话就行。

2. 迭代改图,不重新开始
「在上一张图基础上加一艘帆船」——直接 edit 命令搞定,不用重复描述整个场景。Session 会自动记住当前图片和输出目录,改图效率翻倍。

3. 透明背景图标,一句话搞定
做 Icon、UI 素材、游戏 Sprite 最怕白底。这个 Skill 支持 --transparent 参数,自动选支持透明通道的模型,生成的是真正的 PNG 透明素材。

适合谁用

设计师做概念稿、产品经理出原型插图、独立开发者做 App 图标/配图、创作者做社交媒体内容——只要你在 Claude Code 里干活,这个 Skill 能省掉你在 Midjourney/DALL-E/IDE 之间来回切换的痛苦。

怎么装

三步搞定:

git clone https://github.com/grizzdank/image-gen.git ~/.claude/skills/image-gen
cd ~/.claude/skills/image-gen
python3 -m venv .venv && source .venv/bin/activate && pip install -r requirements.txt

然后配置一下 API Key(OpenRouter + OpenAI),就可以开用了。GitHub 上有完整文档。

👉 https://github.com/grizzdank/image-gen


GitHub: https://github.com/grizzdank/image-gen

评论区

0 条评论

登录后可评论。

苏棠 10 阅读