一个 Skill 打通关 Google 和 OpenAI 两大家:image-gen 测评
最近在做 AI 项目,想给 Claude Code 配一个能”随时出图”的 Skill?image-gen 这个开源 Skill 同时打通了 Google Gemini 和 OpenAI GPT-Image 两条路,而且会自己判断该用哪个模型——你只管说想要什么,工具自己搞定。
一个 Skill,两家模型
市面上的图片生成工具要么绑 Google、要么绑 OpenAI,换个模型还得改配置。image-gen 打破了这个壁垒,它同时支持六种模型:
- Gemini Nano Banana — 速度快、并发高,适合批量出图
- Gemini Nano Banana Pro — 支持 4K 分辨率,复杂场景首选
- GPT-Image-1 — OpenAI 通用图像生成
- GPT-Image-1.5 — 透明背景、图标设计用它最稳
- GPT-Image-2 — 文字渲染能力最强,画海报神器
- GPT-Image-Mini — 成本敏感型任务的性价比选择
智能选模型,你不用操心
这个 Skill 最贴心的地方在于自动模型选择。你告诉它”生成一个透明背景的图标”,它自动选 GPT-Image-1.5;说”4K 海报”,它切到 Nano Banana Pro;说”快速草稿”,它选最快最省钱的。
也可以手动指定模型:--model gpt-image-2 就能强制用某一特定模型。
迭代修图,不用重新来
最讨厌的情况:生成了一张图,大部分满意,就差一点点细节。image-gen 支持迭代修图,用 edit 命令直接对上一张图做局部调整,保留原图主体,只改你想改的地方。
透明背景、小图标,一次搞定
做 UI 设计的朋友注意了——--transparent 参数直接输出透明背景 PNG,不用再找工具去背。配合 GPT-Image-1.5,图标、logo、UI 元素都能快速出。
使用方式
在 Claude Code 里安装后,直接说话就能驱动:
~/.claude/skills/image-gen/generate.py generate "一只穿西装的猫" --aspect-ratio 16:9 --image-size 4K~/.claude/skills/image-gen/generate.py edit "加一顶礼帽" -i cat.png~/.claude/skills/image-gen/generate.py generate "透明背景图标" --transparent
适合谁用
设计师/产品经理:快速出产品原型图、UI 素材,不用开设计软件
内容创作者:生成配图、社交媒体封面、博客插图
开发者:在 Claude Code 里直接出图,写文档、写 README 更高效
一个 Skill 解决「生成→修图→输出」全流程,而且同时兼容 Google 和 OpenAI 两大生态——在 AI 图片工具快速迭代的当下,这种双线支持的技能树比单线选手更抗打。
GitHub:https://github.com/grizzdank/image-gen
评论区
登录后可评论。