一个 Skill 打通关 Google 和 OpenAI 两大家:image-gen 测评

最近在做 AI 项目,想给 Claude Code 配一个能”随时出图”的 Skillimage-gen 这个开源 Skill 同时打通了 Google Gemini 和 OpenAI GPT-Image 两条路,而且会自己判断该用哪个模型——你只管说想要什么,工具自己搞定。

一个 Skill,两家模型

市面上的图片生成工具要么绑 Google、要么绑 OpenAI,换个模型还得改配置。image-gen 打破了这个壁垒,它同时支持六种模型:

  • Gemini Nano Banana — 速度快、并发高,适合批量出图
  • Gemini Nano Banana Pro — 支持 4K 分辨率,复杂场景首选
  • GPT-Image-1 — OpenAI 通用图像生成
  • GPT-Image-1.5 — 透明背景、图标设计用它最稳
  • GPT-Image-2 — 文字渲染能力最强,画海报神器
  • GPT-Image-Mini — 成本敏感型任务的性价比选择

智能选模型,你不用操心

这个 Skill 最贴心的地方在于自动模型选择。你告诉它”生成一个透明背景的图标”,它自动选 GPT-Image-1.5;说”4K 海报”,它切到 Nano Banana Pro;说”快速草稿”,它选最快最省钱的。

也可以手动指定模型:--model gpt-image-2 就能强制用某一特定模型。

迭代修图,不用重新来

最讨厌的情况:生成了一张图,大部分满意,就差一点点细节。image-gen 支持迭代修图,用 edit 命令直接对上一张图做局部调整,保留原图主体,只改你想改的地方。

透明背景、小图标,一次搞定

做 UI 设计的朋友注意了——--transparent 参数直接输出透明背景 PNG,不用再找工具去背。配合 GPT-Image-1.5,图标、logo、UI 元素都能快速出。

使用方式

在 Claude Code 里安装后,直接说话就能驱动:

  • ~/.claude/skills/image-gen/generate.py generate "一只穿西装的猫" --aspect-ratio 16:9 --image-size 4K
  • ~/.claude/skills/image-gen/generate.py edit "加一顶礼帽" -i cat.png
  • ~/.claude/skills/image-gen/generate.py generate "透明背景图标" --transparent

适合谁用

设计师/产品经理:快速出产品原型图、UI 素材,不用开设计软件
内容创作者:生成配图、社交媒体封面、博客插图
开发者:在 Claude Code 里直接出图,写文档、写 README 更高效

一个 Skill 解决「生成→修图→输出」全流程,而且同时兼容 Google 和 OpenAI 两大生态——在 AI 图片工具快速迭代的当下,这种双线支持的技能树比单线选手更抗打。

GitHubhttps://github.com/grizzdank/image-gen


GitHub: https://github.com/grizzdank/image-gen

评论区

0 条评论

登录后可评论。

苏棠 9 阅读