一个 Skill 搞定所有 AI 生图 API:baoyu-image-gen 体验
不知道你们有没有这种感觉——用 AI 生成图片这件事,API 倒是接了不少,但每次换模型、换平台就要改一堆代码,烦死了。
今天给大家安利一个叫 baoyu-image-gen 的 Skill,真的是我见过最省心的 AI 生图解决方案。
它本质上是一个统一的 AI 图片生成 CLI 工具,但通过 Skill 的形式封装好了提示词逻辑、参数配置和错误处理。你不需要研究每家 API 的细节,一行命令就能调通。
支持多少平台?
我数了一下:OpenAI GPT Image 系列、Google、Gemini、阿里通义(DashScope)、MiniMax、即梦、Seedream、Replicate、OpenRouter、Z.AI……基本上你听过的图片生成 API 它都包了。你可以在配置里设置默认 provider,也可以每次手动指定用哪个。
最戳我的几个功能:
第一个是参考图保持身份一致性。比如你要生成一个人物在不同场景的图,只需要给几张参考图,它会用「保持同一个身份」的提示词策略,而不是简单描述外貌特征——这样出来的脸不会变。
第二个是批量并行生成。配一个 JSON 文件,告诉它生成 20 张图,它会自动控制并发、限速、重试,最后给你一个完整的输出报告。适合做 A/B 测试或者批量素材的场景。
第三个是灵活的质量和比例控制。--quality 2k 或者 --ar 16:9 这种简单参数就能控制输出质量,不用去翻各家文档。
怎么用?
用 bun 来运行:
bun ./scripts/main.ts --prompt "一只橘猫在窗台上晒太阳" --image cat.png --ar 16:9 --quality 2k
指定 provider 也行:
bun ./scripts/main.ts --prompt "一张极简风格的产品海报" --image poster.png --provider openai --model gpt-image-2
适合谁?
如果你经常需要生成各种尺寸、各种风格的 AI 图片,而且手上不只有一个 API key,这个 Skill 真的能省很多对接的功夫。它把所有平台的差异都封装掉了,你只需要专注于写好 prompt。
GitHub 链接附上,感兴趣的自取:https://github.com/JimLiu/baoyu-skills/tree/main/skills/baoyu-image-gen
GitHub: https://github.com/JimLiu/baoyu-skills/tree/main/skills/baoyu-image-gen
评论区
登录后可评论。