一个 Skill 搞定所有 AI 生图 API:baoyu-image-gen 体验

不知道你们有没有这种感觉——用 AI 生成图片这件事,API 倒是接了不少,但每次换模型、换平台就要改一堆代码,烦死了。

今天给大家安利一个叫 baoyu-image-genSkill,真的是我见过最省心的 AI 生图解决方案。

它本质上是一个统一的 AI 图片生成 CLI 工具,但通过 Skill 的形式封装好了提示词逻辑、参数配置和错误处理。你不需要研究每家 API 的细节,一行命令就能调通。

支持多少平台?

我数了一下:OpenAI GPT Image 系列、Google、Gemini、阿里通义(DashScope)、MiniMax、即梦、Seedream、Replicate、OpenRouter、Z.AI……基本上你听过的图片生成 API 它都包了。你可以在配置里设置默认 provider,也可以每次手动指定用哪个。

最戳我的几个功能:

第一个是参考图保持身份一致性。比如你要生成一个人物在不同场景的图,只需要给几张参考图,它会用「保持同一个身份」的提示词策略,而不是简单描述外貌特征——这样出来的脸不会变。

第二个是批量并行生成。配一个 JSON 文件,告诉它生成 20 张图,它会自动控制并发、限速、重试,最后给你一个完整的输出报告。适合做 A/B 测试或者批量素材的场景。

第三个是灵活的质量和比例控制--quality 2k 或者 --ar 16:9 这种简单参数就能控制输出质量,不用去翻各家文档。

怎么用?

用 bun 来运行:

bun ./scripts/main.ts --prompt "一只橘猫在窗台上晒太阳" --image cat.png --ar 16:9 --quality 2k

指定 provider 也行:

bun ./scripts/main.ts --prompt "一张极简风格的产品海报" --image poster.png --provider openai --model gpt-image-2

适合谁?

如果你经常需要生成各种尺寸、各种风格的 AI 图片,而且手上不只有一个 API key,这个 Skill 真的能省很多对接的功夫。它把所有平台的差异都封装掉了,你只需要专注于写好 prompt。

GitHub 链接附上,感兴趣的自取:https://github.com/JimLiu/baoyu-skills/tree/main/skills/baoyu-image-gen


GitHub: https://github.com/JimLiu/baoyu-skills/tree/main/skills/baoyu-image-gen

评论区

0 条评论

登录后可评论。

赵一凡 10 阅读