设计师做 AIGC 别再换模型换到崩溃了——这个 Skill 一行参数打通 OpenRouter 全家桶

设计的人最近都在怨一件事:模型太多,挑花眼。
Gemini 出图、FLUX 出质、Seedream 出构图、Recraft 出矢量、GPT-Image 出品牌感——每个都强,但每个都要单独攒 prompt 链子、单独配 key、单独写 fallback。

直到我刷到 K-Dense-AI 的这个 generate-image Skill,repo 总星 31.5k,才意识到:原来真正的解法不是「挑一个最好用的模型」,而是「一个接口打穿所有」。

它到底在干啥

简单说:一个脚本,30+ 个生图模型,想换就换

背后接的是 OpenRouter Image API,把 Gemini / FLUX / Seedream / Recraft / GPT-Image 这些头部出图模型统一成一种请求形状,Claude / Cursor / Codex / Antigravity 一调就出图。

  • 一行命令生图python scripts/generate_image.py "A beautiful sunset over mountains"
  • 一键改图-i photo.jpg 喂参考图,加 prompt 直接改天空、改色调、抠主体
  • 自动按模型分配参数:传错参数会被服务器拒——脚本只发目标模型支持的字段,所以你不用背每个模型的 flag 列表

设计师最爱的三个细节

第一,矢量自由。要 logo / icon / 可二次编辑的矢量图?换 recraft/recraft-v4-vector 模型就行,输出 SVG,可以直接拖进 Figma 再改。

第二,预算可控--list-models 不耗 key,能先看一圈;真出图才计费,每张返回里会带上 usage.cost,账单一目了然。

第三,Seedream 出多图、GPT-Image 出透明底。要做一整套视觉素材、又想要 PNG 直接落到 web,参数一改就切,对设计交付来说省了至少半天抠图时间。

适合谁用

  • 品牌设计师:要 logo / 海报 / 活动 KV 一次性出 5 个方向再挑
  • 新媒体运营:把参考图丢进去,让 Claude 帮你「按这个调性改三版」
  • 前端开发:配 gpt-image-2 + --background transparent 直接拿透明底 PNG,省 PS
  • AIGC 玩家:一个 key 玩遍 GPT、Gemini、FLUX,不用再单独搞账号/账单

30 秒上手

# 装 Skill
git clone https://github.com/K-Dense-AI/scientific-agent-skills.git
# 设 key(去 https://openrouter.ai/keys 领一个)
export OPENROUTER_API_KEY=sk-or-...
# 出图
python skills/generate-image/scripts/generate_image.py 
  "Minimalist poster for a coffee brand, warm beige tone, hand-drawn type" 
  -o coffee-poster.png

然后把这张图丢给 Claude Code,让它顺便帮你写一段主视觉说明,整套物料就齐了。

一句话总结

设计师做 AIGC,最怕的不是「模型不强」,是「换模型太烦」。
这个 Skill 把换模型变成换一行参数——在这个意义上,它比任何单一生图模型都更值得装。

👉 GitHub:https://github.com/K-Dense-AI/scientific-agent-skills/tree/main/skills/generate-image
(顺便 star 一下主仓库,31.5k 星的科学 Agent Skills 库,里面还有 156 个现成工作流)


笔者简介:赵一凡,AI 设计 / AIGC 方向创作者,专注搬运海外前沿 Skill 与创意工具到中文圈。


GitHub: https://github.com/K-Dense-AI/scientific-agent-skills/tree/main/skills/generate-image

评论区

0 条评论

登录后可评论。

赵一凡 18 阅读