让 AI 自己决定怎么出图:OpenAI 官方生图 Skill 来了

别人还在 Midjourney 网页版一张张出图,你已经让 AI 自己写 prompt、自己调参数、批量跑完一套产品图了。

这就是 openai/imagegen 干的事——一个 OpenAI 官方推出的生图 Skill,专门给 AI Agent 用的。生图这事儿,从”我描述 → AI 出图”的单次交互,正式进入了”AI 自己决定怎么出、出什么、出多少”的自动化阶段。

它能做什么

一句话:接上 OPENAI_API_KEY,Agent 就能听懂”给我生成一张产品主图”这类指令,然后自己调用 OpenAI 的图像模型完成。

具体场景包括:

  • 图生成:输入描述,直接出图
  • 局部重绘(inpaint/mask):只想改图里某个部分?没问题
  • 背景抠除 / 替换:一键去背景,或者换个新背景
  • 透明背景:电商主图必备技能
  • 产品图 / 概念图 / 封面图:各种商业场景
  • 批量变体:一次出多个尺寸或风格版本

底层跑的是 scripts/image_gen.py 这个 CLI 脚本,只要环境变量里有 OPENAI_API_KEY,装上就能用。支持 GPT-Image-1(OpenAI 最新生图模型),也兼容 DALL-E 系列接口。

为什么值得关注

之前的 AI 生图工具,本质上都是”人机交互”——人描述,AI 出。但当 Agent 有了这个 Skill,生图就变成了”AI 工作流”的一部分:

  • AI 可以自己判断什么时候需要配图
  • 自己写合适的 prompt(它知道什么 prompt 效果好)
  • 自己调用 API、自己处理结果
  • 整个过程不需要人盯着

举个例子:运营要发一篇推文,Agent 可以自动判断需要一张封面图 → 自己写 prompt → 调用 imagegen → 直接产出可用图片。整个链路不用人工介入。

适合谁用

设计:快速出概念稿、批量尝试不同风格
内容创作者:不用切换工具,AI 直接配图
电商店主:批量生成主图、换背景、出一整套变体图
开发者:把生图能力嵌进自己的 AI 应用或 Agent 工作流

怎么装

在 Claude Code / Codex / Cursor 等支持 Skills 的 AI 编程工具里,直接导入这个 Skill 即可。Smithery 平台上有安装指引,支持 20+ 种 Agent 平台。设置好 OPENAI_API_KEY,说干就干。

GitHub 仓库是 openai/skills,目前 7,309 Stars,是 OpenAI 官方的 Skill 库,质量和更新都有保障。

以后别说”帮我生张图”了——让 AI 自己决定什么时候生、怎么生。这才是 AI 时代该有的工作方式。


GitHub: https://github.com/openai/skills

评论区

0 条评论

登录后可评论。

赵一凡 14 阅读