OpenAI 官方 imagegen:把 AIGC 流水线塞进 Claude 的设计师神器
做了两年 AIGC,最被问到的一个问题是「AI 出图这么强,但我写 prompt 怎么还是不对味?」——其实问题往往不在 prompt 本身,而在你跟模型的协作流程没沉淀下来。今天安利的是 OpenAI 官方仓库里把这件事做成「开箱即用流程」的一个 Skill:imagegen。
为什么我把它当 AIGC 工作流标配
在 OpenAI 自己的 openai/skills 仓库(28k stars)里,imagegen 不是那种教你「prompt 模板大全」的笔记型 Skill,而是一个真正能跑通的图像生成+编辑流水线。它明确把工作模式分成两层:
- 默认模式(首选):直接用 Codex 内置的
image_gen工具生成/编辑图像,不用配OPENAI_API_KEY,免账号也能跑; - Fallback CLI 模式:走
scripts/image_gen.py,对外暴露generate、edit、generate-batch三个子命令——批量出图、Inpainting 编辑、参考图风格迁移全包了。
对设计师来说,最香的是它强制执行「分层输出策略」:默认把生成的图落到 $CODEX_HOME/generated_images/ 这种「预览沙盒」里,等你确认效果后再手动 move/copy 到项目目录。不会出现那种「AI 自动把图塞进 git 仓库,你不想用也得回滚一次」的尴尬。
三个我天天在用的真实场景
1. Hero 大图 + 透明背景素材:写一句「清晨雾气里的玻璃质感咖啡杯,留白构图」,让 Codex 走默认模式直接出图,透明背景走 Clipdrop 风格的 fall-back 通道。文件名走 hero-v2.png 这种带版本号的命名,不会污染原资产。
2. 品牌物料批量迭代:用 generate-batch + JSONL,一次性跑 20 张候选 banner,输出落到 output/imagegen/ 下方便 A/B 对比。这种「一次生成多条赛道」的玩法,传统设计师一个人干要两小时,现在喝杯水的功夫。
3. 老图二次创作:给一张产品照,配 prompt「换深色背景、阴影更柔和、保留高光细节」,走 edit 子命令原地微调。比再开一个修图软件快得多。
踩坑预警
有两点要注意:① 千万不要让默认模式自动覆盖你已有的项目资产——它会强制走「版本号文件名」策略,但如果你手动指了路径就另说;② Fallback CLI 模式要求 OPENAI_API_KEY 且需要 Org 已验证 gpt-image-1,没开权限的同学先用默认模式就够了。
写在最后
imagegen 让我重新相信「官方 Skill」不等于「PPT Skill」——它把 OpenAI 自己内部的图像工作流沉淀下来了,既给普通创作者兜底(零配置),又给重度用户留了 CLI 出口。对于要把 AIGC 嵌入日常设计流程的人来说,这套才是真正的「生产力范式」。
👉 仓库直达:https://github.com/openai/skills(在 skills/.system/imagegen/ 目录下)
GitHub: https://github.com/openai/skills
评论区
登录后可评论。