GPT-Image2-Skill:把 GPT Image 2 提示词变成可复用的 Agent Skill
GPT-Image2-Skill:把 GPT Image 2 提示词变成可复用的 Agent Skill
GPT-Image2-Skill 是一个将 OpenAI GPT Image 2 图像生成能力封装为可复用 Skill 的开源项目,同时提供一套精选提示词库和 CLI 工具,支持 Claude Code / Codex / OpenClaw / Hermes Agent 等主流 Agent 运行时。不同于单纯的提示词合集,它把每一类图像场景的生成方法论结构化,让 AI 出图从「碰运气」变为「可控生产」。该项目在 oosmetrics 上同时登顶 Agents / LLMs / CLI 三榜 Top 1。
功能与原则
核心能力:将 GPT Image 2 的图像生成能力通过 SKILL.md 封装为 Agent 可调用的专业技能,包含精选提示词库、参考示例和工作流指引。
设计原则:
– 精选 over 海量:只保留经过验证、能稳定复现的提示词,不搞刷量堆砌
– 场景覆盖全面:研究论文图、国风海报、UI 原型、游戏 HUD、动漫角色、摄影、字体设计、地图、刺青图案、参考图编辑均有收录
– 多运行时兼容:Claude Code 插件、Codex Skill、npx skills CLI 三种安装方式均支持
– CLI + Skill 双形态:既可通过自然语言调用 Skill 生成,也可通过 gpt-image CLI 精确控制
认可度
- GitHub Star:4,243(截至 2026-08-09)
- Forks:361
- 最近更新:2026-07-20
- oosmetrics 排名:同时登顶 Agents / LLMs / CLI 三榜 Top 1(按增速)
- 支持运行时:Claude Code、Codex、OpenClaw、Hermes Agent,以及 npx skills 跨运行时安装
链接
GitHub:https://github.com/wuyoscar/GPT-Image2-Skill
原作者
GitHub Username:wuyoscar
专注于 AI 图像生成与 Agent 工具链的独立开发者,将 OpenAI 官方能力与开源 Skill 生态连接起来。项目有英文 + 中文双语文档。
介绍
GPT Image 2 是 OpenAI 推出的图像生成模型,具备极高的文本理解和风格控制能力。但普通用户在实际使用时往往面临两个问题:不知道如何描述需求才能生成理想图像,以及不同场景需要完全不同的提示词策略。
wuyoscar 在使用 GPT Image 2 的过程中,将高频场景的提示词整理为结构化库,并配合 SKILL.md 封装成 Agent 可直接调用的 Skill。每个提示词目录都包含:场景说明、参考示例、可直接复制的提示词文本,以及最佳实践说明。
支持的图像类型包括:研究论文图表(Figure)、海报设计、UI/UX 原型、游戏 HUD 界面、动漫 / 漫画角色、摄影作品、字体排版、地图可视化、刺青图案、参考图编辑工作流等。项目还维护了一个精选展示区(showcase),展示各类提示词的实际生成效果。
特点
- 提示词精选库:覆盖 10+ 主流图像场景,每个提示词经过实际生成验证
- Agent 原生集成:以 SKILL.md 形式封装,Claude Code / Codex 等运行时可直接触发
- 双语支持:英文 + 中文文档,中文用户零门槛上手
- CLI 工具:gpt-image CLI 支持非 Agent 场景下的精确图像生成控制
- 参考图编辑:支持将现有图像作为参考,结合提示词生成变体或衍生图
- MIT 许可:完全开源,可自由fork、改编、集成到自己的工具链
- 社区活跃:持续更新,欢迎 PR,场景覆盖还在不断扩展
使用方法
安装 Skill(Claude Code):
/plugin marketplace add wuyoscar/gpt_image_2_skill
/plugin install gpt-image@wuyoscar-skills
安装 Skill(Codex):
npx --yes skills@latest add wuyoscar/gpt_image_2_skill
--skill gpt-image --agent codex --copy
手动安装:
git clone https://github.com/wuyoscar/gpt_image_2_skill.git
cd gpt_image_2_skill
cp -R skills/gpt-image ~/.codex/skills/
基本调用:
在 Claude Code / Codex 中直接描述需求,Skill 会自动匹配场景并生成优化后的提示词:
帮我生成一个中国风水墨风格海报,主标题是"清明"
Agent 会调用对应的 gpt-image 提示词,结合风格参数生成图像。
使用场景与人群
适用场景:
– 研究人员快速生成论文图表的参考图和风格样例
– UI/UX 设计师制作高保真原型(无需 Figma,直接描述生成)
– 游戏开发者生成 HUD 界面、角色立绘、场景概念图
– 内容创作者制作国风海报、社交媒体配图、字体设计
– 任何需要 AI 可控图像生成的 Agent 工作流扩展
目标用户:
– 使用 Claude Code、Codex、OpenClaw 等 Agent 工具的开发者
– 需要高质量提示词参考的 AI 图像创作者
– 希望将图像生成能力集成到自己 Agent 工作流的技术团队
输入与输出案例
案例一:生成 UI 原型
输入(对 Agent 说):
帮我生成一个电商 App 的首页原型,商品卡片是圆角白色卡片
Skill 自动调用 gallery-ui-ux-mockups.md 中的提示词模板,生成包含具体尺寸、间距、色彩规范的完整提示词,GPT Image 2 输出可直接用于开发参考的高保真原型图。
案例二:生成国风海报
输入:
用宋代夜市风格做一个活动海报,主标题”上元灯会”
Skill 匹配中文场景目录,从 gallery-chinese-style.md 调取已验证的宋代风格提示词模板,自动注入主标题并保持古画质感、灯火氛围和传统色彩体系,生成结果具有强视觉一致性和文化准确性。
评论区
登录后可评论。