GPT-Image2-Skill:把 GPT Image 2 提示词变成可复用的 Agent Skill

GPT-Image2-Skill:把 GPT Image 2 提示词变成可复用的 Agent Skill

GPT-Image2-Skill 是一个将 OpenAI GPT Image 2 图像生成能力封装为可复用 Skill 的开源项目,同时提供一套精选提示词库和 CLI 工具,支持 Claude Code / Codex / OpenClaw / Hermes Agent 等主流 Agent 运行时。不同于单纯的提示词合集,它把每一类图像场景的生成方法论结构化,让 AI 出图从「碰运气」变为「可控生产」。该项目在 oosmetrics 上同时登顶 Agents / LLMs / CLI 三榜 Top 1。

功能与原则

核心能力:将 GPT Image 2 的图像生成能力通过 SKILL.md 封装为 Agent 可调用的专业技能,包含精选提示词库、参考示例和工作流指引。

设计原则
精选 over 海量:只保留经过验证、能稳定复现的提示词,不搞刷量堆砌
场景覆盖全面:研究论文图、国风海报、UI 原型、游戏 HUD、动漫角色、摄影、字体设计、地图、刺青图案、参考图编辑均有收录
多运行时兼容:Claude Code 插件、Codex Skill、npx skills CLI 三种安装方式均支持
CLI + Skill 双形态:既可通过自然语言调用 Skill 生成,也可通过 gpt-image CLI 精确控制

认可度

  • GitHub Star:4,243(截至 2026-08-09)
  • Forks:361
  • 最近更新:2026-07-20
  • oosmetrics 排名:同时登顶 Agents / LLMs / CLI 三榜 Top 1(按增速)
  • 支持运行时:Claude Code、Codex、OpenClaw、Hermes Agent,以及 npx skills 跨运行时安装

链接

GitHub:https://github.com/wuyoscar/GPT-Image2-Skill

原作者

GitHub Username:wuyoscar

专注于 AI 图像生成与 Agent 工具链的独立开发者,将 OpenAI 官方能力与开源 Skill 生态连接起来。项目有英文 + 中文双语文档。

介绍

GPT Image 2 是 OpenAI 推出的图像生成模型,具备极高的文本理解和风格控制能力。但普通用户在实际使用时往往面临两个问题:不知道如何描述需求才能生成理想图像,以及不同场景需要完全不同的提示词策略。

wuyoscar 在使用 GPT Image 2 的过程中,将高频场景的提示词整理为结构化库,并配合 SKILL.md 封装成 Agent 可直接调用的 Skill。每个提示词目录都包含:场景说明、参考示例、可直接复制的提示词文本,以及最佳实践说明。

支持的图像类型包括:研究论文图表(Figure)、海报设计、UI/UX 原型、游戏 HUD 界面、动漫 / 漫画角色、摄影作品、字体排版、地图可视化、刺青图案、参考图编辑工作流等。项目还维护了一个精选展示区(showcase),展示各类提示词的实际生成效果。

特点

  • 提示词精选库:覆盖 10+ 主流图像场景,每个提示词经过实际生成验证
  • Agent 原生集成:以 SKILL.md 形式封装,Claude Code / Codex 等运行时可直接触发
  • 双语支持:英文 + 中文文档,中文用户零门槛上手
  • CLI 工具:gpt-image CLI 支持非 Agent 场景下的精确图像生成控制
  • 参考图编辑:支持将现有图像作为参考,结合提示词生成变体或衍生图
  • MIT 许可:完全开源,可自由fork、改编、集成到自己的工具链
  • 社区活跃:持续更新,欢迎 PR,场景覆盖还在不断扩展

使用方法

安装 Skill(Claude Code)

/plugin marketplace add wuyoscar/gpt_image_2_skill
/plugin install gpt-image@wuyoscar-skills

安装 Skill(Codex)

npx --yes skills@latest add wuyoscar/gpt_image_2_skill 
  --skill gpt-image --agent codex --copy

手动安装

git clone https://github.com/wuyoscar/gpt_image_2_skill.git
cd gpt_image_2_skill
cp -R skills/gpt-image ~/.codex/skills/

基本调用

在 Claude Code / Codex 中直接描述需求,Skill 会自动匹配场景并生成优化后的提示词:

帮我生成一个中国风水墨风格海报,主标题是"清明"

Agent 会调用对应的 gpt-image 提示词,结合风格参数生成图像。

使用场景与人群

适用场景
– 研究人员快速生成论文图表的参考图和风格样例
– UI/UX 设计师制作高保真原型(无需 Figma,直接描述生成)
– 游戏开发者生成 HUD 界面、角色立绘、场景概念图
– 内容创作者制作国风海报、社交媒体配图、字体设计
– 任何需要 AI 可控图像生成的 Agent 工作流扩展

目标用户
– 使用 Claude Code、Codex、OpenClaw 等 Agent 工具的开发者
– 需要高质量提示词参考的 AI 图像创作者
– 希望将图像生成能力集成到自己 Agent 工作流的技术团队

输入与输出案例

案例一:生成 UI 原型

输入(对 Agent 说):

帮我生成一个电商 App 的首页原型,商品卡片是圆角白色卡片

Skill 自动调用 gallery-ui-ux-mockups.md 中的提示词模板,生成包含具体尺寸、间距、色彩规范的完整提示词,GPT Image 2 输出可直接用于开发参考的高保真原型图。

案例二:生成国风海报

输入:

用宋代夜市风格做一个活动海报,主标题”上元灯会”

Skill 匹配中文场景目录,从 gallery-chinese-style.md 调取已验证的宋代风格提示词模板,自动注入主标题并保持古画质感、灯火氛围和传统色彩体系,生成结果具有强视觉一致性和文化准确性。


GitHub: https://github.com/wuyoscar/GPT-Image2-Skill

评论区

0 条评论

登录后可评论。

Skill超级捕获手 12 阅读