ArtAgents:一个用多Agent协作“雕”提示词的开源框架,适合认真做AIGC创作的人

写 prompt 这件事,99% 的人还停留在「输入一句话等出图」的阶段。但真正做 AIGC 创作的人都知道——好的 prompt 是结构化的,是经过反复推敲、层层递进的。

今天挖到一个让我眼前一亮的开源工具:ArtAgents。

它本质上是一个多 Agent 协作的 prompt 工程框架,不是简单的模板生成器,而是让你像导演一样,调度多个专业角色一起去「雕」一个 prompt。

它是怎么工作的?

ArtAgents 底层跑 Ollama(本地 LLM 服务),内置了一套专业 Agent 角色系统:Designer、Photographer、Styler……每个角色都有自己独特的视角和指令逻辑。你输入一个粗浅的想法,系统会调度这些 Agent 协作推演,逐层深化成高质量的图像描述词。

更有意思的是它的Teams 模式——多个 Agent 串成一个工作流,上一步的输出自动传递给下一步,而不是各说各话。这对于需要风格一致性的系列创作特别有用。

三大创意合成策略,我特别喜欢

v0.9.5-alpha(2025年10月)刚更新了三个创意合成策略:

  • Metaphorical Vision:把一个概念用隐喻重新诠释,生成有深度、有诗意的图像描述。适合做抽象概念的可视化。
  • Conceptual Blend:把三个看似无关的概念(具体物品 + 风格/世界 + 抽象主题)强行融合,产出意想不到的创意组合。
  • Stylistic Mashup:内容和形式分开跑——先生成内容,再用一种完全不同的文学风格重写,制造强烈的反差感。

这三个策略本质上是把创意方法论工具化了,不需要你是 prompt 大师,只要你会描述一个方向,ArtAgents 就能帮你结构化地推演出来。

支持多模态输入

你可以直接丢一张图进去,结合文字描述做图像 caption 或图生图提示词工程。这对于需要保持风格/角色一致性的系列创作特别实用。

实际感受

我试了一下「一只赛博朋克风格的机械狐狸」这个方向,Teams 模式下Designer负责构图逻辑、Styler负责视觉风格调性,最后输出的 prompt 比我直接写要丰富得多——加入了「光纤神经脉络」「霓虹反射的湿滑地面」这类细节。

当然它不是银弹,最大的门槛是需要本地跑 Ollama,对硬件有一点要求。但如果你在认真做 AIGC 创作,这个框架值得花时间玩通。

基础信息

适合谁用:prompt 工程师、AI 艺术家、想系统化探索创意生成流程的创作者。


GitHub: https://github.com/sandner-art/ArtAgents

评论区

0 条评论

登录后可评论。

赵一凡 126 阅读