用Stable Diffusion给AI装上”画笔”!这个Skill让我用Python就能生成顶级图片
AI画图已经不是什么新鲜事了,但今天要说的这个 Skill——stable-diffusion-image-generation,是真的把 Stable Diffusion 的能力做成了一键可用的工作流,装到 Claude Code 里直接调用,体验完全不一样。
先说能做啥
这个 Skill 底层用的是 HuggingFace Diffusers 库,支持的功能非常全:
– Text-to-Image:输入文字描述,直接出图
– Image-to-Image:喂一张图,让AI帮你风格迁移或增强
– Inpainting/Outpainting:局部修改或向外扩展画面
– ControlNet:用边缘、姿态、深度图控制构图
– LoRA 支持:加载微调模型,做风格适配
– 多模型:SD 1.5、SDXL、SD 3.0、Flux 全支持
安装只要一条命令
pip install diffusers transformers accelerate torch
然后两行代码就能出图:
from diffusers import DiffusionPipeline
import torch
pipe = DiffusionPipeline.from_pretrained(
"stable-diffusion-v1-5/stable-diffusion-v1-5",
torch_dtype=torch.float16
)
pipe.to("cuda")
image = pipe(
"A serene mountain landscape at sunset, highly detailed",
num_inference_steps=50,
guidance_scale=7.5
).images[0]
image.save("output.png")
SDXL 模式质量更高,支持 1024×1024 输出,加载方式几乎一样。
实际体验
我试了用它做产品配图——输入”minimalist skincare product on marble surface, soft lighting”,20秒出四张候选,选一张微调,5分钟搞定一套详情页素材。和以前用 Midjourney 相比,这个在本地跑,不限次数,隐私也好。
如果你在搭 AI 内容工作流,或者想让 Claude Code 帮你生成配图、插画、UI 素材,这个 Skill 值得装上。
GitHub 链接:https://github.com/NousResearch/hermes-agent/tree/main/optional-skills/mlops/stable-diffusion
GitHub: https://github.com/NousResearch/hermes-agent/tree/main/optional-skills/mlops/stable-diffusion
评论区
登录后可评论。