这个 0.1 元一张的国产 AI 海报神器,真把汉字渲染干到开源第一了
说一句可能得罪同行的话——现在大多数 AI 生图模型,在「画一张含大量中文的海报」这件事上还是让人想砸键盘。文字渲染糊成一坨、汉字笔画七零八落、排版逻辑混乱,这是几乎所有海外 Diffusion 模型的通病。
但今天安利的这个 Skill,来自一个被很多人忽视的玩家:智谱 AI(zai-org) 的 GLM-Image。它最牛的地方不是「画得像」,而是「能看懂你要什么文字、按你要的位置写上去」。在 LongText-Bench 中文榜上,它直接干到开源第一,汉字渲染准确率 0.9788——这是真正的「中文友好」,不是营销话术。
它是什么
这是一个官方出品的 Claude Code / Codex Skill,GitHub 仓库 zai-org/GLM-Image,1k+ stars,MIT 协议。SKILL.md 是中英双语写的,作者直接把它定位成「海报、社交媒体图文、科普插画、人像」四类场景的官方工具。
底层模型 GLM-Image 用了「自回归 + 扩散解码器」的混合设计——简单说就是先用语言模型理解你的需求,再用扩散模型出图。这套架构让它在「信息密集型」场景(文案+人物+产品+排版)表现远超纯 SD 系模型。
能干啥(实际能交付的活)
- 商业海报:产品图 + 标题 + 副标 + 价格标签,一张图里全给你排好
- 小红书 / 公众号封面:中文标题清晰可读,不再出现「鬼画符」汉字
- 科普插画:流程图、原理示意,文字和图形一致性强
- 高质量人像:HD 模式约 20 秒出一张,细节精致
- 产品 mockup:电商图、详情页主图
怎么用
上手门槛极低:
- 去智谱开放平台申请一个
ZHIPU_API_KEY - 把这个 Skill 安装到 Claude Code 或 Codex:
npx skills add https://github.com/zai-org/GLM-Image --skill glm-image-generation - 在 Claude 里直接说「帮我画一张小红书风格的 XX 海报」,它自己会调 API 出图
支持的比例很全:1:1、3:2、2:3、16:9、9:16、4:3、3:4,还有 1024 / 1280 / 1568 / 1728 / 1472 几个常用尺寸,自定义尺寸只要是 32 的倍数都行。最关键的:每张图 0.1 元(API 定价),批量出图不心疼。
为什么搬运这个
海外模型强在美学,国产模型强在中文场景的「可用性」。GLM-Image 不是让你画一只猫一只狗炫技的——它是让你真正交付一张能挂淘宝、能发公众号、能投信息流的图。
做小红书电商、做公众号头图、做品牌物料的设计师朋友,这个 Skill 可以直接进你的工作流。装上,跑两条 prompt 试试,你会回来谢我。
仓库地址(顺手 Star 一下):https://github.com/zai-org/GLM-Image
评论区
登录后可评论。