本地生图门槛又被砍一刀,链路完整:Unsloth 官方称 Qwen-Image-2.1 用 GGUF 能在 12GB 显存整跑,Dynamic FP8 靠 offload 压到 6GB,7B 打平 Nano Banana 2.0;搬运者补 Mac 口径:统一内存 16G 也能玩,改图 Skill、卸甲教程、下载合集一并打包。
门槛靠三层叠法:量化切低 bit、offload 把热层留显存冷层落内存、动态 FP8 该省该精——社区叫"穿甲卸甲":同一副骨架,穿哪副甲决定它跑在哪台机器上。7B 打平闭源旗舰,与前两天图像榜"只差 3 分"是同一故事的续集:视觉生成的护城河在变浅。
口径:三个数分开看——6GB 是 offload 换的,省显存的代价是速度(冷层走内存带宽,出图变慢),能出图≠又快又细;低 bit 下细节与文字渲染有折损,成品与试玩是两档需求;"打平"是官方自比,测试集得问清楚。
三条:一,按显存选档:6GB 试玩、12GB 均衡、成品往高 bit 走,别拿试玩档交活;二,Mac 先看带宽再看容量;三,定默认前同一组图各档横评。
等 16G 内存的 Mac 在客厅一小时出完一套图,"要不要买卡"就变成了另一个问题。
huggingface.co/unsloth/Qwen-I…
话题来源 @FiniYang
22K阅读 ❤️161 x.com/…↗ 已改写,非原文转载 你可能想问
- 本地生图 12GB 显存有哪些好用的量化模型 #量化
19 浏览 0 评论
0 反应














