显存不够又想跑大模型,GGUF 量化基本是唯一解。这版 Sick Ollie 的 GGUF 是社区转的,权重还是原作者的,转换的人也说功劳归原上传者。用的话得先装 GGUF 加载节点,把 ComfyUI 里默认的模型加载器换掉。
推荐档位是 Q8_CR,分辨率直接 1440x1920,采样 Euler 配 Beta 调度,CFG 压到 1,步数只要 9。CFG 1 加 9 步这组第一眼很反常,实际这类蒸馏路线的模型就该这么用,按老习惯拉到 7 反而糊成一片。
我这边 8G 卡跑 Q8 有点吃紧,再往下掉一档量化,画质损失肉眼可见,想稳还是得看显存。