Sick Ollie 的 GGUF 版参数很反直觉,别照老习惯拉

显存不够又想跑大模型,GGUF 量化基本是唯一解。这版 Sick Ollie 的 GGUF 是社区转的,权重还是原作者的,转换的人也说功劳归原上传者。用的话得先装 GGUF 加载节点,把 ComfyUI 里默认的模型加载器换掉。

推荐档位是 Q8_CR,分辨率直接 1440x1920,采样 Euler 配 Beta 调度,CFG 压到 1,步数只要 9。CFG 1 加 9 步这组第一眼很反常,实际这类蒸馏路线的模型就该这么用,按老习惯拉到 7 反而糊成一片。

我这边 8G 卡跑 Q8 有点吃紧,再往下掉一档量化,画质损失肉眼可见,想稳还是得看显存。

mark

CFG 1 那块确实反直觉,我第一次也是照老参数拉高,出来一堆过曝

Q8 在 12G 上还算舒服,1440x1920 直出没爆

GGUF 节点版本对不上会报很奇怪的错,装之前先更新一下

Q8在12G上我这边跑1440偶尔掉共享显存,速度直接慢一半,还得看机器

1 个赞