Z-Image-Turbo有GGUF量化版了,标签写着ggml、gguf、quantized这套,一看就是奔着降低本地部署门槛去的。
文生图模型走GGUF这条路子我是乐见其成,量化之后显存占用能压不少,中低端卡也有机会跑起来,不用非得堆一张大显存的卡。就是量化必然有精度取舍,具体掉多少画质、Turbo那套少步数出图还稳不稳,得等实际跑过才知道。
有本地折腾过的说说体感,别光看标签。
Z-Image-Turbo有GGUF量化版了,标签写着ggml、gguf、quantized这套,一看就是奔着降低本地部署门槛去的。
文生图模型走GGUF这条路子我是乐见其成,量化之后显存占用能压不少,中低端卡也有机会跑起来,不用非得堆一张大显存的卡。就是量化必然有精度取舍,具体掉多少画质、Turbo那套少步数出图还稳不稳,得等实际跑过才知道。
有本地折腾过的说说体感,别光看标签。
蹲一个显存占用实测
GGUF铺开是好事,救活一批老显卡
Turbo本来步数就少,再量化会不会崩细节
量化掉画质是必然的,看能不能接受
牛啊
中低端卡终于能碰文生图了 ![]()
等大佬跑分,标签党路过
试过Q4确实糊一档,脸和手先崩,Q6勉强能看,看你能忍到哪 ![]()