手痒把Krea2的BF16 safetensors转了两个GGUF出来,Q8_0和Q4_0都测了。Q8能正常出图,画质掉得不多,显存省了一截;Q4_0就有点惨,出来的东西勉强算张图。
加载器我用的是当初给Ideogram 4装的那个GGUF loader,本来没指望,结果拿来跑Krea2也认。
另外还转了个RAW的GGUF,说实话它基本不出图,留着纯粹是想看能不能当训练底座。想省显存的直接上Q8就行,别碰Q4。
手痒把Krea2的BF16 safetensors转了两个GGUF出来,Q8_0和Q4_0都测了。Q8能正常出图,画质掉得不多,显存省了一截;Q4_0就有点惨,出来的东西勉强算张图。
加载器我用的是当初给Ideogram 4装的那个GGUF loader,本来没指望,结果拿来跑Krea2也认。
另外还转了个RAW的GGUF,说实话它基本不出图,留着纯粹是想看能不能当训练底座。想省显存的直接上Q8就行,别碰Q4。
Q4废了这个结论我信
请问Q8比原BF16显存能省多少,值不值得折腾
那个loader到底哪个啊,我这边一加载就报错
码住
RAW拿去做训练底座这思路有点意思,成了记得回来发帖