把Anima量化到int8之后差不多保留了原模型九成质量,显存直接省掉一半,低端卡终于跑得动了。实测int8比bf16原版快了四成多,再配上turbo lora把cfg压到1,能冲到七点几it/s,提速挺夸张。
mxfp8那版理论上更准,但我没看出明显优势,而且只认RTX50xx的Blackwell,普通卡用不上。
最省心的是它在新版ComfyUI里能直接当替换用,不用装自定义节点。跑不起来的先把ComfyUI和依赖都更到最新再说。
把Anima量化到int8之后差不多保留了原模型九成质量,显存直接省掉一半,低端卡终于跑得动了。实测int8比bf16原版快了四成多,再配上turbo lora把cfg压到1,能冲到七点几it/s,提速挺夸张。
mxfp8那版理论上更准,但我没看出明显优势,而且只认RTX50xx的Blackwell,普通卡用不上。
最省心的是它在新版ComfyUI里能直接当替换用,不用装自定义节点。跑不起来的先把ComfyUI和依赖都更到最新再说。
int8省一半显存这个太实在,穷卡福音
drop-in不用装节点这点好评,省事
mxfp8只认50xx,直接劝退 ![]()