Anima量化成int8:省一半显存还快四成,低端卡有救

把Anima量化到int8之后差不多保留了原模型九成质量,显存直接省掉一半,低端卡终于跑得动了。实测int8比bf16原版快了四成多,再配上turbo lora把cfg压到1,能冲到七点几it/s,提速挺夸张。

mxfp8那版理论上更准,但我没看出明显优势,而且只认RTX50xx的Blackwell,普通卡用不上。

最省心的是它在新版ComfyUI里能直接当替换用,不用装自定义节点。跑不起来的先把ComfyUI和依赖都更到最新再说。

int8省一半显存这个太实在,穷卡福音

drop-in不用装节点这点好评,省事

mxfp8只认50xx,直接劝退 :sweat_smile: