MiniMax-H3那个turbo lora瘦到315MB,效果没掉

MiniMax-H3用的4step turbo lora,现在有Comfy版的轻量版了,Kijai做的,文件名一长串:loras/minimax_h3_fl2v_lightx2v_turbo_4step_v0.1_comfy_resized_avg_rank_21_bf16.safetensors。

重点是体积,1.96GB压到315MB,出的效果跟原版一样。看名字就是resize过的,平均rank收到21,再存成bf16。turbo这类lora本身就是把加速那点方向性信息塞进低秩矩阵,原始rank往往给得偏富余,砍掉冗余的部分基本不掉质量,属于该压的。

实际用下来最舒服的是加载快了、显存松了一圈,几个lora叠着来回切的时候差别很明显。原来那份我还留着,两版并排跑同seed的一组再决定删不删。

1.96G砍到315M,多lora切换的时候太爽了

rank 21压完真没差?我同seed跑了两组,感觉纹理细节稍微软了一丁点

bf16这点老卡注意下,不支持的话还得自己转一遍

1 个赞

resize这招其实大部分turbo lora都吃得住,原始rank普遍给太满了

同感,平面区域看不出,头发和布料会软一档,当底稿无所谓

同感,我也只拿它出底稿,定稿还是切回原版重跑一遍