拿 LoRA 微调 SD,几 M 的权重就能把画风带过来

翻了下 LoRA 用在 Stable Diffusion 上的做法,核心就是不去动整个大模型,只训一小撮低秩矩阵,出来的权重能压到几兆这个量级。

这么小的体积意味着换风格、换角色特别灵活,一个基础模型挂不同 LoRA 就能切好几套画风,显存吃得也少,消费级卡在家就能训。代价是它学的是「偏移」,底模本身的能力上限还在那,指望靠一个几 M 的 LoRA 把模型能力质变不现实。

数据集干净、打标准确比堆步数更关键,过拟合了角色就死板。

几兆的体积换风格是真方便

1 个赞

打标比堆步数重要,血泪教训

消费级卡在家能训这点太香了

过拟合角色就僵,表情都不对了

一个底模挂一堆lora,切画风爽