训 Anima 的 LoRA,底模换成 epoch1 的未收敛权重更好带

训 Anima 系的 LoRA 一直有个怪毛病:底模本身某些概念已经拽得太死,你的数据一进去,要么学不动,要么一学就崩,风格全被底模拽回去。RDBT 的思路是干脆放一个 epoch 1 的权重出来专门当训练底座——没跑满、没被过拟合污染,稳定性问题在这一层就被摊平了。

作者也写明这版不是给你出图用的,直接拿它 gen 图肯定不如正式版好看,别搞错用途。版本对应关系也要看清,v1.

5 是基于 Anima base v1 的,混版本训出来的东西挂回去容易偏。我自己的体会是这种未收敛的 ckpt 当底座,收敛曲线更听话,同样的学习率不用往下压那么多。

拿未收敛权重当底模这思路有点意思,等于给数据留了活口,回头试试