说人话讲讲“训练模型”到底在干嘛,给纯玩LoRA的朋友

群里常有人问训练模型是什么意思,我尽量用大白话讲讲,也欢迎纠错。简单说,训练就是给模型看一堆“图加标注”,让它反复调整内部参数,直到输出的东西越来越接近你喂的那批图的风格或特征。

我们平时练LoRA其实就是小规模的训练,准备几十张同一画风或同一角色的图、打好标签、设好学习率和步数,让它专门记住这部分特征,而不用重训整个大模型。

几个坑,图要干净统一、标签别自相矛盾、步数过多会过拟合,出图只会复读那几张。理解了这套逻辑,调参就不再是玄学。哪里讲得不准欢迎补充。

过拟合那段太真实,我第一次练角色步数拉满,出来全是训练集原图复刻

步数拉满出原图我也干过,后来中间多存几个档,挑没练死的那个