练角色LoRA翻车翻多了才认清一个事,九成问题出在数据集,不在设置。我踩过的坑基本能一条条对上号——图贪多,觉得越多越好塞了一百多张,结果过拟合到只会摆训练里那几个姿势,六十张上下反而最稳。
全是大头特写,出肖像惊艳、一到全身就崩,得掺三成左右的中远景进去。光线全一个样,模型根本学不会泛化。还有那些差一点点就好的图舍不得删,LoRA是把所有图往平均了算,一张脸怪的能把整体拖下水。
后来老老实实清数据集,比我改任何参数都管用。大家还遇到过哪些比想象中更要命的因素?
练角色LoRA翻车翻多了才认清一个事,九成问题出在数据集,不在设置。我踩过的坑基本能一条条对上号——图贪多,觉得越多越好塞了一百多张,结果过拟合到只会摆训练里那几个姿势,六十张上下反而最稳。
全是大头特写,出肖像惊艳、一到全身就崩,得掺三成左右的中远景进去。光线全一个样,模型根本学不会泛化。还有那些差一点点就好的图舍不得删,LoRA是把所有图往平均了算,一张脸怪的能把整体拖下水。
后来老老实实清数据集,比我改任何参数都管用。大家还遇到过哪些比想象中更要命的因素?
六十张这个数我也验证过,靠谱
同问,除了数据集还有啥隐形坑
标注也算一个,我触发词跟常见词撞了,怎么练都串