视频角色LoRA的数据集,图和视频到底怎么配

普通角色LoRA我练过好几个了,最近想上手视频的,结果卡在数据集这一步。训练器说图片和视频片段都能传,我不确定是两样一起喂效果更好,还是有个比例讲究。手头这个是西方卡通风的角色,形变比较大,不知道视频帧里那些夸张动作会不会反而把特征带偏。

另外视频训练那边给了三个可选的训练模型,我一个都没试出所以然来,选哪个心里没底。

有练成过西式卡通角色的老哥,能说说你的图和视频大概什么配比、最后选了哪个底模吗,少走点弯路。有现成的靠谱教程也求个方向,文字视频都行。

我的经验是先用静图把外形锁死,视频片段少量补动态,全喂视频反而糊

卡通形变大的话,清洗一下太夸张的帧,不然一致性会崩

1 个赞

蹲一个底模选择,我也懵

同求教程

这配比我也验证过,全喂视频糊得厉害,静图打底稳很多

静图锁外形这套我也这么走,视频片段只放很小一部分,多了直接糊