H3周边这两天冒出来一堆,挑几个真用得上的说

生态铺开的速度比模型本身还快。关键帧这块已经合进主线了,多了个能在任意帧上锚定图像和音频引导的节点,做卡点和对口型终于不用靠玄学。远景人脸崩坏也有了单独的修脸方案,代价是得额外装一份人脸检测权重。

还有个主打真实感的人物LoRA,特写下的皮肤纹理和表情比裸模型自然不少。Ref2VA那边有加速节点,负向提示也有人做了类似NAG的实现,这条对赶走画面里不想要的东西挺关键。

音乐模型出了GGUF版,但要配专门的文本编码器和VAE,显存紧张的可以先看看。采样组合上,dpmpp_sde_gpu配simple值得先试一轮。

任意帧锚定音频这个,做对口型的可以起飞了

负向提示总算有人做了,之前全靠改正向硬躲

码住

修脸要多装一份权重有点烦,但远景那张脸是真没法看

1 个赞

音乐GGUF实测吃多少显存,有人跑过吗

负向能单独写才是正经,之前往正向硬塞躲词纯属自我安慰