magnANIMA 这类自建数据集的 finetune,比 lora 堆出来的味道正

画分镜的时候最烦的是模型只有一种审美,你换十个提示词它还是同一个打光同一种构图,气氛全靠自己后期救。magnANIMA 走的是拿自己整理的数据集重新微调底模,不是把一堆 lora 揉一起再倒出来,这两条路出来的东西手感差很多——merge 出来的常常互相打架,边缘发脏,风格在同一张图里都不统一。

它自己强调的是风格情绪构图的多样性,加上提示词理解不掉链子,主攻角色但没锁死。

我关心的其实就一条:给它写氛围向的描述,它能不能给我不一样的答案,而不是把同一张脸换个背景。作者说喜欢看大家发生成图,这种态度挺好的,模型作者愿意看反馈的不多。

收了

finetune和lora merge确实不是一回事,后者糊味很重

自建数据集才是护城河,模型结构大家都差不多