越用anima越觉得它二次采样细节拉跨,不管噪声注入还是普通latent放大,颗粒感都挺重。前阵子练lora时随手调了个参数,忽然想到会不会是训练集的锅,anima为了兼容512、1024、1536都练了,那个512x512的低分集是不是有点拖后腿。
当然也可能是我想多了,dit这套架构本来放大就这德行。
有没有炼过丹的聊聊,到底是训练集还是架构的问题?
越用anima越觉得它二次采样细节拉跨,不管噪声注入还是普通latent放大,颗粒感都挺重。前阵子练lora时随手调了个参数,忽然想到会不会是训练集的锅,anima为了兼容512、1024、1536都练了,那个512x512的低分集是不是有点拖后腿。
当然也可能是我想多了,dit这套架构本来放大就这德行。
有没有炼过丹的聊聊,到底是训练集还是架构的问题?
细节怎么说也比光辉强,2k以内直出问题不大,放大别死磕latent
这更多是dit架构的通病,lumina、newbie、flux都这样