踩了很久的坑才想明白:出图不对,多半不是词写少了,而是塞太多互相打架。你把银发、红眼、水手服、红丝带、手套、项链一股脑堆进去,模型顾不过来,颜色跟它训练偏好一冲突就直接给你改掉,越regenerate越离谱。
我现在的做法是先只写主体和主要动作,出对了再一样样加,一次只改一个变量看效果。颜色老被改就换个偏这个风格的checkpoint,比死磕文字有用。想锁人物长相、固定服装,纯prompt根本压不住,该上LoRA上LoRA,该丢参考图丢参考图。
LoRA权重也别乱开,太低没效果,太高直接盖过你的描述糊成训练集原样,大部分时候0.6到0.8那一段最舒服。