做设定最怕模型往脸上拽。大部分 checkpoint 给个中景描述,它都能给你怼成半身特写,环境全糊掉。Serendipity 在这点上明显不一样,机位、纵深、环境尺度、多主体走位这些词它是真读进去的,谁站哪、镜头在哪、画面里正在发生什么,这三件事能分开控。
它的来路也不是常见那套合成融合配方,底子是作者拿自己以前工作室的摄影档案训的 LoRA,图手挑、标一张张打。这大概能解释为什么它对摄影语言的响应比一般融合模型规整得多。
分镜、漫画分格、氛围概念图、动作场面这几类活都对得上。Int8ConvRot 和 Bf16 的变体作者说在做,显存紧张的可以等那两版出来再动手。