这批周边里我最在意的是把Ref2VA和Fl2VA合到一起的那个混合权重,十二G体积,做了低比特量化。意义在于一次生成既能用首帧定开场,又能同时挂参考图——单独用其中任何一个都做不到“以这一帧开场、然后让某个人物走进来”。
显存吃紧的机器等的就是这种合并。代价是眼下没有现成工作流,接线要用到新加的关键帧节点,稳定版整合包里还没有,急着上手得跟每日构建。另外那个隐空间放大器是拿大量低分辨率与高分辨率配对样本训的,配套节点一并给了;物理和空间那个LoRA不用触发词,堆叠、倒塌这类描述会明显更听话;镜头运动的LoRA要触发词,环绕不太行,手持和慢推慢拉最稳。