刚看到贾佳亚团队把新一代ControlNet端出来了,宣传里那只妖娆起舞的蜘蛛侠动图确实抓眼球。两个点值得留意:一是即插即用,意味着不用大动干戈重训主模型就能挂上去用;二是把控制能力从图像延伸到了视频生成,这块儿一直是老大难,帧间一致性和可控性很难两全。
如果它真能在视频上做到稳定的姿态、结构控制,那对做动态内容的人是实打实的利好。
目前只是看个演示,控制维度到底覆盖多少、和现有ControlNet生态怎么衔接、对显存要求高不高,都得等代码和权重出来自己跑过才有底。先蹲开源。
刚看到贾佳亚团队把新一代ControlNet端出来了,宣传里那只妖娆起舞的蜘蛛侠动图确实抓眼球。两个点值得留意:一是即插即用,意味着不用大动干戈重训主模型就能挂上去用;二是把控制能力从图像延伸到了视频生成,这块儿一直是老大难,帧间一致性和可控性很难两全。
如果它真能在视频上做到稳定的姿态、结构控制,那对做动态内容的人是实打实的利好。
目前只是看个演示,控制维度到底覆盖多少、和现有ControlNet生态怎么衔接、对显存要求高不高,都得等代码和权重出来自己跑过才有底。先蹲开源。
视频可控这块要是真稳就厉害了
即插即用是最实用的点,不用重训省太多事
那个蜘蛛侠动图有点东西 ![]()
蹲权重
帧间一致性才是照妖镜,demo挑好的放谁都会
贾佳亚团队出手一般不含糊,先期待着