一次生成能出到二十秒,声音是跟画面同一遍出来的,不是后期配上去的——对剪片子的人来说,这条的价值比画质高。以前拿 AI 视频当素材,环境音、对白、音效全得自己补,现在对白和氛围声在同一次里给,想要干净的无声底自己配乐也能关掉。
ComfyUI 这边走的是 Partner Node,本地不用装权重,更新到最新版把 I2V、T2V 和分镜三套工作流拉下来就能开跑,开放权重说是之后再放。能给首帧,也能给尾帧,还能按顺序丢一串关键帧,或者接着已有片段往下续,运镜和场景逻辑会带过去。
多场景多机位在一次生成里出,做分镜的人应该最有感。风格上官方强调不止电影感,写实到动画都能压住,这个得自己跑过才敢信。