刚看到Vidu上了个新模型叫Q3,主打的是能一次直出16秒的音视频,画面和声音一起出,官方说法是生成即成片。对做短视频的来说这个点挺敏感的,之前大部分视频模型出来的都是无声画面,得自己再配音配环境声,一段一段接。
真要能音画同步一把出16秒,起码省掉一堆对轨的活。
当然还得看它出的声音是环境音、口型还是纯BGM那种,成片能不能直接用不返工才是关键。等有实测素材再看。
刚看到Vidu上了个新模型叫Q3,主打的是能一次直出16秒的音视频,画面和声音一起出,官方说法是生成即成片。对做短视频的来说这个点挺敏感的,之前大部分视频模型出来的都是无声画面,得自己再配音配环境声,一段一段接。
真要能音画同步一把出16秒,起码省掉一堆对轨的活。
当然还得看它出的声音是环境音、口型还是纯BGM那种,成片能不能直接用不返工才是关键。等有实测素材再看。
蹲一个实测
16秒够剪个开头了
声音这块要是真同步就省事了,最烦后期对口型
音画一次直出16秒,做短视频开头够用了,就看声音同步稳不稳,最烦后期对口型