卡在五秒十秒的那些模型,一个完整镜头都撑不满,你们平时都怎么拼的?我是一段一段往上接,成片节奏基本不归自己管。
Wan3.0 放出来了,说明里最扎眼的就两点:支持多输入,单条能生成到 30 秒。剪过片的都懂这 30 秒的分量——一个小段落一次出完,转场不用再硬接。
多输入这块我反而更在意到底能塞什么。参考图、首尾帧加上动作描述要是能一起给,可控性就是另一个量级了。
不过时长拉上去,一致性掉不掉、人脸会不会越走越漂,只能拿真素材跑过才知道。这周手上的活先留一条出来喂它。
卡在五秒十秒的那些模型,一个完整镜头都撑不满,你们平时都怎么拼的?我是一段一段往上接,成片节奏基本不归自己管。
Wan3.0 放出来了,说明里最扎眼的就两点:支持多输入,单条能生成到 30 秒。剪过片的都懂这 30 秒的分量——一个小段落一次出完,转场不用再硬接。
多输入这块我反而更在意到底能塞什么。参考图、首尾帧加上动作描述要是能一起给,可控性就是另一个量级了。
不过时长拉上去,一致性掉不掉、人脸会不会越走越漂,只能拿真素材跑过才知道。这周手上的活先留一条出来喂它。