同一段对白喂给两个视频模型,人脸这块我还是更买 H3 的账

在给自己的短漫做动态分镜试片,写了段互相试探的对白,照着旧港片那种欲言又止的腔调来,粤语。同一段描述分别丢给 MiniMax H3 和 Seedance 2.5,纯文字生成,不给参考图。

两边画面完成度都够看,差别在人。H3 出来的脸更像被认真挑过的演员,眼神里有戏,说话时的小停顿和嘴角变化跟台词情绪对得上;Seedance 2.5 有几条会往那种很标准的漂亮脸上滑,好看是好看,演不出那股拧巴劲。

摸出来两条写法:情绪转折写在台词的间隙里,别全塞进台词本身,模型才知道哪儿该憋一下;镜头语言老实给,近景、过肩、稍微推一点,比反复形容「很有电影感」管用。分境试片比我手画快太多,先看节奏对不对再动笔。

对白戏最难的是停顿,这两个在这块差得多吗

我也觉得 H3 的脸更耐看,另一个偶尔会滑向网红脸

1 个赞

拿视频当分镜试片这个思路有意思,比直接画快多了