Flux 3 的运镜和多镜头一致性,Seedance 2.5 现在还追不上

接了个三十秒的短片分镜,两边各跑了一轮同样的提示词,差距比想象中大。Flux 3 在镜头控制上明显更听话,推轨、摇臂这种描述写进去基本能还原,Seedance 那边经常给我自由发挥。

跟提示词的贴合度也是同样的情况,人物动作和场景细节偏离得少。物理表现上,衣服和头发的甩动没那么塑料。最要命的是跨镜头一致性,同一个角色连着三四个镜头下来,Flux 这边脸和服装还认得出是一个人,另一边就得反复重抽。

原生音频支持的语种也更多,配旁白省了一道工序。Seedance 2.5 放出来的新片段我也过了一遍,感觉还是差一档。黑森林那边确实是慢慢磨出来的。

多镜头一致性这块我也有同感,重抽次数直接决定了工期

运镜听话这点太重要了,写了半天分镜结果模型自己发挥等于白写

物理那块具体是哪种场景差得明显?我这边测水和布料还行

我这边是烟和碎屑差得明显,水和布料倒都还行,落地反弹那种最容易穿帮

烟和碎屑确实是重灾区,落地反弹那下我基本放弃,改成切镜头躲过去

重抽次数算进工期才是真实差距,只看单条成片容易被骗

1 个赞