接了个三十秒的短片分镜,两边各跑了一轮同样的提示词,差距比想象中大。Flux 3 在镜头控制上明显更听话,推轨、摇臂这种描述写进去基本能还原,Seedance 那边经常给我自由发挥。
跟提示词的贴合度也是同样的情况,人物动作和场景细节偏离得少。物理表现上,衣服和头发的甩动没那么塑料。最要命的是跨镜头一致性,同一个角色连着三四个镜头下来,Flux 这边脸和服装还认得出是一个人,另一边就得反复重抽。
原生音频支持的语种也更多,配旁白省了一道工序。Seedance 2.5 放出来的新片段我也过了一遍,感觉还是差一档。黑森林那边确实是慢慢磨出来的。