这两年做短片流程基本固定下来了:不管最后落到哪个模型出图,第一步一定先在 MJ 里瞎跑几十张,找那个世界该长什么样。GPT Image 和 Nano Banana 不是不好,它们能非常准确地把我脑子里那句话画出来,但也就到此为止,给什么出什么,很难自己长出氛围来。
MJ 反过来,你丢一句含糊的描述,它会往外推,推出来的东西常常比我原本想的更像一部片子该有的样子。调子定死了,我才切回 NB Pro 或者 GPT Image 做角色一致性,这活它俩是真稳,同一张脸跨十几个镜头不崩。
所以对我来说不存在谁替代谁,一个负责让我知道要拍什么,另一个负责把它拍完。