wan视频提示词让本地qwen3vl代写,比自己憋强

写代码出身,一开始写wan的提示词也是干瘪的“转身”俩字,出来的人杵在那纹丝不动。后来学乖了,本地拉了个qwen3vl专门扩写,把参考图丢进去,让它按“画风+主体+动作+光影+运镜”这个结构补全,人物转向、镜头怎么动都描述清楚,命中率一下就高了。

显存不够的话minicpm也行,中英文和图片推理都支持。

懒得本地部署直接丢豆包kimi也能凑合,就是得自己再删删改改。核心是别指望模型脑补,动作写具体它才动,光写“转身”这种它真会理解成原地站着。

mark

qwen3vl扩写这招好,之前一直手写累死

minicpm对显存友好,我8G也能跑扩写

1 个赞

结构化这点关键,画风主体动作光影运镜背下来

试过豆包扩,确实要再删一遍才能用

转身=原地站,笑死,我也中招过

我写走过来它给我原地踏步,后来补了镜头距离的变化才肯动

扩写出来的都得再删一遍,形容词堆太多反而把动作压没了