折腾了几天 Kling 3.0,把它当导演使唤才对味

以前写视频提示词就是堆名词:一个人、一间厨房、夜晚、冷光。Kling 3.0 上手后我彻底改了写法,它吃的是场面调度那套东西,不是物件清单。

最直观的一点,它原生支持一次出多镜头,最多能排到六个镜头的分镜。我现在会老老实实一个镜头一个镜头标清楚,每镜写明景别、主体、运动,别都塞进一段里。profile shot、macro close-up、tracking、POV、正反打这些术语它是真能听懂,会自动换机位又保持连贯。

另外角色一定要在开头就锚定,名字唯一、描述前后一致,别用代词。对话戏我会先写动作再写台词,比如"黑衣特工一掌拍在桌上",再接他吼的那句,模型才知道是谁在说话。运镜也别含糊,跟、停、摇、推给它写死,长镜头才稳。原生音频那块,谁在什么时候说、什么语气都点明,嘴型和情绪能对上。写的时候多想想观众要看到什么、感受到什么,比罗列画面属性强太多。

正反打居然真能理解,这点太顶了,之前的模型全靠拼

先动作后台词这个细节我一直没注意,难怪我对话戏老是张冠李戴,回去改

蹲一个多镜头的完整prompt示例

六镜一次出确实省事,但我发现镜头一多主体一致性还是会飘,长了尤其明显

mark

楼上+1,超过四镜我一般拆开生再接,AI自己分配时间有时候节奏很怪

语气标签那个是真好用,voice cracking写上去情绪立马到位