以前写视频提示词就是堆名词:一个人、一间厨房、夜晚、冷光。Kling 3.0 上手后我彻底改了写法,它吃的是场面调度那套东西,不是物件清单。
最直观的一点,它原生支持一次出多镜头,最多能排到六个镜头的分镜。我现在会老老实实一个镜头一个镜头标清楚,每镜写明景别、主体、运动,别都塞进一段里。profile shot、macro close-up、tracking、POV、正反打这些术语它是真能听懂,会自动换机位又保持连贯。
另外角色一定要在开头就锚定,名字唯一、描述前后一致,别用代词。对话戏我会先写动作再写台词,比如"黑衣特工一掌拍在桌上",再接他吼的那句,模型才知道是谁在说话。运镜也别含糊,跟、停、摇、推给它写死,长镜头才稳。原生音频那块,谁在什么时候说、什么语气都点明,嘴型和情绪能对上。写的时候多想想观众要看到什么、感受到什么,比罗列画面属性强太多。