做长片段的时候栽过同一个跟头:一段里主角连着换了三张脸,年轻兵、白胡子老头、戴冠的,说好是同一个人的生平。
根子在于我每个镜头都单独开一次口,模型每次都从零重新想象这人长什么样。写多少遍“和上一张是同一个人”都没用,图不听你的。
现在的做法是把人物外貌单独写成一张卡:年纪、发须、甲胄、披风、不戴冠,写一次,生成前自动塞进每条提示词。时代设定也照这个办法单独声明一遍。要改的时候只动一行,整段跟着变。
但否定句是真按不住,写了不要出现拱顶照样给你画一个,石碑上还刻一串假拉丁文。所以渲染前我加了一道看图的关卡,让视觉模型直接盯输出的像素挑毛病,不过的换个种子重画。声明管不住的东西,那道关卡基本都能捞回来。