之前看到有人用 JSON 结构化提示词做生图,其实拿来做图片编辑一样好使。
道理很朴素:自然语言天生有歧义,你说改这里改那里,模型可能理解偏。换成一个规整的 JSON 结构,把要改的字段一条条列清楚,歧义就被压下去了。像 Flux.2 这类模型,用结构化的写法第一次就能给出比较到位的编辑结果,来回返工的次数明显少。
看着好像多此一举,但对需要精确控制的场景真香,尤其是那种只想动某一处、其他保持不变的编辑。我平时改设计稿会拿这个套路省不少事。
之前看到有人用 JSON 结构化提示词做生图,其实拿来做图片编辑一样好使。
道理很朴素:自然语言天生有歧义,你说改这里改那里,模型可能理解偏。换成一个规整的 JSON 结构,把要改的字段一条条列清楚,歧义就被压下去了。像 Flux.2 这类模型,用结构化的写法第一次就能给出比较到位的编辑结果,来回返工的次数明显少。
看着好像多此一举,但对需要精确控制的场景真香,尤其是那种只想动某一处、其他保持不变的编辑。我平时改设计稿会拿这个套路省不少事。
结构化压歧义这个说法很到位
只改一处其他不动的场景,自然语言真的容易误伤
Flux.2配JSON我也试过,第一次成功率高不少
看着繁琐,但精确控制时值这个功夫
有没有现成的字段模板参考下?