把出图这套全自动化了,跑下来最大的感受是模型没那么重要

先说这条线长什么样,再说为什么这么搭。

  1. 输入只给一个需求。不写完整prompt,一句话说清要什么,剩下的交给后面。
  2. 把这个需求自动扩成一批详细prompt。关键在于这一批彼此得不一样,不是同一句话换几个形容词,而是真的分岔开。
  3. 批量丢进工作流跑,人不用守着。跑完回来挑。

我是写prompt写到手软才决定这么干的。折腾两年下来,最大的体会是模型没有大家想的那么关键。质量真正卡住的地方是prompt,卡的还不是单条prompt写得多精,是你能不能一次甩出足够多、互相不重复的prompt。

为什么是多样性而不是精度?因为你在写的时候根本没法预判哪一条会出彩。一条prompt再讲究,出来什么样还是得看到图才知道。既然判断只能发生在生成之后,那前面就别死磕,把可能性铺开,总有一个能出彩,挑出来就是了。

以前我是守着一张图一点点调,改个词看一眼,改个权重再看一眼,一下午就没了。现在整个思路反过来,靠量和多样性取胜,人只在最后一步做选择。

做过类似自动化的聊聊,你们扩prompt那步是怎么弄的。

扩prompt那步我拿模板轮换,出来还是一股同款味

模型没那么重要这句会得罪人,但确实如此