Meta这次自研图像模型主打的点很明确——省掉反复调提示词那套,直接上Agent自动改图。从产品角度看,这其实是把人肉试错的活儿交给模型自己迭代,用户只描述目标,中间的调参交给Agent去逼近。
如果真能做到,对新手门槛是断崖式下降的,以前玩图最劝退的就是提示词那点玄学。
我更关心它改图的可控粒度,是整张重绘还是能局部听指令,这决定它是玩具还是生产力工具。等实测出来再看落地效果。
Meta这次自研图像模型主打的点很明确——省掉反复调提示词那套,直接上Agent自动改图。从产品角度看,这其实是把人肉试错的活儿交给模型自己迭代,用户只描述目标,中间的调参交给Agent去逼近。
如果真能做到,对新手门槛是断崖式下降的,以前玩图最劝退的就是提示词那点玄学。
我更关心它改图的可控粒度,是整张重绘还是能局部听指令,这决定它是玩具还是生产力工具。等实测出来再看落地效果。
玄学干不掉,只是从人肉调变成机器调