重新梳理了下Kontext这套,图像编辑思路确实和文生图不是一回事

Kontext 跟传统文生图压根不是一条路子:它能同时吃文本和图像输入,做的是基于上下文的生成和编辑。

差别就在这儿。文生图是听一句提示词凭空生一张;Kontext 是你把原图连同一句改动指令一起递过去,它在理解画面的基础上动手,而不是重画一遍。所以做局部编辑、要保持主体一致这类需求,方向上比纯文生图对路得多。

最近整理模型脉络又把它过了一遍,还是没摸清它上下文这块的边界到底在哪,有深度用过的来聊聊。