刚上手谷歌那个 Nano-Banana 的图像编辑模型,跑下来居然跟 FLUX Kontext 不落下风。我平时修图靠 Kontext 做局部改写和指令编辑用得挺顺手,突然冒出个能对标的确实有点意外,名字还起得这么随意。
图像编辑这块拼的就是自然语言指令能不能翻译成精准的像素改动,Kontext 之前算是把这条路趟出来了,现在谷歌能追平的话,选型又多一个备胎。
就是不知道遇到复杂遮挡、多主体的场景会不会露馅,等更多人拿极端案例试出来再说。
刚上手谷歌那个 Nano-Banana 的图像编辑模型,跑下来居然跟 FLUX Kontext 不落下风。我平时修图靠 Kontext 做局部改写和指令编辑用得挺顺手,突然冒出个能对标的确实有点意外,名字还起得这么随意。
图像编辑这块拼的就是自然语言指令能不能翻译成精准的像素改动,Kontext 之前算是把这条路趟出来了,现在谷歌能追平的话,选型又多一个备胎。
就是不知道遇到复杂遮挡、多主体的场景会不会露馅,等更多人拿极端案例试出来再说。
名字真的绝了哈哈 ![]()
对标 Kontext?那得看指令跟随的精度到哪一档
谷歌出手一般不至于太差