刚刷到Meta新放出来的图像生成模型,本来以为发新东西肯定要自吹一波,结果那组五项测试的综合表现,排第一的是ChatGPT那边,Meta自家反倒没拿下头名。
我看对比这种东西一向留个心眼,五个维度到底怎么切的、样本量多大、prompt是不是各家都友好,这些没交代清楚,一个综合排名说服力就有限。同一批图换个评委、换个题材,名次很可能又抖一遍。
不过话说回来,能被单独拎出来做横向评测,至少说明这模型已经进到第一梯队的讨论范围了。等有人拿一致的prompt跑一整套出来,再看它在具体场景里到底强在哪一块,比一个笼统的综合分实在。