GPT Image 2在文生图上排到全球第一,把之前的Nano Banana 2给超了。具体是哪个评测榜、用的什么维度打分我没查到,也不敢瞎猜分数。
做算法的看这种榜其实挺谨慎,文生图的评测很吃prompt集和评判标准,同一个模型换个测法名次能差好几位。谁家榜上第一不代表所有场景都强,尤其中文prompt和英文prompt的表现经常两回事。
真正有意义的是拿自己的活儿去盲测,同一批提示词几个模型各出一版对比。有条件的同学不妨自己跑一轮,比看榜单实在。你们手头这俩谁出图更合心意?
GPT Image 2在文生图上排到全球第一,把之前的Nano Banana 2给超了。具体是哪个评测榜、用的什么维度打分我没查到,也不敢瞎猜分数。
做算法的看这种榜其实挺谨慎,文生图的评测很吃prompt集和评判标准,同一个模型换个测法名次能差好几位。谁家榜上第一不代表所有场景都强,尤其中文prompt和英文prompt的表现经常两回事。
真正有意义的是拿自己的活儿去盲测,同一批提示词几个模型各出一版对比。有条件的同学不妨自己跑一轮,比看榜单实在。你们手头这俩谁出图更合心意?
榜是哪个榜啊,不说榜单等于没说
文生图评测水太深,换套prompt排名就变
实测下来我还是觉得看具体题材,人像和场景各有强项