刚看到七月的国内大模型平台排行更新了。榜单这东西看看就好,但趋势还是有参考性的——这一年国内几家在生图和视频上的迭代明显比去年密。
我更关心的是排行怎么排的,是按用户量、能力评测还是综合体验,不同口径出来的名次能差很远。对我们做产品选型的来说,纯看总榜意义不大,得拆到具体能力项:文生图、图生图、视频、可控性各是谁强。
有在同时用两三家的朋友吗,实际体感和榜单一致吗。
刚看到七月的国内大模型平台排行更新了。榜单这东西看看就好,但趋势还是有参考性的——这一年国内几家在生图和视频上的迭代明显比去年密。
我更关心的是排行怎么排的,是按用户量、能力评测还是综合体验,不同口径出来的名次能差很远。对我们做产品选型的来说,纯看总榜意义不大,得拆到具体能力项:文生图、图生图、视频、可控性各是谁强。
有在同时用两三家的朋友吗,实际体感和榜单一致吗。
榜单和实际体验经常两回事,评测集刷得高不代表随手一张就好看
我们选型只看图生图稳不稳定,总榜真参考不了
口径这点说到关键了,很多榜是按API调用量排的,跟质量没啥关系
蹲个各能力项的拆解