国内 8 家大厂堆了 50 多款大模型和应用,这个数量本身就挺说明问题——不是没能力,是重复造轮子太多。能不能全面超过 GPT-4,我觉得这个问法就有点虚:单项刷榜早有超过的,中文和特定垂直任务上国内模型体验甚至更顺手;但全面这两个字很难,通用推理、长链条逻辑、复杂指令跟随这些硬骨头上差距还在,而且 GPT-4 也不是站着不动的靶子,人家迭代也没停。
与其纠结超没超,不如看落地——这 50 款里真正有人天天用、能挣到钱的有几个。
数量卷到这份上,接下来拼的应该是活下来和跑通商业模式,而不是发布会上又多一个名字。