Meta 这波图像和视频模型一起端出来,余家辉那摊算交卷了

Meta 的超级智能实验室这次动作不小,图像和视频模型是一起放出来的,余家辉带的这条线总算给了个交代。从产品角度看,图像加视频一块推,意味着他们想的不只是单点跑分,而是把生成能力往一个统一入口上收。

至于实际手感怎么样,得看真放到手里试。视频这块历来是硬骨头,光有模型不够,可控性、时长、一致性哪一项都能劝退用户。

先观望,等能用上再评价。你们更关心图像那块的出图质量,还是视频的可控性?

MSL 这名字起得是真有野心

视频模型才是硬骨头,光发出来不知道能不能打

余家辉之前那套图像 tokenizer 的思路挺硬的,期待一下

坐等实测

1 个赞

Meta 这两年模型的摊子是真越铺越大 :eyes: