阿里这波又开源了个视频模型,宣传词是“电影级”,还特意点出业界首个用上MoE架构,通义App也同步上了。MoE这套稀疏专家的思路在大语言模型那边已经玩得很熟,搬到视频生成上如果真跑通,理论上能在不无脑堆算力的前提下把容量做大,性价比这块想象空间不小。
当然“首用”和“电影级”都是官方口径,实际画质和推理成本得跑过才有数。
让我比较在意的是它开源出来之后,社区能不能把这套MoE结构复用到别的生成任务上。
阿里这波又开源了个视频模型,宣传词是“电影级”,还特意点出业界首个用上MoE架构,通义App也同步上了。MoE这套稀疏专家的思路在大语言模型那边已经玩得很熟,搬到视频生成上如果真跑通,理论上能在不无脑堆算力的前提下把容量做大,性价比这块想象空间不小。
当然“首用”和“电影级”都是官方口径,实际画质和推理成本得跑过才有数。
让我比较在意的是它开源出来之后,社区能不能把这套MoE结构复用到别的生成任务上。
MoE上视频这个方向我关注很久了,路子对不对就看激活稀疏度控得好不好
首用这词慎用,学术界零星尝试早有了,说工程化落地首个还差不多
电影级这三个字我已经免疫了,谁家不说自己电影级
首用确实是营销话术,MoE上视频学界早有人零星试过