LTX-2这次同时放dense和MoE两个版本,思路挺清楚:MoE只激活当前生成需要的那部分,想在不让算力线性上涨的前提下把质量堆上去,这对视频模型尤其关键,帧一多算力就爆。
更让我在意的是那个用扩散解码器替掉传统VAE的实验,把解码和放大合成一步,如果真做出来,输出清晰度可能上一个台阶。再加上他们开LoRA训练工具、放trainer recipe让你在base上练领域变体,还承诺权重一直开源——不是那种先开源攒口碑、等模型够好了再关门的套路。
就看最后落地能不能对得起这套规划了。
LTX-2这次同时放dense和MoE两个版本,思路挺清楚:MoE只激活当前生成需要的那部分,想在不让算力线性上涨的前提下把质量堆上去,这对视频模型尤其关键,帧一多算力就爆。
更让我在意的是那个用扩散解码器替掉传统VAE的实验,把解码和放大合成一步,如果真做出来,输出清晰度可能上一个台阶。再加上他们开LoRA训练工具、放trainer recipe让你在base上练领域变体,还承诺权重一直开源——不是那种先开源攒口碑、等模型够好了再关门的套路。
就看最后落地能不能对得起这套规划了。
MoE用在视频生成上确实对,算力是死穴
坐等实测
扩散解码器替VAE这个要是成了是大事
就怕又是画饼