上海交大放出个「世界叙事模型」,冲的是视频生成不可控这个老问题

刚刷到上海交大发的世界叙事模型,主打方向是突破AI视频生成里那个「不可控」的瓶颈。这个点算是戳中痛处了,现在大多数视频模型生一段能看,但你想让人物、动作、镜头按你的意图连贯地走下去就很难,稍微长一点就崩。

从「叙事」这个命名看,思路大概是想把生成过程往可控的时序结构上靠,而不是一帧帧碰运气。具体是怎么建模的还得看放出来的东西。国内高校在这个方向上肯出成果挺好,可控性这块要是真能往前推一截,落地场景会宽很多。

可控性确实是现在最卡的地方

叫叙事模型,估计在时序一致性上做了文章