多模态大模型驱动内容创作,这个方向我看好

AICon北京站有场分享讲多模态大模型驱动的内容创作范式,讲者是智象未来的联合创始人姚霆。抛开会议本身,我更在意范式革命这个说法背不背得动。

从做产品的角度看,多模态真正的价值不是把文生图、文生视频拼一块,而是让一个模型理解跨模态的意图——你给它一段文字加一张草图再加一句语气要求,它能统一输出。

现在大部分工具还是各模态各干各的,拼接痕迹很重。真把这层意图打通,内容生产的门槛才算实实在在降下来,就看谁先做到工程可用。

跨模态意图统一,这个点戳到了

1 个赞

范式革命这词都快被用烂了,还得看落地

坐等

现在工具确实拼接痕迹重,各干各的

智象这团队技术底子还算扎实

工程可用才是分水岭,同意