刚看到智象未来完成超5亿元融资,方向定的是原生全模态的世界模型。从安全这条线看,这类模型越往“世界模型”走,我越关心它的边界在哪。全模态意味着文字图像视频音频能互相生成打通,能力越综合,被滥用做深度伪造、批量造假内容的风险也水涨船高。
原生全模态这个提法说明它不是拼几个模块,而是底层就统一建模,这样生成的东西会更真、更难分辨真假。
融资额度不小,能力肯定会往上走,希望投产品的同时也把内容溯源、水印这些防护一起做了,别只顾着秀能力。
刚看到智象未来完成超5亿元融资,方向定的是原生全模态的世界模型。从安全这条线看,这类模型越往“世界模型”走,我越关心它的边界在哪。全模态意味着文字图像视频音频能互相生成打通,能力越综合,被滥用做深度伪造、批量造假内容的风险也水涨船高。
原生全模态这个提法说明它不是拼几个模块,而是底层就统一建模,这样生成的东西会更真、更难分辨真假。
融资额度不小,能力肯定会往上走,希望投产品的同时也把内容溯源、水印这些防护一起做了,别只顾着秀能力。
能力越强越得配溯源,不然又是深伪重灾区