看到智象未来完成超5亿元融资,目标是做原生全模态的世界模型。这个词现在挺热,简单说就是不满足于单独做图或者做视频,而是想让模型对物理世界、时间、空间有一套统一的理解,图像、视频、声音都从一个底座里长出来。
想法很大,但这条路真的很吃算力和数据,5个亿听着多,扔进世界模型的训练里估计也就是个起步。
我持保留态度但也乐见其成,国内愿意往底层模型砸钱的团队本来就不多,能多一家往深水区走的总归是好事。就看后面能不能真拿出跑得动的东西。
看到智象未来完成超5亿元融资,目标是做原生全模态的世界模型。这个词现在挺热,简单说就是不满足于单独做图或者做视频,而是想让模型对物理世界、时间、空间有一套统一的理解,图像、视频、声音都从一个底座里长出来。
想法很大,但这条路真的很吃算力和数据,5个亿听着多,扔进世界模型的训练里估计也就是个起步。
我持保留态度但也乐见其成,国内愿意往底层模型砸钱的团队本来就不多,能多一家往深水区走的总归是好事。就看后面能不能真拿出跑得动的东西。
全模态世界模型这词,听着就很烧钱
5亿在这个赛道真不算多,训练一轮就没了
mark
世界模型是不是有点炒概念的嫌疑,先把视频生成做稳再说吧