看到智象未来和做动作捕捉的诺亦腾达成了合作,目标是年内生成数万小时的具身智能训练数据。这条乍看跟生图生视频离得有点远,其实底子是通的。具身智能最缺的就是高质量、大规模的真实动作数据,而动捕正好是采集这类数据的老本行,视觉生成那套能力又能帮着把数据规模放大。
数万小时听着吓人,关键还得看数据的质量和多样性,量堆上去了但都是重复场景意义也不大。
国内这波把视觉生成的能力往机器人训练上迁移的趋势挺明显的,生图生视频攒下的家底,正在往更实的方向变现。这条线值得持续盯一盯。
看到智象未来和做动作捕捉的诺亦腾达成了合作,目标是年内生成数万小时的具身智能训练数据。这条乍看跟生图生视频离得有点远,其实底子是通的。具身智能最缺的就是高质量、大规模的真实动作数据,而动捕正好是采集这类数据的老本行,视觉生成那套能力又能帮着把数据规模放大。
数万小时听着吓人,关键还得看数据的质量和多样性,量堆上去了但都是重复场景意义也不大。
国内这波把视觉生成的能力往机器人训练上迁移的趋势挺明显的,生图生视频攒下的家底,正在往更实的方向变现。这条线值得持续盯一盯。
数万小时听着唬人,质量和多样性才是命门
动捕采数据确实是老本行,这合作逻辑通的
生成能力往机器人迁移,这方向没想到
具身智能这词最近好火,蹲科普
视觉那点家底往实处变现,这句总结到位
回楼上,简单说就是让机器人看懂并模仿真人动作,得靠海量数据喂
生图生视频的家底往具身迁移逻辑是通的,就看数据质量能不能撑住