看到华中科技大学和阿里通义合作的这条,说是让图像生成模型更聪明地分配算力。虽然细节我还没扒到,但光看这个思路就想聊两句。现在文生图最烦的就是不管画面简单复杂,一律按同样的步数跑,一张纯色背景的图和一张满是细节的场景图吃掉的算力差不多,属实浪费。
如果真能按区域或者按难度动态分配计算量,简单的地方少算、复杂的地方多算,那推理成本能压下来不少,出图也能更快。
国内高校和大厂联手做底层优化的越来越多了,这种活儿其实比堆参数更有意义。等论文或者技术细节出来我再回来补。
看到华中科技大学和阿里通义合作的这条,说是让图像生成模型更聪明地分配算力。虽然细节我还没扒到,但光看这个思路就想聊两句。现在文生图最烦的就是不管画面简单复杂,一律按同样的步数跑,一张纯色背景的图和一张满是细节的场景图吃掉的算力差不多,属实浪费。
如果真能按区域或者按难度动态分配计算量,简单的地方少算、复杂的地方多算,那推理成本能压下来不少,出图也能更快。
国内高校和大厂联手做底层优化的越来越多了,这种活儿其实比堆参数更有意义。等论文或者技术细节出来我再回来补。
动态算力分配听着就香,等实测
细节没出来之前先别吹,坑多着呢
华科在CV这块底子一直不错
推理成本降下来我们这种小团队才用得起
关键是好不好落地,论文效果和工程差很远
同求技术细节,蹲一个后续