玩硬件的老毛病,一看到速度暴跌十倍先怀疑瓶颈在哪,而不是急着改工作流。用条件设置属性给多个lora分区做mask再合并,这套确实吃资源,但慢十倍多半不是节点本身慢,是显存不够开始往内存或者硬盘倒腾,一爆共享显存速度就是断崖式往下掉。
先开着任务管理器看专用显存是不是顶满、有没有溢出到共享。真爆了就两条路:把分辨率降下来先跑通,或者上cache-dit这类缓存加速把重复计算省掉。
要是显存还有富余那才轮到查是不是mask合并的连法绕了远路。别一上来就换方案,先定位。
玩硬件的老毛病,一看到速度暴跌十倍先怀疑瓶颈在哪,而不是急着改工作流。用条件设置属性给多个lora分区做mask再合并,这套确实吃资源,但慢十倍多半不是节点本身慢,是显存不够开始往内存或者硬盘倒腾,一爆共享显存速度就是断崖式往下掉。
先开着任务管理器看专用显存是不是顶满、有没有溢出到共享。真爆了就两条路:把分辨率降下来先跑通,或者上cache-dit这类缓存加速把重复计算省掉。
要是显存还有富余那才轮到查是不是mask合并的连法绕了远路。别一上来就换方案,先定位。
靠谱
先看专用显存顶没顶满这步太对了,多少人一慢就乱换方案