最近帮团队攒了台练丹机,围绕 Kohya_ss 折腾了两周,简单说说各档显存能干嘛。SD1.5 的 LoRA 其实很宽容,6G 勉强能跑,8G 就舒服了,随便一张现代卡都行。到了 SDXL 就得看,12G 是底线,16G 才有余量去堆分辨率和 batch。
Flux.1 是真吃显存,16G 起步,跑起来还得开梯度检查点续命,24G 才算顺手。我自己那台 4090 跑 SDXL 的 LoRA 一千五百步大概十几分钟,Flux 就得翻两三倍时间。
预算紧的话 4060Ti 16G 性价比最高,别贪便宜上 8G,OOM 能把你劝退。
还有个容易被新人忽略的点:练之前先把 latents 缓存好,网络缓存这一步做了,整体速度差很多。数据集别放机械硬盘,Kohya 反复读图,慢盘几千步下来时间白白多出一截。