量化格式别只看显存塞不塞得下

手上两张卡都拿这批权重跑了一遍,结论挺反直觉:能加载进显存和能跑得快完全是两码事。你的卡没有对应的硅上支持时,ComfyUI 照样会把这个格式模拟出来给你用,界面上一个字都不提示,你只会觉得「这模型怎么这么慢」,还以为是自己工作流写差了。

30 系去抓 12.5G 那份因为它「装得下」,实际不如老老实实上 21G 那份原生能跑的;Blackwell 才是低比特那几个格式的主场,差距是拉得开的。另外这批是 ComfyUI 自己的量化格式,0.

32 以上原版内置的加载器直接读,加载链路里不塞任何自定义节点,也不用先打架构补丁,出问题排查省事太多。选之前先搞清楚自己的卡吃哪一种,按显卡挑,别按文件体积挑。

码住

一直以为文件小的那个就是快的那个,白折腾了半个月

模拟路径不提示这点确实坑,日志里能看出来吗,还是只能自己跑一遍掐表比