LTX 2.3那个Distilled/Turbo版也做了HQ Int8 Row ConvRot量化,跟前面Krea那份一个作者一套路子。作者的说法是这套量化质量能压过GGUF Q8,配他们的ComfyUI后端,在3000、4000、5000系显卡上比FP8 Scaled快一倍。
量化过程还是那套,5090上跑三到四个小时,用prodigy优化器做接近训练式的量化。
对我这种懒得折腾的,能拿现成量化档、又不掉太多质量、还提速,基本就是拿来即用的状态。
LTX 2.3那个Distilled/Turbo版也做了HQ Int8 Row ConvRot量化,跟前面Krea那份一个作者一套路子。作者的说法是这套量化质量能压过GGUF Q8,配他们的ComfyUI后端,在3000、4000、5000系显卡上比FP8 Scaled快一倍。
量化过程还是那套,5090上跑三到四个小时,用prodigy优化器做接近训练式的量化。
对我这种懒得折腾的,能拿现成量化档、又不掉太多质量、还提速,基本就是拿来即用的状态。
Turbo版量化质量能压过Q8就够我用了
prodigy优化器拿来做量化这操作有点东西
3000/4000/5000都快一倍,老卡党这回有救
蹲实测
跟Krea那版一个作者一套模板,稳
老卡快一倍这个太香,3060跑Turbo一直嫌慢,坐等实测 ![]()