M1 Max 64GB 跑不跑得动 FLUX.2 dev,按计算器就有答案

手上这台 M1 Max 64GB,先量了一下真实的统一内存:68719476736 字节除下来正好 64.0GB,规格写多少就是多少。iogpu 那个上限还是出厂默认,从没调过,但就算按建议拉到 57344MB(约 56GB),FLUX.

2 dev 的 32B 在 BF16 下光权重就是 32B×2 字节,直接把 64GB 吃满,系统、ComfyUI 本体、文本编码器、VAE、推理时的激活全都没地方放。

这不是调参能省出来的,是模型自己就那么大。顺手翻了下模型目录,FLUX 系只躺着两个 FLUX.1 的 Q6_K,九点八 G 上下,一个 FLUX.2 的权重文件都没有。

ComfyUI 里带了 FLUX.2 的节点和模板,跟这台机器能跑它是两码事。二手 M1 Max 现在便宜,当入门机之前先拿参数量乘精度算一遍,比下完几十 G 再删快多了。

码住,回头拿自己那台 32G 的也算一遍

iogpu 那个值我调过,拉满也只是让 Metal 能多占点,模型本身超了照样没用

确实

留余量选量化版这个思路我认同,贴着边跑一开浏览器就爆

12B 和 32B 都被叫 FLUX 这事坑过我,下了半天才发现不是一个东西

1 个赞

老机器没人测才是真的,新芯片的文章倒是一堆 :eyes:

所以 M1 Max 想碰 32B 只能等更狠的量化方案了吧

留余量我一般按显存七成算,剩下的给系统和缓存,贴着边跑迟早出事

七成这个卡法我也用,Mac 上系统随时来抢一块,贴着边算迟早翻车。