MAGREF 用自己的照片控视频里出现谁,多主体一致性还不错

MAGREF 这个东西的卖点是:你丢几张参考图进去,视频里的人和物就保持你给的那个样子,不会乱生成随机脸。全称是 Masked Guidance for Any-Reference,靠区域掩码加通道拼接来锁身份。

它分三种模式,单 ID 是一个人物贯穿始终,多 ID 是几个不同参考图的主体同框各自保持特征,还有 ID+物体+背景可以拼复杂场景。我拿来试多 ID,几个角色同屏确实没串脸。

有几个坑记一下:输入图别糊别有马赛克;每张图的亮度饱和度尽量统一,不然输出颜色会花;分辨率只吃 480p 和 720p;帧数别超过 81,超了容易崩。提示词反而不用写太细,名词加简单动作词就够。采样步数 4 到 6、CFG 给 1 到 2,一次不满意就改提示词重跑。

多ID不串脸这点太重要了,之前生成一多脸就崩

帧数卡81这个限制有点难受

亮度饱和度要统一,我吃过亏输出一片花