把 Krea 2 的过滤机制掰开揉碎讲,说到底就是几个数字,这个拆解讲得挺通透。作者先声明这 LoRA 是 AI 辅助写的,他不在乎,能用就行。原理他打了个比方:Krea 2 是个扩散 transformer,你把它想成一条很长的流水线,每一站都拿你的提示词去推动半成品图往目标靠。
文字和流水线之间有个小调音台,每个旋钮控制某种文字信号的强度,比如风格锐度、解剖正确性、内容是否允许。
据他分析安全过滤就藏在其中两个旋钮里,触发拒绝时这俩就把结果推向通用或者打码输出。让人意外的是,这过滤不是想象中那种庞大的独立审核模型,而就是塞在扩散模型里的一小串数字。
从做产品的角度看这挺有意思,说明所谓安全机制的实现可以非常轻量。当然这类东西游走在灰色地带,用不用自己掂量,别拿去干违规的事。