Granite 3.3把RAG做成LoRA这个思路挺有意思

看到IBM放出Granite 3.3,除了语音识别和推理增强,比较戳我的是它专门给RAG搞了个LoRA。平时做检索增强,最头疼的就是模型对检索回来的上下文不够听话,该引用的不引用、瞎编的照样编。

用LoRA针对RAG场景专门微调,理论上能让模型更老实地贴着给定材料回答,这个方向对做企业内部知识库的挺实用。

IBM在企业市场深耕这么多年,出这类偏落地的东西还是有它的道理。具体效果得自己拉下来跑跑才知道。

RAG LoRA这个点子确实新

1 个赞

企业知识库场景太需要模型别瞎编了

IBM做的东西一贯偏工程落地

把检索对齐做成LoRA挺讨巧的,就是不知道换个领域是不是还得重训一版