刚看到 NVIDIA 把 Nemotron 3 Embed 放出来了,是一整套开源的 embedding 模型合集,不是单个 checkpoint。最抓眼的是里面的 8B 版本在 RTEB(检索类的 embedding 榜)上排到了第一。
embedding 这层平时存在感低,但做 RAG 或者 agent 检索的都懂,召回好不好基本就看它了,前面这步废了后面再牛的模型也白搭。所以一线大厂正经开源一套 embedding,比又发个对话模型实用多了。
我更好奇实际落地的表现——榜单第一是一回事,换到自己的中文私域语料、代码检索这些真实场景还灵不灵,多语言撑到什么程度,8B 这个体量推理成本扛不扛得住。有已经拉下来跑过的老哥说说体感?榜归榜,最后还是得看自己数据上的召回。