从创作出发 · 探索AI的无限可能

AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

英伟达发布Nemotron 3 Embed 8B参数版登顶RTEB权威评测榜单

英伟达近日正式推出Nemotron 3 Embed开源嵌入模型系列,该系列包含3个不同参数规模的开放权重,全部采用OpenMDW-1.1许可协议开源。其中8B参数版本在权威嵌入模型评测基准RTEB中以78.46的得分位列榜首,性能超越目前市面多数同量级闭源及开源嵌入模型,为检索增强生成、语义搜索等场景提供了更高性能的选型。

配图

随着检索增强生成(RAG)技术成为企业落地大模型的主流方案,嵌入模型的性能上限直接决定了大模型知识检索的准确率、幻觉抑制效果,是行业公认的AI落地核心“隐形基础设施”。

此前行业用户的选择始终面临两难:闭源商用嵌入模型性能稳定但调用成本高,且无法本地化部署满足数据安全要求;开源嵌入模型普遍参数规模偏小,在长文本匹配、跨域检索等复杂场景下表现不足,难以满足中大型企业的落地需求。

这次英伟达推出的Nemotron 3 Embed系列共包含三个不同参数规模的开放权重,覆盖边缘端、端侧、云端等不同部署场景,所有版本均采用OpenMDW-1.1许可协议,开发者可免费商用、修改权重,无需额外申请授权。

其中参数规模最大的8B版本表现最为亮眼:在覆盖200余项不同任务的全球权威嵌入模型评测基准RTEB中,该版本拿到了78.46的总分,位列所有参评模型第一,比此前的榜首产品得分高出1.1个百分点,尤其在长文本语义匹配、跨领域知识检索两类高难度任务上,领先幅度超过3%,打破了此前开源嵌入模型性能弱于闭源产品的行业固有认知。

作为全球AI算力领域的龙头企业,英伟达此前已经在Nemotron大模型系列下发布了多款开源基座模型、推理优化工具,本次嵌入模型的推出,也补全了RAG落地全链路的开源工具栈。

业内人士分析,该系列模型的发布将进一步拉低大模型落地的成本:中小开发者无需再为嵌入接口支付高昂的调用费用,有数据安全要求的企业也可通过本地化部署满足合规要求,预计未来半年内,基于该系列嵌入模型的行业知识库、AI Agent应用将迎来集中落地。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。