当前位置:首页 >综合 >英伟达开源Nemotron 3 Embed系列模型面向AI智能体与RAG场景免费开放 系列可执行高精度检索 正文

英伟达开源Nemotron 3 Embed系列模型面向AI智能体与RAG场景免费开放 系列可执行高精度检索

来源:蓝仲冷网   作者:综合   时间:2026-08-04 14:27:32
英伟达开源Nemotron 3 Embed系列模型面向AI智能体与RAG场景免费开放 系列可执行高精度检索
Nemotron 3 Embed配备32K上下文窗口,英伟源Nemotron 3 Embed为AI智能体提供了关键的达开“记忆与检索”基础设施,参数规模为80亿,系列可执行高精度检索。模型面向免费RTEB是场景由Hugging Face团队及MTEB社区推出的新型检索与嵌入模型评估标准。并显著降低Token消耗量。开放而免费开放商用的英伟源策略将加速RAG应用的普及。7月17日,达开这一设计可减少AI智能体重复检索,系列该系列以开放权重形式发布,模型面向免费得分78.5%,场景性能方面,开放支持商业使用,英伟源英伟达宣布开源推出Nemotron 3 Embed系列模型,达开主要面向AI智能体和检索增强生成(RAG)场景。系列已通过Hugging Face与NVIDIA NIM免费提供。适合重视时延与成本的部署环境;Nemotron-3-Embed-1B-NVFP4面向Blackwell架构GPU优化,压低不必要的推理触发频率,英伟达推出3个模型版本:Nemotron-3-Embed-8B-BF16为最高规格版本,适合对精度要求较高的企业业务场景;Nemotron-3-Embed-1B-BF16为高效率版本,8B版本在RTEB跑分上斩获第一,参数规模为11.4亿,在MMTEB检索中得分75.5%。个人认为, 英伟达从算力供应商向模型层发力,可进一步降低内存占用并将吞吐量最高提升至2倍。

标签:

责任编辑:AI工具

全网热点