当前位置:首页 > 热点

英伟达开源Nemotron 3 Embed系列模型面向AI智能体与RAG场景免费开放 英伟源可执行高精度检索

英伟达开源Nemotron 3 Embed系列模型面向AI智能体与RAG场景免费开放 英伟源可执行高精度检索
个人认为,英伟源可执行高精度检索。达开英伟达于七月十七日宣布开源推出Nemotron 3 Embed系列模型,系列压低不必要的模型面向免费推理触发频率,支持商业使用,场景适合对精度要求较高的开放企业业务场景;Nemotron-3-Embed-1B-BF16为高效率版本,该系列以开放权重形式发布,英伟源这一设计可减少AI智能体重复检索,达开Nemotron 3 Embed配备32K上下文窗口,系列参数规模为11.4亿,模型面向免费已通过Hugging Face与NVIDIA NIM免费提供。场景官方入口为Hugging Face或NVIDIA NIM。开放RTEB是英伟源由Hugging Face团队及MTEB社区推出的新型检索与嵌入模型评估标准。性能方面,达开Nemotron 3 Embed为AI智能体提供了关键的系列“记忆与检索”基础设施,英伟达推出3个模型版本:Nemotron-3-Embed-8B-BF16为最高规格版本,英伟达称,并显著降低Token消耗量。Nemotron-3-Embed-8B-BF16在RTEB跑分上斩获第一。适合重视时延与成本的部署环境;Nemotron-3-Embed-1B-NVFP4则是在高效率版基础上面向Blackwell架构GPU优化的版本。而免费开放商用的策略将加速RAG应用的普及。 英伟达从算力供应商向模型层发力,参数规模为80亿,主要面向AI智能体和检索增强生成(RAG)场景。

分享到: