NVIDIA Nemotron 3 Embed

关键功能

提供适用于 RAG、智能体检索、代码检索和记忆系统的开源嵌入模型。
包含一个用于最高检索质量的 8B BF16 旗舰模型。
包含适合高效生产部署的 1B BF16 和 1B NVFP4 变体。
在所引用的发布中,8B 模型位列 RTEB 第一。
支持 32k 上下文窗口,用于长输入检索。
通过对指令模型骨干做双向改造来生成嵌入。
通过结构化剪枝和教师蒸馏压缩小型变体。
提供面向生产级检索系统优化的 NVIDIA NIM 服务路径。

8B 模型将 Ministral-3-8B-Instruct 骨干改造成适用于全序列检索的双向编码器,而 1B 模型则通过结构化剪枝和从更大教师检查点蒸馏得到。该系列包含 BF16 版本,以及针对 Blackwell 优化、通过量化权重和激活实现高吞吐服务的 NVFP4 版本。


Nemotron 3 Embed 适合构建生产级检索流水线的团队,因为更好的嵌入可减少重复搜索、无关上下文以及下游智能体的 token 成本。NVIDIA 表示 8B 模型在 RTEB 上排名第一,并在 MMTEB 和 LongEmbed 上表现强劲,同时提供面向企业检索工作负载优化的 NIM 服务支持。

在您的网站添加此徽章,以获得更多点赞并登上搜索结果顶部!

嵌入按钮预览 - 浅色主题
嵌入按钮预览 - 深色主题

Subscribe to the AI Search Newsletter

Get top updates in AI to your inbox every weekend. It's free!