8B 模型将 Ministral-3-8B-Instruct 骨干改造成适用于全序列检索的双向编码器,而 1B 模型则通过结构化剪枝和从更大教师检查点蒸馏得到。该系列包含 BF16 版本,以及针对 Blackwell 优化、通过量化权重和激活实现高吞吐服务的 NVFP4 版本。
Nemotron 3 Embed 适合构建生产级检索流水线的团队,因为更好的嵌入可减少重复搜索、无关上下文以及下游智能体的 token 成本。NVIDIA 表示 8B 模型在 RTEB 上排名第一,并在 MMTEB 和 LongEmbed 上表现强劲,同时提供面向企业检索工作负载优化的 NIM 服务支持。

