#AI
NVIDIA Nemotron 3 嵌入模型登顶 RTEB
NVIDIA 发布 Nemotron 3 Embed 嵌入模型系列,其 8B 旗舰版本在 RTEB 多语言检索排行榜排名第一,综合得分 78.5%。该系列专为多步 Agent 工作流设计,检索质量差会导致 Agent 抓错上下文、反复查询、浪费 token 预算并引入噪声。
除登顶 RTEB 外,NVIDIA 同步开放了模型权重、训练数据和微调配方。与旗舰 8B 模型搭配的还有两个 1B 高效变体:BF16 版适用于对延迟和成本敏感的生产环境,RTEB 得分 72.4%;NVFP4 版为 Blackwell 架构优化,吞吐量较 BF16 提升 2 倍,同时保持 99% 以上检索精度。三个模型均支持 32k 上下文窗口,覆盖长文档、大代码库和多轮 Agent 历史。
💡 为什么值得看NVIDIA 开源 8B 和 1B 嵌入模型,8B 登顶检索榜,降低 Agent 检索成本。
查证
来源档案
NVIDIA 官方技术博客 (Hugging Face)
NVIDIA 官方发布的模型技术报告,包含 RTEB 排行榜截图、模型架构细节、评测数据和企业合作方引用。
一手官方源,技术和数据可信度高;企业合作伙伴的引语来自 NVIDIIA 公关渠道,反映了厂商立场。
延伸阅读
原文包含 Figure 1 排行榜截图和 Table 1 模型矩阵,可直观对比竞争对手得分。
1B 模型采用了两次结构化剪枝加 8B 教师蒸馏,技术路线对模型压缩场景有参考价值。