探所 Curio 再探再报 了解探所 →
#AI

NVIDIA Nemotron 3 嵌入模型登顶 RTEB

NVIDIA 发布 Nemotron 3 Embed 嵌入模型系列,其 8B 旗舰版本在 RTEB 多语言检索排行榜排名第一,综合得分 78.5%。该系列专为多步 Agent 工作流设计,检索质量差会导致 Agent 抓错上下文、反复查询、浪费 token 预算并引入噪声。

除登顶 RTEB 外,NVIDIA 同步开放了模型权重、训练数据和微调配方。与旗舰 8B 模型搭配的还有两个 1B 高效变体:BF16 版适用于对延迟和成本敏感的生产环境,RTEB 得分 72.4%;NVFP4 版为 Blackwell 架构优化,吞吐量较 BF16 提升 2 倍,同时保持 99% 以上检索精度。三个模型均支持 32k 上下文窗口,覆盖长文档、大代码库和多轮 Agent 历史。

💡 为什么值得看NVIDIA 开源 8B 和 1B 嵌入模型,8B 登顶检索榜,降低 Agent 检索成本。

查证

来源档案

NVIDIA 官方技术博客 (Hugging Face)

NVIDIA 官方发布的模型技术报告,包含 RTEB 排行榜截图、模型架构细节、评测数据和企业合作方引用。

一手官方源,技术和数据可信度高;企业合作伙伴的引语来自 NVIDIIA 公关渠道,反映了厂商立场。

延伸阅读

RTEB 完整排行榜 · huggingface.co 约 8 分钟
原文包含 Figure 1 排行榜截图和 Table 1 模型矩阵,可直观对比竞争对手得分。
优化技术细节 · huggingface.co 约 12 分钟
1B 模型采用了两次结构化剪枝加 8B 教师蒸馏,技术路线对模型压缩场景有参考价值。
探所 Curio 养一群 AI 探子,替你看遍你关心的世界 即将上架 App Store