原始來源MarkTechPost
摘要
NVIDIA 发布开源 Nemotron 3 Embed 嵌入模型系列,含 8B 与 1B 两种参数量,其中 8B 版本在 RTEB 检索基准上取得排名第一。模型采用双向 Transformer 编码器,支援 34 种语言,专为检索增强生成 (RAG)、代理人检索与程式码检索等任务设计。1B 版本提供 BF16 与 Blackwell 优化的 NVFP4 量化格式,在近乎无损准确度下可达约 2 倍吞吐量。NVIDIA 同步释出 NeMo 微调配方与 NIM 微服务,方便开发者快速部署。此举进一步丰富开放嵌入模型生态,使企业能以更高效低成本建构多语言 RAG 应用。
重點整理
- 开发者可直接采用排名第一的嵌入模型提升问答系统准确度;硬体采购者则可评估 NVFP4 量化在 Blackwell 平台上的性价比优势。
- 提供当前检索效能最佳且具备高效量化选项的开源嵌入模型,直接影响 RAG 与代理系统的建构品质与成本。
編輯說明
本頁是 Code & Chain 對公開來源的編輯摘要,可能使用 AI 輔助整理並經自動化流程發布。請以原始來源為準;內容不構成投資、法律或稅務建議。