Nemotron 3

Nemotron 3是NVIDIA于2025年12月15日发布的开放大模型系列,包含Nano、Super、Ultra三档,采用Hybrid Mamba-Transformer MoE架构,支持100万token上下文,专为代理式AI应用设计,已开源模型权重与训练数据。
访问官网 ↗一、平台定位
NVIDIA Nemotron 3 是 NVIDIA 于 2025 年 12 月 15 日正式发布的开放大模型系列,定位"高效精准的代理式 AI 开放模型"。系列包含 Nano、Super、Ultra 三种规模,采用突破性的异构混合专家(Hybrid Mamba-Transformer MoE)架构,专为多智能体协作系统设计,支持 100 万 token 上下文窗口,全面开源模型权重、训练数据与配方,是 NVIDIA 在主权 AI 与代理式 AI 赛道的旗舰产品。
二、核心能力
- 三档分层:Nano(30B参数/3B激活,高效小型)、Super(~100B参数/10B激活,高精度推理)、Ultra(最大规模,顶级精度);
- Hybrid MoE 架构:Mamba-2 + MoE + Attention 混合,吞吐量较 Nemotron 2 Nano 提升 4 倍;
- 100 万 token 上下文:原生支持 1M token,长文档与多智能体记忆场景表现优异;
- 推理可配置:通过 chat template flag 控制是否生成推理链,平衡精度与速度;
- 多环境强化学习:使用 NeMo Gym 开源库进行多环境 RL 后训练,对齐真实 Agent 任务;
- LatentMoE(Super/Ultra):潜在混合专家设计,提升专家专业化程度;
- NVFP4 量化(Super/Ultra):4 位精度训练与推理,成本效益领先;
- 全面开源:模型权重、训练数据集(Nemotron-CC-v2.1 2.5万亿token)、强化学习环境与配方全部开放。
三、适用场景
- 多智能体系统:协作式 Agent 集群,规划/推理/工具调用/验证分工;
- 企业代理式 AI:IT 工单自动化、客服、数据分析、代码生成;
- 主权 AI:金融、政务、央国企需要开放、可审计、可定制模型;
- 长文档处理:100 万 token 上下文,法律合同、科研论文、代码库分析;
- 边缘部署:Nano 版本参数量小、吞吐量高,适合边缘推理;
- 研究与教育:完全开源,适合学术研究与教学。
四、使用流程
- 访问 NVIDIA build 平台 https://build.nvidia.com/nvidia/nemotron-3-nano-30b-a3b;
- 注册 NVIDIA 账号,在线体验 Nemotron 3 Nano 对话与推理;
- API 调用:通过 NVIDIA NIM 微服务集成,获取 API Key;
- 本地部署:从 HuggingFace 下载模型权重(FP8 或 BF16),使用 vLLM/TensorRT-LLM 推理;
- 配置推理模式:设置 chat template flag 开关推理链;
- 微调定制:使用 NeMo 框架与开源数据集进行领域微调;
- 多智能体编排:使用 NeMo Gym 构建 Agent 集群工作流。
五、产品定价
Nemotron 3 采用"开源免费 + NIM API 按量计费"模式:
- 开源免费:NVIDIA Nemotron Open Model License,模型权重、训练数据、配方全部免费可商用;
- NIM API:通过 NVIDIA build 平台按 token 计费,详见官网;
- 私有化部署:免费下载权重,自行部署,无授权费;
- 企业支持:NVIDIA Enterprise 订阅提供 SLA 与技术支持,详见官网。
具体定价、API 用量包、企业支持方案,详见官网。
六、竞品对比
| 模型 | 厂商 | 核心定位 | 差异化 |
|---|---|---|---|
| Nemotron 3 | NVIDIA | 代理式 AI 开放模型 | Hybrid MoE + 1M 上下文 + 全面开源 |
| Qwen3 | 阿里 | 国产开源大模型 | 强在中文与工具调用 |
| DeepSeek V3.5 | 深度求索 | 国产开源 MoE | 推理效率高、成本低 |
| Llama 4 | Meta | 开源大模型 | 全球社区生态最大 |
七、数据安全
- 开源可审计:模型权重、训练数据、配方全部公开,可安全审计;
- NVIDIA Open Model License:允许商用、修改、分发;
- 私有化部署:可完全本地部署,数据不出内网;
- NVIDIA 企业安全:通过 SOC 2、ISO 27001 等合规认证;
- 主权 AI:支持各国/企业构建符合自身数据法规的 AI 系统;
- 训练数据透明:Nemotron-CC-v2.1 数据集来源公开。
八、收录说明
Nemotron 3 于 2025 年 12 月 15 日发布,是 NVIDIA 在代理式 AI 赛道的旗舰开放模型,Hybrid MoE 架构与全面开源策略诚意满满。AI 工具集将其收录至"AI 智能体 > 大模型"分类。
主要收录理由:①NVIDIA 官方开源,权威性与算力生态有保障;②Hybrid Mamba-Transformer MoE 架构创新,吞吐量提升 4 倍;③100 万 token 上下文,多智能体场景领先;④全面开源(权重+数据+配方),可商用;⑤代理式 AI 是 2025-2026 年核心趋势。
官方入口:https://build.nvidia.com/nvidia/nemotron-3-nano-30b-a3b










