关于 Nemotron 3 中文官网

我们致力于为中文开发者社区提供最完整、最权威的 NVIDIA Nemotron 3 系列模型资源、技术文档与部署指南,助力 AI 应用落地。

3
模型规模
1M
上下文长度
4+
部署方式
100%
开源许可

Nemotron 3 模型家族

Nemotron 3 系列采用统一的 Hybrid Mamba-Transformer MoE 架构,三个规模模型覆盖从边缘部署到大规模训练的全场景需求

Nemotron 3 Ultra

旗舰级推理模型

550B 总参数 55B 激活参数 256 专家 1M 上下文

专为企业级复杂推理任务设计,在数学、代码、逻辑推理等基准测试中达到 SOTA 水平。支持 NVFP4 量化,单节点 8×H100 即可高效部署。

Nemotron 3 Super

高性价比平衡之选

120B 总参数 12B 激活参数 128 专家 1M 上下文

在性能与部署成本之间取得最佳平衡,单张 H100/A100 80GB 即可运行 FP8 版本。适合中型企业知识库、代码助手、多语言翻译等场景。

Nemotron 3 Nano

轻量级边缘部署首选

31.6B 总参数 3.2B 激活参数 64 专家 1M 上下文

消费级显卡 (RTX 3090/4090 24GB) 即可流畅运行 GGUF INT4 量化版本。支持本地离线推理、Ollama 一键部署,是个人开发者和边缘计算的理想选择。

更新日志

记录本站内容更新、模型版本发布、重要功能上线等关键节点

v1.0.0 重大发布
  • Nemotron 3 系列三大模型 (Ultra/Super/Nano) 正式开源发布
  • 发布 Hybrid Mamba-Transformer MoE 架构技术报告 (arXiv:2410.14124)
  • 提供 Hugging Face、ModelScope、NVIDIA NIM、OpenRouter 四大下载渠道
  • 支持 FP8、NVFP4、GGUF 多种量化格式
  • 上下文长度统一扩展至 1M tokens
  • Nemotron 3 Ultra 采用 OpenMDW-1.1 许可证,Super/Nano 采用 NVIDIA Nemotron Open Model License
v1.1.0 功能更新
  • 发布 Nemotron 3 Nano GGUF 量化版本 (Q4_K_M, Q5_K_M, Q8_0)
  • 上线 Ollama 官方镜像:ollama pull nemotron3-nano
  • vLLM 官方支持 FP8 推理,新增 PagedAttention 优化
  • TensorRT-LLM 添加 Nemotron 3 专用内核融合优化
  • 更新中文基准测试结果 (C-Eval, CMMLU, CLUE)
v1.2.0 功能更新
  • Nemotron 3 Super GGUF 量化版本发布
  • NVIDIA NIM 微服务正式上线,支持一键部署
  • 新增长上下文评测 (Needle-in-a-Haystack, RULER, LongBench)
  • 发布中文指令微调数据集构建最佳实践指南
  • 本站上线 Nemotron 3 中文官网 (nemotron.cc)
v1.2.1 补丁修复
  • 修复 Nemotron 3 Nano 在特定上下文长度下的注意力掩码问题
  • 更新 llama.cpp 支持,修复 MTP 层加载兼容性
  • 优化 ModelScope 镜像下载速度,新增 CDN 节点
  • 文档新增 Windows WSL2 部署指南、Docker Compose 模板
v1.3.0 功能更新
  • Nemotron 3 Ultra NVFP4 量化版本发布,显存占用降低 75%
  • 新增多模态扩展实验版本 (Nemotron 3 Ultra-V)
  • 发布 RAG 专用检索增强微调指南
  • 新增 LangChain、LlamaIndex 官方集成示例
  • 基准测试更新:MMLU-Pro, GPQA-Diamond, LiveCodeBench 最新结果
v1.3.1 补丁修复
  • 修复 Ultra 模型在极长上下文 (>512K) 下的数值稳定性问题
  • 更新 TensorRT-LLM 至 0.12 版本,修复 FP8 GEMM 精度回归
  • ModelScope 同步最新权重文件,校验和已更新
v1.4.0 功能更新
  • Nemotron 3 Super FP8 量化版本在 ModelScope 发布
  • 新增 OpenRouter 免费 API 端点,支持即时调用
  • 发布企业级部署白皮书:私有化部署、数据安全、合规指南
  • 新增中文长文本生成评测基准 (LongBench-ZH)
  • 本站新增模型对比页面、文档指南页面、深色模式支持

开源许可证

Nemotron 3 系列模型采用宽松的开源许可证,支持商业使用、修改和分发,请根据模型版本选择对应许可证

OpenMDW-1.1 Nemotron 3 Ultra

Open Model Development and Weights License 1.1 是 NVIDIA 为旗舰模型设计的许可证,基于 Apache-2.0 扩展而来,增加了模型权重分发的特定条款。

  • 允许商业使用、修改、分发模型权重
  • 允许基于模型构建衍生作品和商业应用
  • 要求保留许可证声明和版权通知
  • 禁止将模型用于非法活动或违反出口管制
  • 提供专利授权条款,保护下游用户
  • 无需开源衍生模型的训练数据或代码
查看完整许可证文本

NVIDIA Nemotron Open Model License Nemotron 3 Super / Nano

NVIDIA 为 Super 和 Nano 模型定制的开放许可证,兼容商业应用,条款简洁明了,适合广泛的开发者和企业使用场景。

  • 允许免费商业使用、修改、分发
  • 允许基于模型开发衍生产品和服务
  • 要求分发时包含原始许可证副本
  • 保留 NVIDIA 的商标权利 (不得用于背书)
  • 明确的责任免除和无担保条款
  • 兼容主流开源协议生态
查看完整许可证文本
许可证合规提醒

部署到生产环境前,请务必完整阅读对应许可证全文。关键合规要点:

  • 再分发模型权重时必须保留 LICENSE 文件
  • 不得使用 NVIDIA/Nemotron 商标推广衍生产品 (需单独授权)
  • 出口管制合规:遵守美国 EAR 及相关国家/地区法规
  • 模型输出内容的法律责任由部署方承担
  • 建议在产品文档中注明 "Powered by NVIDIA Nemotron 3"

联系我们

欢迎通过以下方式与我们交流,无论是技术问题、合作意向还是建议反馈

技术支持邮箱

模型部署、量化、微调等技术咨询,我们会在 1-2 个工作日内回复

发送邮件

商务合作

企业级部署方案、定制化模型服务、私有化部署咨询、培训服务

商务洽谈

社区交流

加入开发者社区,参与讨论、分享经验、获取最新资讯

GitHub Discussions