旗舰级推理模型
专为企业级复杂推理任务设计,在数学、代码、逻辑推理等基准测试中达到 SOTA 水平。支持 NVFP4 量化,单节点 8×H100 即可高效部署。
我们致力于为中文开发者社区提供最完整、最权威的 NVIDIA Nemotron 3 系列模型资源、技术文档与部署指南,助力 AI 应用落地。
Nemotron 3 系列采用统一的 Hybrid Mamba-Transformer MoE 架构,三个规模模型覆盖从边缘部署到大规模训练的全场景需求
专为企业级复杂推理任务设计,在数学、代码、逻辑推理等基准测试中达到 SOTA 水平。支持 NVFP4 量化,单节点 8×H100 即可高效部署。
在性能与部署成本之间取得最佳平衡,单张 H100/A100 80GB 即可运行 FP8 版本。适合中型企业知识库、代码助手、多语言翻译等场景。
消费级显卡 (RTX 3090/4090 24GB) 即可流畅运行 GGUF INT4 量化版本。支持本地离线推理、Ollama 一键部署,是个人开发者和边缘计算的理想选择。
记录本站内容更新、模型版本发布、重要功能上线等关键节点
ollama pull nemotron3-nanoNemotron 3 系列模型采用宽松的开源许可证,支持商业使用、修改和分发,请根据模型版本选择对应许可证
Open Model Development and Weights License 1.1 是 NVIDIA 为旗舰模型设计的许可证,基于 Apache-2.0 扩展而来,增加了模型权重分发的特定条款。
NVIDIA 为 Super 和 Nano 模型定制的开放许可证,兼容商业应用,条款简洁明了,适合广泛的开发者和企业使用场景。
部署到生产环境前,请务必完整阅读对应许可证全文。关键合规要点:
欢迎通过以下方式与我们交流,无论是技术问题、合作意向还是建议反馈
模型部署、量化、微调等技术咨询,我们会在 1-2 个工作日内回复
发送邮件企业级部署方案、定制化模型服务、私有化部署咨询、培训服务
商务洽谈加入开发者社区,参与讨论、分享经验、获取最新资讯
GitHub Discussions以下是 Nemotron 3 系列模型的官方与社区资源入口,涵盖下载、推理、训练与云服务。