Nemotron 3 Super:英伟达发布全新开源AI模型,参数达120B,性能提升显著

英伟达发布全新开源AI模型Nemotron 3 Super,参数量高达1200亿,采用混合专家架构,专为复杂智能体系统设计。模型具备高推理能力和上下文窗口,有效解决多智能体交互中的瓶颈问题,并大幅提升吞吐量和准确率。

9效率工具AI模型英伟达开源性能提升

Nemotron 3 Super:英伟达发布全新开源AI模型

英伟达公司于3月11日宣布推出Nemotron 3 Super开源大模型,这是其迄今为止最强大的开源权重AI模型。

开源权重模型是指将决定AI模型行为的关键参数向公众免费开放的模型。与完全闭源的模型不同,开发者可以下载并在自己的设备上运行或微调这些模型。

英伟达最强开源权重 AI 模型:Nemotron 3 Super 登场,120B 参数、吞吐量飙升 5 倍插图

模型特点

  • 1200亿参数,采用混合专家(MoE)架构
  • 专为大规模运行复杂智能体系统设计
  • 具备高推理能力和上下文窗口
  • 解决多智能体交互中的瓶颈问题
  • 提升吞吐量和准确率

性能提升

Nemotron 3 Super采用了混合专家(MoE)架构,将吞吐量提升了5倍,准确率比前代翻倍。Mamba层使内存和计算效率提高了4倍,而Transformer层则负责高级推理。

英伟达最强开源权重 AI 模型:Nemotron 3 Super 登场,120B 参数、吞吐量飙升 5 倍插图1

应用场景

该模型已被应用于搜索、软件开发、电信和半导体设计等核心工作流中。

获取方式

开发者可通过Hugging Face、各大云服务商(谷歌云、甲骨文,及即将上线的AWS和Azure)获取该模型。同时,它已被打包为NVIDIA NIM微服务,支持无缝部署制本地数据中心和云端。