万亿参数开源模型在研
8月11日,据The Information援引项目内部人士消息,英伟达正在全力推进新一代开源大模型Nemotron 4研发。旗舰版本目标参数量至少达到1万亿级别,约为现有Nemotron 3 Ultra的两倍。尽管最终训练尚未完成,官方未公布具体发布日期,但该模型最早可能在晚秋时节准备就绪。
英伟达生成式AI副总裁Kari Briski对外表态,布局前沿开源模型的核心逻辑是满足各国企业对于可控AI底座的需求。不同于侧重数据生成和企业微调辅助的前代产品,Nemotron 4定位对标全球第一梯队开源大模型,面向通用推理、多智能体协同、复杂行业任务打造完整基座。
Nemotron 3.5 Lightning已发布
北京时间8月11日晚,英伟达同步发布了新一代开放权重模型Nemotron 3.5 Lightning,并推出开源路由库NeMo Switchyard。Nemotron 3.5 Lightning采用30B-A3B混合MoE架构,专为高吞吐智能体场景优化。
- Nemotron 4旗舰版参数至少1万亿,约为Nemotron 3 Ultra的两倍
- Nemotron 3.5 Lightning已发布,30B-A3B混合MoE架构
- 开源路由库NeMo Switchyard同步推出
- 战略意图:从芯片供给者向全栈生态构建者转型
商业逻辑与行业影响
开源基座能够降低企业自建大模型的门槛,吸引更多政企和科研机构启动本地AI部署。开发者选用Nemotron体系后,模型训练、微调、大规模推理全流程天然适配英伟达软硬件生态,带动DGX服务器、GPU和网络组件持续出货。模型可以开放免费,但承载模型运行的算力基础设施才是核心盈利市场。
此举也是应对外部竞争的防御举措。过去一年,以DeepSeek、Qwen为代表的国产开源模型席卷全球开发者市场;同时OpenAI、Anthropic等头部闭源客户持续推进自研AI芯片,试图降低对英伟达硬件依赖。英伟达入局开源赛道,意在掌握标准话语权,对冲生态分流压力。不过,这也可能与其云厂商客户形成直接竞争,如何平衡合作伙伴利益将是长期挑战。

