英伟达开发开源AI模型Nemotron 4 参数或超1万亿

英伟达正开发新一代开源AI模型系列Nemotron 4,目标是打造可与全球顶尖开源模型相抗衡的产品。

据知情人士透露,Nemotron 4系列中规模最大的模型预计将拥有至少1万亿个参数。

该模型最终训练工作尚未完成,发布时间尚未确定,但多名参与员工表示最快可能于2026年秋末准备就绪。

上月,英伟达与其他企业共同成立联盟,旨在开发并共享AI安全与网络安全工具;同时与微软等科技巨头签署公开信,支持开放权重模型,以避免AI创新“向海外转移”。

英伟达近期发布Nemotron 3.5 Lightning,面向代码审查、工具调用、安全警报监控及账单问题解答等任务;其企业生成式AI软件副总裁Kari Briski指出,该模型融合了更强大模型的知识,但规模显著更小。

英伟达同步推出NeMo Switchyard,一款开源模型路由库,可根据AI智能体的任务需求自动选择合适模型。

Briski表示,Nemotron 3.5 Lightning与NeMo Switchyard均有助于降低AI Token成本并保护企业专有数据,避免将常规任务交由更大模型处理,路由器持续在模型质量、响应速度和成本间权衡。

企业关注知识产权保护,尤其在网络安全、材料科学等领域,担忧AI服务商可能成为其竞争对手。

开源模型支持企业基于自身数据进行定制化训练,英伟达开发Switchyard亦出于控制Token成本及掌握自身知识产权的内部需求。

Briski称,该方案已验证可在提升效率与准确性的同时降低成本,当前Token消耗量巨大,此问题受到广泛关注。

此次发布前一日,Meta发布了开源模型Muse Glimmer,宣称其规模小至可在配备单块消费级GPU的Mac或PC上运行。

免责声明:本文内容由开放的智能模型自动生成,仅供参考。

最新文章
Copyright © DoNews 2000-2026 All Rights Reserved
京ICP备2025120072号