英伟达研发万亿参数开源模型Nemotron 4,对标全球最先进AI
8月12日,据The Information援引项目参与者消息,芯片巨头英伟达正在研发新一代AI模型系列Nemotron 4,希望借此与全球最先进的开源模型展开竞争。该系列中规模最大的模型预计至少拥有1万亿参数,最早可能在今年秋末准备就绪。
英伟达是美国少数主动推出开源模型的大型科技企业之一。随着AI开发和运行成本持续攀升,而价格更低的中国模型在性能上逐步逼近Anthropic、OpenAI等美国领先实验室的顶尖系统,开源模型正获得越来越多的关注。近期多起涉及自主AI智能体的黑客攻击事件,也进一步推高了外界对开源模型安全性与开放性的讨论,尤其是开源模型通常不会对网络安全用途施加限制。
英伟达希望通过开放模型生态扩大AI应用范围,并进一步推动市场对其GPU算力的需求。英伟达生成式AI副总裁Kari Briski在邮件中表示:“投资Nemotron,是因为我们相信每家企业、每个国家都需要可及的前沿开源模型。”上个月,英伟达还与多家企业成立联盟,共同开发并共享AI安全和网络安全工具,并与微软等科技巨头共同签署公开信,支持开放权重模型。
与此同时,英伟达还发布了Nemotron 3.5 Lightning模型,面向代码审查、工具调用、安全警报监控、回答账单问题等任务,进一步扩充现有产品阵容。此外,英伟达同步推出开源模型路由库NeMo Switchyard,可根据不同AI任务的需求,自动将任务分配给最合适的模型。目前Nemotron 4的最终训练尚未完成,发布日期也未确定。