鼓狮财经8月11日讯,在席卷硅谷的“开源”与“闭源”之争中,英伟达已跃升为支持开源AI最积极的科技巨头之一。
据媒体周二报道,这家芯片巨头正在研发新一代AI模型系列Nemotron 4,目标直指打造能与全球顶尖开源模型相抗衡的产品。知情人士透露,英伟达是少数几家推出开源模型的大型美国科技公司之一。随着今年AI相关法规数量激增,以及中国低成本AI模型的能力逐渐逼近Anthropic和OpenAI等美国头部实验室的顶尖水平,开源模型日益受到关注。此外,近期一系列涉及自主AI智能体的黑客攻击事件进一步推高了市场对开源模型的重视,尤其是考虑到开源模型在网络安全领域的应用往往缺乏相应限制。
据报道,多名参与项目的英伟达员工透露,Nemotron 4系列中规模最大的模型预计参数量将达1万亿。英伟达尚未确定Nemotron 4的发布时间,最终训练工作也尚未完成,但员工们表示,该模型最快可能在今年秋末准备就绪。
就在上个月,英伟达与其他企业共同成立联盟,旨在开发并共享AI安全与网络安全工具。此外,英伟达还与微软等科技巨头共同签署公开信,支持开放权重模型,以防止AI创新“向海外转移”。
同日,英伟达还发布了Nemotron 3.5 Lightning,这是其现有AI产品线的新增成员,主要面向代码审查、工具调用、安全警报监控以及账单问题解答等任务。英伟达企业生成式AI软件副总裁Kari Briski表示,Nemotron 3.5 Lightning融合了更强大模型的知识,但模型体积更小。同时推出的NeMo Switchyard是一款开源模型路由库,能够根据不同AI智能体的任务需求,自动选择最合适的模型。
Briski指出,这两款产品都能帮助企业降低AI Token成本,同时保护企业的专有数据。她解释说,企业无需将所有常规任务都交给大模型,路由器会持续在模型质量、响应速度和成本之间进行权衡。
在知识产权保护方面,Briski表示,许多企业,尤其是网络安全、材料科学等领域的公司,担忧AI服务商最终可能成为其竞争对手。她补充道:“企业确实需要考虑一个问题:‘他们究竟把自己的知识产权交给了谁?’因为这些AI服务商最终可能会进入它们所在的市场。”
开源模型的一大优势在于可根据企业自身需求进行定制,利用自有数据对模型进行微调。对于英伟达而言,这一优势同样适用。Briski表示,英伟达最初开发Switchyard就是为了满足控制AI Token成本的需求,同时也希望掌握自己的知识产权。她强调:“我们现在已经能够证明,这套方案可以在提高效率和准确性的同时降低成本。考虑到目前Token的消耗量如此之大,我认为这是很多人目前都非常关注的问题。”
在英伟达发布新模型的前一天,Meta刚刚发布了最新开源模型Muse Glimmer。Meta表示,这款模型规模足够小,甚至可以在配备单块消费级GPU的Mac或PC上运行。
