英伟达正秘密研发新一代开源大模型,旨在打造对标全球顶尖开源模型的旗舰产品。据《The Information》报道,多名内部人士透露,英伟达正在筹备代号为“Nemotron 4”的开源模型,其参数规模高达万亿级别,研发阵容也远超上一代旗舰的 570 名作者规模。知情人士表示,这家芯片巨头正试图打造一款能与“全球最佳开源 AI 模型”正面较量的产品。截至发稿,英伟达周二美股上涨 0.73% 报 219.145 美元。
**万亿参数大模型研发曝光**
参与 Nemotron 项目的几位员工预计,最大的 Nemotron 4 模型将拥有至少 1 万亿个参数,规模约为英伟达当前最大模型 Nemotron 3 Ultra 的两倍,后者于今年 6 月刚刚发布。报道同时指出,1 万亿参数量目前仍小于中国领先的开源模型,但英伟达强调其压缩技术能让较小模型同样具备卓越性能。
今年 3 月,英伟达发起成立了由全球领先 AI 实验室组成的 Nemotron 联盟,旨在推进开放前沿模型发展,进一步拉动开源生态对芯片的需求。英伟达生成式人工智能副总裁卡里·布里斯基对此表示,公司投资 Nemotron 是因为相信每个公司和每个国家都需要易于使用的前沿开放模型,以加强安全保障、加速创新,并提供一个可以代代相传的基础。
目前,Nemotron 4 的发布时间未定,预计最早今年秋季推出。多位员工透露,公司已就 Nemotron 4 的预训练数据和架构做出部分决定,但尚未敲定具体规格或发布日期,最终训练运行可能还需数月。两名员工称模型最早可能在秋末准备就绪,其他人则表示会更晚。一名前员工称:“现阶段所有人都想参与进来。”但这场全员奔赴的背后,英伟达正把自己推向一个微妙的位置——一旦 Nemotron 4 达标,它将与自己投资的开源初创公司正面竞争,同时还要与购买其芯片的大型 AI 实验室同台较量。
**发布轻量级模型与融资计划**
在秘密研发万亿参数 Nemotron 4 的同时,英伟达周二先行亮出了一款轻量级开源模型——Nemotron 3.5 Lightning。这是一款拥有 300 亿个参数的专家混合模型,专为支持始终在线的智能体而构建,能够处理海量任务,并且可以在笔记本电脑或台式机的单个 GPU 上运行。其输出速度较同类提升高达 4 倍,智能体任务完成速度提升 30%,可本地部署于 RTX PC、DGX Spark、Jetson 等设备,兼顾隐私控制与边缘扩展能力。与此同时,英伟达还推出了 NeMo Switchyard 模型路由工具,该技术能根据任务需求自动匹配最合适、最高效的模型。内部基准测试表明,NeMo Switchyard 在保持前沿水平精度的同时,将任务完成成本降低到 Opus 4.8 的近三分之一。
模型之外,英伟达同日抛出一项更重磅的融资计划。公司宣布与 Apollo、贝莱德、黑石、博枫、高盛和 KKR 六大金融机构签署谅解备忘录,计划共同搭建独立算力融资平台,目标是为全球 AI 基础设施筹集超过 5000 亿美元第三方资金,以有竞争力的融资利率直接向英伟达客户提供融资支持。摩根士丹利测算,若英伟达从 GPU 使用收益中抽取 35% 盈余分成,在 GPU 租赁价格维持每小时 13 美元、全球每年新增 5GW 算力的假设下,每年潜在新增营收可达约 510 亿美元,2029 财年每股收益有望增厚约 9.83%。
**回应“循环融资”质疑**
这一架构引发了市场对其本质是否为“循环融资”的质疑。对此,英伟达 CEO 黄仁勋亲自出面回应,态度强硬且直接:AI 工厂算力正在成为一种可投资的资产类别,需求来自真实的商业场景,每个项目都将由独立机构投资者进行独立尽调,“这绝非外界质疑的循环融资。”
