在AMD“Advancing AI 2026”大会召开前夕,英伟达抢先公布了数据中心CPU产品Vera的更多技术细节。这不仅是英伟达继Grace之后在CPU领域的又一重磅落子,更是其从单纯“卖显卡”向“卖AI工厂”垂直整合战略转型的彻底宣示。Vera作为全球首款专为代理式AI量身定制的处理器,其意义非同寻常。此外,英伟达透露,基于Vera Rubin架构的NVL72平台已进入量产爬坡阶段,该平台的供应链覆盖了全球350多家工厂、30个国家,吸引了超过300家合作伙伴参与。
当地时间7月21日,英伟达发布博文,从技术角度详细介绍了Vera CPU。文章指出,智能体AI将更多关键执行路径转移到了CPU上。智能体在沙箱中运行代码、调用工具、检索上下文、与数据库交互并分析结果,随后将信息返回给模型。这一过程意味着CPU不再仅仅是“辅助加速器”,而是成为了AI工厂中控制密集型循环的核心执行者。智能体AI工作负载主要依赖于单线程性能强劲、内存带宽充足、并发延迟可预测以及高效处理不规则控制流和数据结构。
Vera CPU围绕智能体AI负载设计,重点提升满载条件下的单线程表现,其核心设计为Olympus架构。为了应对智能体复杂的分支预测挑战,Olympus核心引入了“神经分支预测器”,配合10路解码引擎,能高效处理智能体运行时的复杂逻辑。单颗Vera集成88个核心,支持176个线程,设计重心明显偏向“宽发射、深流水线”。此外,Vera也是首款在CPU核心中支持FP8精度的处理器,进一步打通了与GPU之间的数值计算壁垒。
在内存方面,Vera采用了创新的SOCAMM2 LPDDR5X内存方案,实现了1.2TB/s的惊人带宽。这一数据是传统DDR5服务器的两倍,而功耗却不到后者的一半。在测试中,Vera能维持90%的峰值带宽,确保即便在数千个智能体并发时,数据供给也不会掉队。根据英伟达公布的基准测试,Vera针对智能体负载的优化效果显著:单线程性能在满载情况下可达传统x86 CPU的1.8倍;任务效率提升约50%;并发智能体运行能力提升1.6倍,编排速度提升高达2.2倍;编译速度方面,单颗Vera编译Linux内核仅需约20秒,每核编译效率约为顶级x86服务器的2倍。
长期以来,英伟达被市场贴上“GPU巨头”的标签,但翻开最新财报与产品路线图,另一个新信号已经释放:它正在系统性摆脱对单一GPU销售的依赖,围绕AI基础设施的全栈化布局,打开了多条GPU之外的新收入曲线。其中,网络互联业务是增长最迅猛的一条曲线。2027财年第一季度,英伟达数据中心网络收入创下148亿美元的纪录,同比暴增199%。随着AI集群从千卡迈向十万卡规模,NVLink、InfiniBand与Spectrum-X已成为构建“AI工厂”的刚需。网络业务占数据中心总收入的比重已攀升至约20%,这标志着英伟达已不仅仅是卖算力的公司,更是卖“连接”的公司,用物理层面的互联壁垒锁死了系统级竞争力。
紧随其后的是自研CPU业务。随着专为智能体AI设计的Vera CPU于2026年6月交付OpenAI、Anthropic等头部客户,英伟达正式杀入了由英特尔与AMD长期统治的服务器CPU腹地。黄仁勋曾表示:“Vera打开了一个全新的市场,CPU让智能体等待的每一刻,都是整栋建筑里最昂贵的东西——GPU处于闲置状态的一刻。”英伟达从零开始打造了一颗全新的、面向智能体的CPU。这是一个新市场,智能体CPU要求超快响应,未来会有数十亿个智能体,它们需要为自己而打造的CPU。英伟达副总裁兼CFO科莱特·克雷斯曾透露,预计英伟达2027财年CPU总收入有望接近200亿美元,这使英伟达有机会成为全球领先的CPU供应商。在未来的增长叙事中,Vera CPU与Rubin GPU的放量将是主要增长动力。
