在AMD“Advancing AI 2026”大会召开前夕,英伟达抢先公布了其数据中心CPU产品Vera的更多技术细节。这不仅是英伟达继Grace之后在CPU领域的又一重要布局,更标志着其战略彻底转型——从单纯的“显卡厂商”转变为“AI工厂”的垂直整合者。作为全球首款专为代理式AI量身定制的处理器,Vera Rubin NVL72已进入量产爬坡阶段,供应链覆盖全球350余家工厂、30个国家,超过300家合作伙伴参与其中。
7月21日,英伟达通过博文详细披露了Vera CPU的技术细节。随着代理式AI的发展,大量关键执行路径正从GPU迁移至CPU。智能体需要在沙箱中运行代码、检索上下文并与数据库交互,这使得CPU从辅助加速器转变为AI工厂中控制密集型循环的核心执行者。
Vera围绕智能体负载设计,核心架构为Olympus。为了应对复杂的分支预测挑战,该核心引入了神经分支预测器,配合10路解码引擎,能高效处理智能体运行时的复杂逻辑。单颗Vera集成88个Olympus核心,支持176个线程,设计重心在于“宽发射、深流水线”。此外,Vera也是首款在CPU核心中支持FP8精度的处理器,打通了与GPU之间的数值计算壁垒。
内存带宽往往是智能体并发执行的最大瓶颈。Vera采用了创新的SOCAMM2 LPDDR5X内存方案,实现了1.2TB/s的惊人带宽,是传统DDR5的两倍,功耗却不到一半。实测中,Vera能维持90%的峰值带宽,确保数据供给不掉队。根据英伟达公布的基准测试,Vera在智能体负载下表现卓越:单线程性能是传统x86的1.8倍;AI智能体任务综合性能提升约50%;并发能力提升1.6倍,编排速度提升2.2倍;编译效率更是顶级x86服务器的2倍,单颗Vera编译Linux内核仅需约20秒。
尽管英伟达常被贴上“GPU巨头”的标签,但财报与产品路线图显示,其正系统性地摆脱对单一GPU销售的依赖。其中,网络互联业务增长迅猛,2027财年Q1收入达148亿美元,同比增长199%。随着AI集群向十万卡规模演进,NVLink和InfiniBand已成为构建“AI工厂”的刚需,网络业务占比已升至约20%。
紧随其后的是自研CPU业务。随着Vera于2026年6月交付OpenAI、Anthropic等头部客户,英伟达正式切入英特尔与AMD长期统治的服务器CPU市场。黄仁勋指出,Vera打开了新市场,因为CPU让智能体等待的每一刻,都是整栋建筑里最昂贵的东西——闲置GPU。英伟达副总裁兼CFO科莱特·克雷斯预计,2027财年CPU总收入有望接近200亿美元,使英伟达成为全球领先的CPU供应商。展望未来,Vera CPU与Rubin GPU的放量将成为英伟达增长叙事中的核心动力。
