随着AI智能体应用场景的快速落地,服务器CPU市场需求急剧攀升。据Wccftech最新报道,AMD旗下的Venice(即霄龙9006系列)服务器CPU市场热度异常火爆。行业渠道数据显示,该产品2027年的全部产能已售罄,AMD目前甚至已经开始承接2028年的订单。
霄龙9006是AMD最新一代服务器CPU,于2026年Advancing AI大会上发布。该产品基于Zen6架构打造,采用台积电新一代2nm工艺制造,是AMD首个专为数据中心场景从零构建的微架构,旨在精准适配客户的AI工作需求。AMD表示,霄龙9006专门解决了智能体时代CPU侧的性能瓶颈,能够驾驭智能体AI、云端、企业级及高性能计算等多种工作负载。该系列处理器配备了先进的PCIe Gen6 I/O接口,单路内存带宽高达1.6TB/s,有助于客户成功部署对延迟和带宽要求极高的智能体工作流。
值得一提的是,Meta于2026年9月8日发布的个人智能体Muse一经问世便成为现象级热点。AMD于同年7月披露,Meta已在其整体基础设施中部署了数百万颗霄龙9006 CPU,双方正作为主要客户开展深度合作。
目前,霄龙9006正处于产能爬坡阶段,预计将推出四款型号:SP7(2026年第四季度)、SP8(2027年上半年)、Venice-X(2027年下半年)以及Verano(2027年下半年)。摩根士丹利预测,该系列CPU在2027年的出货量有望达到675万颗,相比2026年的约125万颗大幅增长。据此测算,若AMD的2027年产能确已全部售罄,在平均单价7691美元且出货675万颗的假设下,AMD明年将锁定约510亿美元的营收。
机构分析指出,智能体对服务器CPU需求的拉动将持续至2027年。过去的大模型以问答对话为主,绝大部分算力消耗在GPU上,CPU仅起辅助调度作用。而智能体需要反复进行任务规划、调用外部工具、运行隔离沙盒及检索向量数据库,这些控制、调度和IO交互工作均由CPU完成。若CPU性能不足,将直接拖累GPU的实际利用率,造成昂贵的GPU算力浪费。随着多智能体并发量的提升,传统CPU规格面临瓶颈,市场对多核、高内存带宽的新一代服务器CPU需求快速上升。
目前,供需紧张局面已引发服务器CPU连续涨价。媒体此前报道,服务器厂商的平均交期已拉长至8至12周(最长可达6个月),价格涨幅超过40%。英特尔目前的产能仅能满足约50%的客户需求,其PC CPU预计在2026年10月5日再度涨价约10%,涉及部分消费级与服务器CPU产品。
华鑫证券认为,Agentic AI对服务器CPU需求的拉升将延续至2027年,不排除CPU行业涨价趋势持续,利好AMD部分服务器CPU产品的价格。该机构援引TrendForce数据指出,在传统云端架构下,每GW数据中心约需3000万颗CPU核心,而进入代理式AI时代后,需求将提升至1.2亿颗,增长约4倍。Arm也在「Arm Everywhere」大会上预测了类似趋势。
交银国际证券表示,智能体向消费端普及将进一步提升CPU和存储芯片的需求。AMD和英特尔管理层此前均引用市场观点,认为CPU与GPU的比例或从1:8上升至1:1。该机构认为,随着智能体普及,CPU与GPU比例上升的速度或快于预期。参考其2028年加速器出货量预测,若届时CPU与GPU/加速器的需求比达到1:2,对应2500万片加速器出货量或需超2500万颗数据中心CPU。以每颗CPU单价5000美元计算,届时数据中心CPU市场规模或达到1250亿美元。同时,交银国际认为,若CPU涨价趋势持续,将帮助核心CPU设计厂商获得晶圆供给,短期内供给紧张仍将持续,成为制约CPU出货增长的主要因素。
