当AI负载从「训练一个大模型」转向「同时跑成千上万个智能体」,数据中心的算力配比也要跟着改写。10月8日,AMD发布的这套全栈智能体AI平台,正是对这个变化的直接回应。
这套平台的「全栈」体现在它把四条产品线串成了一体:EPYC系列CPU负责通用计算与调度,Instinct系列加速器负责AI推理与训练,Pensando系列处理网络与数据面,ROCm软件栈提供统一的编程与生态支撑。AMD的目标很明确——用一套协同优化的组合,去承接「智能体时代」的数据中心负载。
配比之变是重点: 这套发布里最值得注意的细节,是CPU与GPU配比的调整。传统AI训练集群中,CPU与GPU的比例常在1:4到1:8之间,GPU是绝对主角;而智能体推理负载的特点是「小模型、高并发、强编排、多工具调用」,对CPU的依赖显著上升。AMD据此把配比推向1:1甚至更高,把CPU重新放回「算力第一公民」的位置。
背景与含义: 过去两年,AI基础设施叙事几乎被「谁家的GPU更大」垄断;但当推理侧、尤其是Agent侧成为新的增长引擎,算力形态开始从「GPU单点堆料」转向「CPU+GPU+网络+软件」的协同优化。AMD这套平台的真正意图,是用EPYC在数据中心CPU市场的既有优势,去撬动Agent推理这一新战场,同时以ROCm软件生态降低开发者的迁移门槛。
观察点: 全栈叙事能否兑现,取决于ROCm生态对主流框架与模型的兼容成熟度,以及「1:1配比」在真实企业工作负载下的性价比是否真的优于传统方案。事实以AMD官方发布为准。