云厂商与芯片龙头的合作,正在从「买卡」升级成「一起设计机架、一起卖政府、一起把CPU也塞进AI工厂」——AWS追加200万颗GPU与Vera CPU上云,是在同时回答规模、主权与编排算力三件事。
亚马逊AWS是全球最大公有云厂商,英伟达是AI加速计算主导供应商。双方8月26日宣布扩大战略合作:在2026年GTC已披露「2026年起新增逾100万颗GPU」基础上,因需求超预期,计划在2027–2028年再部署200万颗英伟达GPU,覆盖全球基础设施与AI工厂。英伟达CEO黄仁勋与AWS CEO Matt Garman均强调客户需要自由选择GPU、Trainium或组合方案。
合作要点:
所谓IL6,白话是美国政府系统较高的安全分级之一,意味着数据与算力需满足严格隔离与审计要求——「政府也要买AI工厂」正把合规算力产品化。所谓Vera CPU,白话是英伟达在GPU之外补强的通用高主频处理器,解决Agent任务里大量「胶水逻辑」与编排,而非矩阵乘法本身。
产业观察上,AWS一边加码英伟达GPU,一边推销Trainium与NVLink Fusion,是典型的「既合作又制衡」:客户要规模时卖Rubin机架,客户要成本时推自研芯片混部。200万颗增量将牵动2027–2028年全球电力、机柜与液冷供应链;政府AI工厂则为「主权算力」树立模板。可以把它想成:AWS既当最大的英伟达分销商,又当最大的英伟达替代品制造商——客户受益于选择面,行业则面临更复杂的定价与锁定博弈。
需要把边界读清楚。200万颗为多年部署计划,非单年到货;政府项目审批与预算周期可能拉长落地时间。下一观察点是Trainium在主流推理场景的份额、Vera CPU实例定价与首批政府订单披露。