AWS与英伟达|再部署200万颗GPU:Vera CPU上云与政府级AI工厂

PromptTree|阅读 0
2026/08/27 19:11
AWS英伟达Vera CPUTrainium
亚马逊AWS与英伟达8月26日宣布扩大合作:2027–2028年再部署200万颗英伟达GPU,并引入Vera CPU服务Agentic AI与强化学习中的CPU密集负载。双方将为美国政府建设含约10万GPU的AI工厂,满足IL6及以上安全等级;并推进Trainium与NVLink Fusion、NVHBM机架协同及多项软件集成。

云厂商与芯片龙头的合作,正在从「买卡」升级成「一起设计机架、一起卖政府、一起把CPU也塞进AI工厂」——AWS追加200万颗GPU与Vera CPU上云,是在同时回答规模、主权与编排算力三件事。

亚马逊AWS是全球最大公有云厂商,英伟达是AI加速计算主导供应商。双方8月26日宣布扩大战略合作:在2026年GTC已披露「2026年起新增逾100万颗GPU」基础上,因需求超预期,计划在2027–2028年再部署200万颗英伟达GPU,覆盖全球基础设施与AI工厂。英伟达CEO黄仁勋与AWS CEO Matt Garman均强调客户需要自由选择GPU、Trainium或组合方案。

合作要点:

  1. GPU规模:累计规划新增数百万颗级GPU,服务前沿实验室、企业与政府工作负载。
  2. Vera CPU:将引入AWS,面向Agentic AI与强化学习中的代码执行、工具调用、数据管道与编排等CPU密集环节——让「喂饱GPU」的通用算力也在云上可租。
  3. 机架协同:推进Trainium与NVLink Fusion、NVHBM,使自研Trainium与英伟达GPU可在统一机架架构内协同。
  4. 政府AI工厂:在AWS安全基础设施上交付英伟达AI栈,含约10万颗GPU,满足美国联邦IL6及以上安全等级 workload。
  5. 软件集成:Nemotron开放模型上Amazon Bedrock与SageMaker;EMR GPU加速数据处理宣称较CPU配置快约3.7倍;Amazon Robotics集成Jetson、Omniverse与Isaac做仓储物理AI。

所谓IL6,白话是美国政府系统较高的安全分级之一,意味着数据与算力需满足严格隔离与审计要求——「政府也要买AI工厂」正把合规算力产品化。所谓Vera CPU,白话是英伟达在GPU之外补强的通用高主频处理器,解决Agent任务里大量「胶水逻辑」与编排,而非矩阵乘法本身。

产业观察上,AWS一边加码英伟达GPU,一边推销Trainium与NVLink Fusion,是典型的「既合作又制衡」:客户要规模时卖Rubin机架,客户要成本时推自研芯片混部。200万颗增量将牵动2027–2028年全球电力、机柜与液冷供应链;政府AI工厂则为「主权算力」树立模板。可以把它想成:AWS既当最大的英伟达分销商,又当最大的英伟达替代品制造商——客户受益于选择面,行业则面临更复杂的定价与锁定博弈。

需要把边界读清楚。200万颗为多年部署计划,非单年到货;政府项目审批与预算周期可能拉长落地时间。下一观察点是Trainium在主流推理场景的份额、Vera CPU实例定价与首批政府订单披露。