亚马逊云服务AWS计划在2027至2028年期间,在全球基础设施中新增部署200万台英伟达GPU,包括Blackwell Ultra、Rubin和Rubin Ultra系列,进一步加速人工智能计算能力提升 [1, 2, 3, 4, 5, 6, 7, 8]。

这次部署是继AWS于2026年初宣布将新增100多万台英伟达GPU之后,累计新增GPU将超过300万台,显示云服务巨头在AI基础设施的强力投入 [4, 5]。

AWS与英伟达的合作也从GPU扩展到了CPU和内存技术。双方将联合推出基于英伟达Vera CPU的新基础设施,满足代理型AI等需要CPU与加速计算协同的复杂工作负载需求 [1, 2, 3, 4, 5, 6, 7, 8]。此外,AWS将采用英伟达定制的高带宽内存技术NVHBM,该技术相比标准HBM4E,内存带宽提升30%,功耗降低15%,芯片面积节省25%,能显著提升AWS自研Trainium芯片与英伟达GPU的性能和能耗效率 [1, 2, 4, 6, 8]。

英伟达CEO黄仁勋表示:“NVIDIA与AWS共同打造了AI时代最强劲的成长引擎之一,市场需求远超所有预测。”他还称,双方的合作已扩展到GPU、CPU、网络、开放模型与软件全堆栈层面,以空前的速度与规模推动代理型AI与物理AI落地 [1, 2, 3, 5, 7, 8]。

AWS CEO马特·加尔曼强调:“客户希望能自由选择最适合其AI工作负载的工具,也希望确信所有技术能彼此无缝协作。这正是我们与NVIDIA深度合作,致力让AWS成为执行NVIDIA AI技术最佳平台的原因。” [3, 5, 8]

除技术合作外,AWS计划在未来两年内为美国政府建设一座安全AI工厂,部署10万台GPU以支持联邦和国家安全级别的AI工作负载 [3, 4, 5, 8]。

此次扩大战略将带动台湾半导体及服务器生态企业,包括台积电、日月光、鸿海、广达、纬创、华硕、台达电子、丽台等相关企业在AI数据中心建设上的需求增长 [7, 8, 9]。

去年8月,英伟达宣布预计2028财年营收将增长70%,反映其AI产品的强劲市场需求 [9]。AWS与英伟达16年前开始合作,如今则升级为涵盖定制CPU、GPU、网络和开源AI模型的全方位合作伙伴关系 [1, 2, 3, 6, 7]。

AWS此次大规模部署与技术创新凸显大型云服务商在AI基础设施领域持续的资本投入,回应市场对资本支出放缓的担忧 [1, 2, 3, 5, 8]。