亚马逊云科技和英伟达扩大战略合作,共建下一代AI基础设施

发布时间:2026/8/27 12:52:22
亚马逊云科技和英伟达扩大战略合作,共建下一代AI基础设施 近日亚马逊云科技与英伟达宣布大幅扩展双方战略合作。基于16年的联合创新双方计划在亚马逊云科技的全球基础设施中新增部署200万颗英伟达GPU并在AI工厂、CPU、网络、开放模型、数据处理和机器人技术等领域深化合作通过提供联合设计的解决方案助力客户以空前规模加速AI开发。此次合作扩展补充了亚马逊云科技的自研芯片产品线让客户可根据特定工作负载灵活选择最优算力方案无论是选择英伟达GPU、Amazon Trainium芯片还是两者结合使用。近二十年来亚马逊云科技和英伟达携手为全球客户提供前沿AI能力。双方合作在亚马逊云科技上推出了全球首个云上GPU加速实例如今亚马逊云科技为客户提供最广泛的英伟达GPU解决方案。如今AI需求加速爆发双方将合作推向新高度。AI工作负载正以极快的速度扩展从模型的训练和部署到数据的处理以及用于驱动智能应用。客户正跨越Agentic AI、科学发现、企业自动化和机器人技术等领域从试点阶段迈向生产阶段他们需要能够跟上这一步伐的基础设施。亚马逊云科技首席执行官Matt Garman表示“客户希望能够自由选择最适合其AI工作负载的工具并希望所有工具都能无缝协作。因此我们与英伟达进行了深度合作使亚马逊云科技成为运行英伟达AI技术的最佳场所从网络、安全到部署全面优化我们基础设施的性能。此次合作的深化将为前沿实验室、企业和政府机构提供更多在亚马逊云科技上构建和部署AI的方式。”英伟达创始人兼首席执行官黄仁勋表示“英伟达和亚马逊云科技构建了AI时代最伟大的增长引擎之一且需求正超出所有预期。16年来我们共同在云端扩展英伟达计算能力。现在我们将合作扩展到整个技术栈包括GPU、CPU、网络、开放模型和软件以只有双方联手才能实现的空前速度与规模落地Agentic AI和物理AI。此次合作扩展正是响应了客户在亚马逊云科技上对英伟达平台的需求。”扩展AI计算容量在2026年英伟达GTC大会上亚马逊云科技宣布计划从2026年起增加超过100万颗英伟达GPU。自那时起需求已经超过了这些预期。亚马逊云科技现在计划于2027至2028年间在其全球基础设施包括AI工厂中新增部署200万颗英伟达GPU。这些新增的GPU将为客户的工作负载提供支持涵盖从Agentic AI和科学发现到企业自动化和物理AI等各个方面。客户已经开始从此次合作中受益例如加快药物研发速度和提高欺诈检测效率。此外亚马逊云科技和英伟达还在高级网络技术方面展开合作以更高效地连接GPU从而进行大规模AI训练。将英伟达Vera CPU引入亚马逊云科技亚马逊云科技和英伟达正致力于将基于Vera CPU的基础设施引入亚马逊云科技为同时需要高性能CPU算力与加速基础设施的Agentic AI工作负载提供更多选择。这将进一步丰富AI基础设施的配置方案并与亚马逊云科技提供最广泛计算选择而非一刀切解决方案的理念保持一致。Vera CPU专为Agentic AI和强化学习的后端CPU任务设计包括代码执行、工具调用、沙箱运行、数据分析、数据管道和任务编排等。Vera既可作为加速系统的主控CPU也可作为AI工厂工作负载的独立CPU保障GPU算力持续供给、Agent响应及时、训练循环稳定运行。将Amazon Trainium芯片与NVLink Fusion连接在2025年re:Invent大会上亚马逊云科技宣布其下一代Amazon Trainium芯片将支持英伟达NVLink Fusion高速芯片互连技术。亚马逊旗下Annapurna Labs将与英伟达合作采用其全新的定制高带宽内存NVHBM技术并与内存供应商合作使Amazon Trainium能够使用速度更快、能效更高的内存。结合NVHBM和NVLink FusionAnnapurna Labs能够利用英伟达的定制内存技术和可扩展架构以提高AI工作负载的性能和效率同时将Amazon Trainium和GPU无缝集成到统一的机架级架构中。双方现有能力已开放客户使用上述全新合作承诺基于双方已有的深度技术集成而这些集成能力已为客户创造实际价值安全性和可靠性所有基于英伟达GPU和Amazon Trainium的Amazon EC2实例包括使用NVLink Fusion的实例均基于Amazon Nitro System构建并通过Elastic Fabric Adapter (EFA)连接从而帮助客户确保大规模地保持安全性、可靠性和网络性能。亚马逊云科技上的开放模型英伟达的Nemotron系列开放模型可在Amazon Bedrock上作为全托管的无服务器模型使用客户也可通过Amazon SageMaker平台在自有基础设施中完成该系列模型的部署与微调。更快的数据处理与基于CPU的配置相比在Amazon EMR上使用NVIDIA cuDF进行GPU加速数据处理Apache Spark工作负载的处理速度最高可提升3.7倍性价比提升30%。在Amazon OpenSearch Service上进行GPU加速向量索引索引速度最高可提升9倍而成本仅为四分之一。机器人物理AIAmazon Robotics正在集成英伟达的全栈物理AI平台包括Jetson、Omniverse和Isaac以通过模拟、合成数据生成和真实世界验证加速下一代仓储自动化落地。