【導讀】2026年——當AI工作負載從試點走向規(guī)模化生產(chǎn),從代理式AI延伸到物理AI,算力基礎設施的“天花板”正以前所未有的速度被逼近。今天,亞馬遜云科技與NVIDIA宣布大幅擴展戰(zhàn)略合作,計劃于2027-2028年間在全球基礎設施中新增部署200萬個NVIDIA GPU,并將合作從GPU延伸至Vera CPU、NVHBM定制內(nèi)存、Spectrum-X網(wǎng)絡、Nemotron開放模型乃至機器人物理AI平臺。

亞馬遜公司 (Amazon.com, Inc.,) 旗下的亞馬遜云科技 (AWS) 和 NVIDIA 今日宣布大幅擴展戰(zhàn)略合作,以應對全球?qū)?AI 基礎設施日益高漲且不斷加速的需求。基于客戶對亞馬遜云科技上的 NVIDIA 加速計算的快速采用,雙方計劃在亞馬遜云科技的全球基礎設施中新增部署 200 萬個 NVIDIA GPU,并在 AI 工廠、CPU、網(wǎng)絡、開放模型、數(shù)據(jù)處理和機器人領域深化合作,提供共同打造的 AI 解決方案,助力客戶以前所未有的規(guī)模加速 AI 開發(fā)和部署。
AI 工作負載正在迅速擴展,從模型的訓練和運行方式,到數(shù)據(jù)處理、索引和用于驅(qū)動智能應用的方式均在快速演進。客戶正在從試點階段轉(zhuǎn)向生產(chǎn)階段,并在代理式 AI、科學發(fā)現(xiàn)、企業(yè)自動化和機器人領域擴展工作負載。他們需要更廣泛的模型選擇、更快速的數(shù)據(jù)管線以及針對物理 AI 等新興用例的新功能。他們還需要確保底層基礎設施能夠跟上他們自身的創(chuàng)新能力,同時為關鍵任務工作負載保持高水平的安全性與可靠性。
為了滿足來自前沿實驗室、全球企業(yè)、初創(chuàng)公司和政府機構(gòu)不斷增長的需求,亞馬遜云科技和 NVIDIA 基于長達 16 年聯(lián)合創(chuàng)新,進一步擴大 AI 計算能力,并更快地為客戶提供全新聯(lián)合打造的解決方案。作為擴展合作的一部分,雙方正致力于:
將于 2027-2028 年間,在亞馬遜云科技的全球基礎設施中新增部署 200 萬個 NVIDIA GPU
將基于 NVIDIA Vera CPU 的基礎設施引入亞馬遜云科技
使用 NVIDIA 定制高帶寬內(nèi)存 (NVHBM) 擴展 NVIDIA NVLink Fusion?
為政府構(gòu)建 AI 工廠,包括在亞馬遜云科技安全的基礎設施上部署 10 萬個 GPU,用于運行國家級安全工作負載
將 NVIDIA 平臺與亞馬遜云科技 Nitro 系統(tǒng)和 Elastic Fabric Adapter (EFA) 集成,以增強安全性與可靠性
繼續(xù)支持 Amazon Bedrock 和 Amazon SageMaker 上的 NVIDIA Nemotron? 開放模型,為使用 NVIDIA cuDF 和 cuVS CUDA-X? 庫加速 Amazon EMR 和 Amazon OpenSearch 上的數(shù)據(jù)處理和向量索引,實現(xiàn)更快、更合算的分析和 AI 應用
通過 Amazon Robotics 采用 NVIDIA 物理 AI 平臺,進一步推進機器人工作負載,加速倉庫自動化和新一代機器人的創(chuàng)新
亞馬遜云科技首席執(zhí)行官 Matt Garman 表示:“客戶希望能夠自由選擇適合其 AI 工作負載的工具,并確保所有工具能夠無縫協(xié)作。因此,我們與 NVIDIA 展開了深入合作,使亞馬遜云科技成為運行 NVIDIA AI 技術的重要平臺,從網(wǎng)絡、安全到部署,全面優(yōu)化我們基礎設施的性能。此次擴展合作將為前沿實驗室、企業(yè)和政府提供更多在亞馬遜云科技上構(gòu)建和部署 AI 的方式?!?/p>
NVIDIA 創(chuàng)始人兼首席執(zhí)行官黃仁勛表示:“NVIDIA 和亞馬遜云科技共同打造了 AI 時代最強勁的增長引擎之一,且需求量已經(jīng)超出了所有預測。過去 16 年來,我們共同在云端擴展 NVIDIA 的計算能力?,F(xiàn)在,我們正將合作拓展至整個技術棧,包括 GPU、CPU、網(wǎng)絡、開放模型和軟件,以只有亞馬遜云科技和 NVIDIA 才能夠提供的空前速度和規(guī)模,讓代理式 AI 和物理 AI 成為現(xiàn)實。此次擴展反映了客戶對于在亞馬遜云科技上使用 NVIDIA 平臺的需求?!?/p>
大規(guī)模擴展 AI 計算能力
亞馬遜云科技提供了所有云服務商中最廣泛的基于 GPU 的實例,以支持各種 AI 和機器學習工作負載。在 NVIDIA GTC 2026 上,亞馬遜云科技宣布計劃從 2026 年開始,將增加超過 100 萬個 NVIDIA GPU。需求從那時起已經(jīng)超過了預期。亞馬遜云科技計劃于 2027-2028 年間,在其包括 AI 工廠在內(nèi)的全球基礎設施中部署另外 200 萬個 NVIDIA Blackwell Ultra、Rubin 和 Rubin Ultra GPU。這些新增的算力將支持客戶從智能體 AI、科學發(fā)現(xiàn)到企業(yè)自動化和物理 AI 的各種工作負載。此外,亞馬遜云科技將擴展 NVIDIA Blackwell 的算力容量,包括為 Amazon EC2 G7 實例配備 NVIDIA RTX PRO? Blackwell 服務器版 GPU。與上一代 G6 實例相比,G7 實例的 AI 推理性能提升了 4.6 倍,圖形性能提升了 2.1 倍。亞馬遜云科技也是首家提供由 RTX PRO 4500 加速的計算實例的主要云服務商。同時,亞馬遜云科技和 NVIDIA 正在 NVIDIA Spectrum-X? 以太網(wǎng)網(wǎng)絡方面展開合作,以進一步優(yōu)化跨 GPU 集群大規(guī)模 AI 訓練工作負載的網(wǎng)絡性能。
亞馬遜云科技引入 NVIDIA Vera CPU
亞馬遜云科技正與 NVIDIA 合作,將基于 Vera CPU 的基礎設施引入亞馬遜云科技,為那些需要加速基礎設施與高性能 CPU 計算協(xié)同運行的智能體 AI 工作負載提供額外選項。Vera 專為下一代 AI 量身打造,它進一步完善了亞馬遜云科技提供廣泛計算選擇的戰(zhàn)略 —— 從亞馬遜云科技自研芯片到合作伙伴提供的最新加速器和 CPU 都可以覆蓋。
基于 NVIDIA NVLink Fusion 和 NVHBM 的異構(gòu) AI 基礎設施
在 re:Invent 2025 大會上,亞馬遜云科技宣布下一代 Trainium 芯片支持 NVIDIA NVLink Fusion 高速芯片互連技術。目前,NVIDIA 和亞馬遜旗下的 Annapurna Labs 正在進一步擴大合作:雙方將與內(nèi)存供應商合作,共同推進對 NVIDIA 全新定制高帶寬內(nèi)存 (NVHBM) 技術的支持,使 Trainium 能夠采用更快、更高效的內(nèi)存。結(jié)合 NVLink Fusion,Annapurna Labs 現(xiàn)可利用 NVIDIA 的定制內(nèi)存技術和縱向擴展架構(gòu),將 Trainium 和 GPU 無縫集成到相同的機架級架構(gòu)中,從而提高 AI 工作負載的性能和效率。
以最高安全級別賦能 AI
政府機構(gòu)需要安全的 AI 基礎設施,以滿足國家安全需求。亞馬遜云科技和 NVIDIA 計劃為政府建立 AI 工廠,提供 NVIDIA 的 AI 技術棧,并計劃在亞馬遜云科技的安全基礎設施上為國家級安全工作負載提供 10 萬個 GPU。此次合作使亞馬遜云科技和 NVIDIA 成為推動國家安全 AI 發(fā)展的核心力量,助力政府機構(gòu)大規(guī)模部署 AI,用于處理影響級別 6 (IL6) 及以上的機密工作負載。
以下新承諾建立在亞馬遜云科技和 NVIDIA 深度技術集成的基礎之上,相關技術集成已經(jīng)為客戶帶來切實成效,包括:
借助亞馬遜云科技 Nitro 系統(tǒng)和 EFA 增強安全性與可靠性 —— 在此次擴展合作中,所有基于 NVIDIA GPU 和 Trainium 的 EC2 實例,包括采用 NVLink Fusion 的實例,都基于亞馬遜云科技 Nitro 系統(tǒng)構(gòu)建,并通過 EFA 進行互連。基于 GPU 加速和 Trainium 的 EC2 實例將繼續(xù)基于 Nitro 系統(tǒng)構(gòu)建,并依托 EFA 進行橫向擴展。Nitro 和 EFA 共同確保了在亞馬遜云科技擴展 NVIDIA GPU 集群并集成新互連技術的同時,客戶仍能夠保持其在大規(guī)模量產(chǎn)級 AI 工作負載中所依賴的安全性、可靠性和網(wǎng)絡性能。
亞馬遜云科技上的 NVIDIA Nemotron 模型 —— 作為亞馬遜云科技向客戶提供更廣泛 AI 模型選擇承諾的一部分,NVIDIA 的 Nemotron 系列開放模型可在 Amazon Bedrock 上作為全托管無服務器模型提供,同時也可在 Amazon SageMaker 上提供,供希望在自有基礎設施上部署和微調(diào)的客戶使用。通過這種集成,客戶可以利用亞馬遜云科技的安全性、可擴展性和運營工具,訪問 NVIDIA 最新開放模型。
GPU 加速的數(shù)據(jù)處理和向量索引 —— 隨著數(shù)據(jù)量的增長,特征工程、大規(guī)模 ETL 和實時分析等工作負載對處理速度的要求不斷提高。亞馬遜云科技正在和 NVIDIA 合作,通過 Amazon EC2 G7 實例和 NVIDIA cuDF 庫在 Amazon EMR 上實現(xiàn) GPU 加速的數(shù)據(jù)處理,與基于 CPU 的配置相比,處理速度可提升至原來的 3.7 倍,性價比提高 30%。另外,隨著 AI 應用、檢索增強生成工作流和語義搜索將向量數(shù)據(jù)庫推向數(shù)十億條記錄,索引構(gòu)建和優(yōu)化成為瓶頸。Amazon OpenSearch Service 上的 GPU 加速向量索引功能可將索引構(gòu)建任務卸載至專用 GPU 上,以四分之一的成本實現(xiàn)高達 9 倍的向量索引速度提升。該功能在托管集群和 Amazon OpenSearch Serverless 中均可使用。
面向機器人的物理 AI —— Amazon Robotics 正與 NVIDIA 展開合作,加速開發(fā)集成 NVIDIA 全棧物理 AI 平臺的新一代機器人,涵蓋 NVIDIA Jetson? 平臺、NVIDIA Omniverse? 庫和 NVIDIA Isaac? 開放機器人開發(fā)平臺。此次合作的領域包括仿真、合成數(shù)據(jù)生成、機器人訓練、路線優(yōu)化、功能安全和從現(xiàn)實到仿真驗證,所有環(huán)節(jié)都運行在 GPU 加速的 Amazon EC2 實例上。亞馬遜云科技和 NVIDIA 共同助力提升大規(guī)模機器人工作負載所需的能力:大規(guī)模仿真、多樣化訓練數(shù)據(jù)和持續(xù)的現(xiàn)實世界驗證。
結(jié)論
從200萬GPU的算力擴張,到Vera CPU的首次引入;從NVLink Fusion與NVHBM的異構(gòu)集成,到面向國家級安全的10萬GPU AI工廠;從Amazon Bedrock上的Nemotron模型,到Amazon Robotics借力NVIDIA物理AI平臺加速倉庫自動化——此次合作已遠超“芯片供應”層面,而是AI技術棧從芯片、系統(tǒng)到應用的全方位融合。亞馬遜云科技提供了全球最廣泛的GPU實例選擇與Nitro+EFA的安全可靠底座,NVIDIA則貢獻了從加速計算到開放模型的全棧能力。





