擬部署200萬 GPU 加速代理式 AI 發展
Amazon Web Services(AWS)與 NVIDIA 宣佈擴展長達 16 年的戰略合作。面對全球對 AI 算力需求持續上升,雙方計劃於 2027 至 2028 年間,在 AWS 的全球基礎設施中新增部署 200 萬顆 NVIDIA GPU,並將技術合作延伸至 CPU、網絡、開放模型及機械人技術等範疇。
合作 4 大核心技術亮點
▪️擴展 GPU 雲端容量:因應企業從 AI 試點走向實際生產,AWS 將新增 200 萬顆 GPU,支援代理式 AI(Agentic AI)、科學研究、企業自動化及實體 AI 等大規模工作負載。
▪️引進 NVIDIA Vera CPU:AWS 將導入 Vera CPU 基礎設施,專為代理式 AI 的後端任務(如程式碼執行、數據分析及任務編排)提供高效能運算,避免 GPU 出現效能瓶頸。
▪️整合 Trainium 晶片與 NVLink 互連技術:下一代 Amazon Trainium 晶片將支援 NVIDIA NVLink Fusion 及客製化高頻寬記憶體(NVHBM),讓自研晶片與 GPU 能在統一的機架架構下更高效運作。
▪️數據處理與機械人應用:透過 GPU 加速,Apache Spark 數據處理速度提升高達 3.7 倍;Amazon Robotics 亦整合 NVIDIA 的實體 AI 平台,以加速倉儲自動化測試與應用。
AWS 行政總裁 Matt Garman 表示:「客戶希望自由選擇最適合其 AI 工作負載的工具。我們與 NVIDIA 加強合作,目標是讓 AWS 成為運行 NVIDIA AI 技術的最佳平台,為企業及政府機構提供多元化的建構方式。」
NVIDIA 創始人暨行政總裁黃仁勳補充指雙方將合作擴展至整個技術架構,包括 GPU、CPU、網絡及軟件,以回應客戶對代理式 AI 和實體 AI 的強勁需求。
是次合作讓企業可按特定工作負載,彈性選擇 NVIDIA GPU、AWS 自研 Trainium 晶片或兩者混合使用,在提升算力規模的同時,亦能保持極高的靈活性與成本效益。