AWS와 NVIDIA는 8월 26일 전략적 협력을 확대하고 2027~2028년 AWS 글로벌 인프라에 NVIDIA GPU 200만 개를 추가 배치할 계획이라고 발표했다. 단순 칩 공급을 넘어 NVIDIA Vera CPU와 NVLink Fusion, Nemotron 오픈 모델, 데이터 처리, 로봇까지 대규모 에이전틱·피지컬 AI 작업을 위한 협력이다.
GPU 200만 개는 어디에 쓰이나
AWS에 따르면 추가 용량은 모델 학습·추론과 과학 연구, 기업 자동화, 로봇 등 운영 작업을 지원한다. 계획된 GPU에는 Blackwell Ultra와 Rubin, Rubin Ultra가 포함되며 AWS 글로벌 인프라와 AI 팩토리에 배치된다.
이번 발표는 NVIDIA GTC 2026에서 제시한 AWS 확장 계획의 연장선이다. 당초 2026년부터 NVIDIA GPU 100만 개 이상을 추가할 예정이었지만 수요가 기존 전망을 웃돌아 2027~2028년 추가 계획을 키웠다고 양사는 설명했다.
협력 범위가 AI 스택 전체로
GPU 외에도 AWS는 NVIDIA Vera CPU 인프라를 지원하고 NVIDIA 플랫폼을 AWS Nitro System, Elastic Fabric Adapter와 통합한다. 이는 하나의 API에서 보이는 모델 기능보다 GPU 클러스터의 보안과 네트워크, 연산 협업에 영향을 준다.
모델 계층에서는 NVIDIA Nemotron 오픈 모델을 Amazon Bedrock과 SageMaker로 제공한다. 데이터 계층에서는 cuDF와 cuVS로 처리와 벡터 인덱싱을 가속하고 Amazon Robotics는 창고 자동화에 NVIDIA 피지컬 AI 플랫폼을 도입한다.
계획과 현재 이용 가능한 용량은 다르다
GPU 200만 개는 2027~2028년 배치 계획이지 오늘 모두 임대할 수 있는 용량이 아니다. 제공 시점은 AWS의 후속 제품 발표와 GPU 종류, 지역, EC2 인스턴스, 서비스에 따라 달라진다.
기업은 GPU 수만으로 모델 비용이나 성능을 추정할 수 없다. 결과는 모델 크기와 메모리, 네트워크, 스토리지, 배치 전략, 추론 트래픽, 소프트웨어 최적화에 달려 있으며 AWS 성능 수치는 특정 구성의 비교로 봐야 한다.
AI 개발자에게 주는 의미
이번 협력은 AI 경쟁이 어떤 모델이 가장 강한지를 넘어 안정적인 학습·추론·데이터·로봇 인프라를 누가 제공하는지로 넓어졌음을 보여준다. 개발팀은 모델 선택과 GPU 공급, 비용 관리, 데이터 파이프라인, 배포 지역을 함께 평가해야 하며 하드웨어 숫자 하나만 따라가서는 안 된다.
공식 세부 내용은 AWS와 NVIDIA 발표。
