AWSとNVIDIAは8月26日、戦略提携を拡大し、2027~2028年にAWSのグローバル基盤へNVIDIA GPUを追加で200万基配備する計画を発表した。単なるチップ調達ではなく、NVIDIA Vera CPU、NVLink Fusion、Nemotronオープンモデル、データ処理、ロボットまで対象にする。
200万基のGPUは何に使われるのか
AWSによると、追加容量はモデルの学習・推論、科学研究、企業自動化、ロボットなどの本番ワークロードを支える。計画にはBlackwell Ultra、Rubin、Rubin Ultraが含まれ、AWSのグローバル基盤とAIファクトリーに配備される。
今回の発表は、NVIDIA GTC 2026で示したAWSの拡張方針を引き継ぐ。当初は2026年から100万基超を追加する計画だったが、需要が従来の想定を上回ったとして、2027~2028年の追加計画を拡大する。
協業はAIスタック全体へ
GPUに加え、AWSはNVIDIA Vera CPU基盤を支援し、NVIDIAプラットフォームをAWS Nitro SystemとElastic Fabric Adapterに統合する。これは単一APIの機能というより、GPUクラスターの安全性、ネットワーク、計算連携に関わる部分だ。
モデル層ではNVIDIA NemotronのオープンモデルをAmazon BedrockとSageMakerで提供する。データ層ではcuDFとcuVSで処理とベクトル索引を高速化し、Amazon Roboticsは倉庫自動化でNVIDIAのフィジカルAI基盤を採用する。
計画と現在使えるサービスを分ける
200万基は2027~2028年の配備計画であり、今日すべてを借りられる容量ではない。GPUの種類、地域、EC2インスタンス、サービスごとの提供時期はAWSの今後の発表に左右される。
企業はGPUの数だけでモデルのコストや性能を推定できない。モデルサイズ、メモリ、ネットワーク、ストレージ、バッチ戦略、推論量、ソフトウェア最適化に左右され、AWSの性能値も特定構成での比較として見る必要がある。
AI開発者への意味
今回の協業は、AI競争が最強モデルの比較から、信頼できる学習・推論・データ・ロボット基盤を誰が提供できるかへ広がったことを示す。開発チームはモデル選択、GPU供給、コスト、データパイプライン、導入地域を一体で評価すべきで、単一のハードウェア数を追うだけでは足りない。
公式情報は AWSとNVIDIAの発表。
