NVIDIA und AWS vertiefen ihre Zusammenarbeit, um KI-Systeme produktionsreif und skalierbar zu machen.
Neue EC2 G7-Instanzen mit NVIDIA RTX PRO 4500 Blackwell Server Edition GPUs
AWS führt neue Amazon EC2 G7-Instanzen ein, die auf der NVIDIA RTX PRO 4500 Blackwell Server Edition GPU basieren. Diese Instanzen sind für KI-Inferenz, Grafik, Spatial Computing und GPU-beschleunigte Datenanalyse konzipiert.
Im Vergleich zu vorherigen Generationen bieten sie eine erhebliche Steigerung bei der KI-Inferenzleistung und der Grafikleistung. Sie beschleunigen zudem die GPU-gestützte Datenanalyse auf Amazon EMR mit der NVIDIA cuDF-Bibliothek für Apache Spark-Workloads.
Die Instanzen unterstützen bis zu acht GPUs mit insgesamt 256 GB GPU-Speicher, 700 Gbit/s EFA-fähiger Netzwerkkonnektivität und bis zu 7,6 TB lokalem NVMe-SSD-Speicher. Verfügbar sind Konfigurationen mit einer, zwei, vier und acht GPUs; eine Bare-Metal-Option folgt. Der Zugriff erfolgt über AWS Deep Learning AMIs, Amazon Deep Learning Containers, Amazon EMR, Amazon EKS, Amazon ECS und Grafik-AMIs. Eine Integration in Amazon SageMaker AI ist geplant.
Die GPUs basieren auf der NVIDIA Blackwell-Architektur.
NVIDIA cuVS als Standard für Vektorsuche in Amazon OpenSearch Serverless
NVIDIA cuVS wird zur Standard-Compute-Engine für alle Vektorsammlungen in der nächsten Generation von Amazon OpenSearch Serverless. GPU-beschleunigtes Vektor-Indexing wird damit zur Standardfunktion.
Die Integration ermöglicht eine erheblich schnellere Vektorindizierung bei deutlich reduzierten Kosten im Vergleich zu CPU-basierten Lösungen. Der Aufbau großer Vektordatenbanken wird dadurch praktikabel. Dies ist relevant für Retrieval-Augmented Generation (RAG), semantische Suche, Empfehlungssysteme und agentische KI-Anwendungen.
AWS erreicht NVIDIA Exemplar Cloud Status für GB300-Training
AWS hat den NVIDIA Exemplar Cloud Status für NVIDIA GB300 für Trainings-Workloads erhalten. Der Status bestätigt, dass die AWS-Infrastruktur die strengen Leistungsschwellen von NVIDIA erfüllt.
Dieses Ergebnis entstand durch intensive Ko-Engineering-Arbeit zwischen beiden Unternehmen. Der Status erleichtert Entwicklern die Auswahl einer validierten Cloud-Infrastruktur für groß angelegtes KI-Training. Der GB300 basiert auf dem NVIDIA GB200 Grace Blackwell Superchip, der für das Training großer Sprachmodelle und komplexer KI-Modelle konzipiert ist.
Quelle: NVIDIA Blog
FAQ
Welche Leistungsverbesserung bieten die neuen EC2 G7-Instanzen?
Die G7-Instanzen liefern im Vergleich zu G6-Instanzen eine erhebliche Steigerung der KI-Inferenzleistung und der Grafikleistung sowie eine beschleunigte GPU-gestützte Datenanalyse.
Was ändert sich durch cuVS in Amazon OpenSearch Serverless?
cuVS wird zur Standard-Compute-Wahl. Dies macht GPU-beschleunigtes Vektor-Indexing zur Standardfunktion und ermöglicht deutlich schnellere Indizierung bei reduzierten Kosten.
Was bedeutet der NVIDIA Exemplar Cloud Status für AWS?
Der Status bestätigt, dass AWS die von NVIDIA definierten Leistungsanforderungen für KI-Trainings-Workloads auf Basis der Referenzarchitektur erfüllt. Er signalisiert validierte Leistungsfähigkeit für großskaliges Training.