Amazon Web Services hat am 26. Oktober 2017 die EC2-P3-Instanzen verfügbar gemacht. Die neue GPU-Generation richtet sich an maschinelles Lernen, Hochleistungsrechnen und andere Anwendungen mit hohem Bedarf an paralleler Rechenleistung.
Die größte Variante p3.16xlarge kombiniert acht NVIDIA-Tesla-V100-GPUs, bis zu 64 vCPUs und 488 GB Arbeitsspeicher. AWS nennt eine gemischte Rechenleistung von bis zu einem Petaflop, 300 GB/s über NVLink und bis zu 25 Gbit/s Netzwerkbandbreite. Kleinere Varianten stehen mit einer oder vier GPUs bereit.
GPU-Cloud für große Daten- und Build-Aufgaben
AWS beziffert den Leistungsvorteil gegenüber den vorherigen P2-Instanzen mit bis zu dem 14-Fachen. Das verkürzt laut Anbieter Trainingsläufe von Tagen auf Stunden. Für technische Teams kann eine solche Infrastruktur auch bei automatisierten Tests, Rendering oder der Verarbeitung umfangreicher Entwicklungsdaten eingesetzt werden, sofern die Arbeitslast dafür geeignet ist.
Die P3-Instanzen waren zunächst in Regionen in den USA, Irland und Japan verfügbar. Der frühere Beitrag zu Amazon Lumberyard hatte bereits AWS als Infrastruktur im Umfeld der Spieleentwicklung behandelt. P3 zielte dagegen auf die GPU-Rechenleistung in der Cloud und nicht auf eine Game-Engine.

