Zum Hauptinhalt springen
Cloud / AWS / Produkte / AWS Parallel Computing Service: Managed HPC mit Slurm

AWS Parallel Computing Service: Managed HPC mit Slurm

AWS Parallel Computing Service (PCS) betreibt verwaltete HPC-Cluster auf Slurm-Basis für Simulations- und Forschungs-Workloads.

Compute
Preismodell Stündliche Cluster-Controller-Gebühr und stündliche Node-Management-Gebühr je EC2-Instanz, zuzüglich der genutzten AWS-Ressourcen
Verfügbarkeit Unter anderem Frankfurt (eu-central-1), Irland (eu-west-1), London (eu-west-2), Mailand (eu-south-1), Paris (eu-west-3), Spanien (eu-south-2) und Stockholm (eu-north-1)
Datensouveränität EU-Regionen verfügbar
Zuverlässigkeit SLA gemäß Anbieter (siehe offizielle SLA-Seite) SLA

Was ist AWS Parallel Computing Service?

AWS Parallel Computing Service (AWS PCS) ist ein verwalteter Dienst, mit dem Sie High-Performance-Computing-Workloads (HPC) auf AWS mit Slurm ausführen und skalieren. AWS betreibt dabei den Slurm-Controller, während die Rechenknoten als EC2-Instanzen in Ihrem eigenen AWS-Account laufen.

Der Dienst kombiniert Compute, Storage, Netzwerk und Visualisierungswerkzeuge zu einer elastischen Umgebung. Nutzerinnen und Nutzer arbeiten in der gewohnten Slurm-Umgebung, ohne die zugrunde liegende Infrastruktur selbst betreiben zu müssen.

Kernfunktionen

  • Verwalteter Slurm-Controller: AWS betreibt und aktualisiert den Scheduler, inklusive verwalteter Updates
  • Compute Node Groups: Gruppen elastisch skalierender EC2-Instanzen, die Jobs ausführen; Login-Knoten lassen sich als eigene Node Group betreiben
  • Queues: Warteschlangen, die Jobs gezielt an Compute Node Groups zuweisen
  • Gemeinsamer Speicher: Anbindung von Amazon EFS als Home-Verzeichnis und Amazon FSx for Lustre als leistungsstarkes gemeinsames Dateisystem
  • Integrierte Observability: eingebaute Beobachtbarkeit für den Clusterbetrieb
  • Bereitstellung als Code: Einrichtung über Console, AWS CLI, AWS SDK oder AWS CloudFormation

Typische Anwendungsfälle

Eng gekoppelte MPI-Anwendungen: Simulationen aus Computer Aided Engineering, Wettermodellierung oder seismischer Auswertung, die über viele Knoten hinweg kommunizieren.

High Throughput Computing: Große Mengen unabhängiger Einzeljobs, etwa Monte-Carlo-Simulationen oder Genomik-Pipelines.

Beschleunigtes Rechnen: Workloads auf GPUs, FPGAs oder AWS-eigenen Beschleunigern.

Interaktive Arbeitsabläufe: Interaktiver Zugriff über Login-Knoten für Auswertung und Visualisierung.

Vorteile

  • Vertraute Slurm-Umgebung ohne eigenen Scheduler-Betrieb
  • Elastische Skalierung der Rechenknoten über EC2
  • Rechenknoten laufen in Ihrem eigenen AWS-Account und VPC
  • Bereitstellung als Infrastructure as Code über CloudFormation
  • Verfügbarkeit in mehreren EU-Regionen

Integration mit innFactory

Als AWS Reseller unterstützt innFactory Sie bei AWS PCS: Auslegung von Cluster-Controller und Compute Node Groups, Anbindung von Amazon FSx for Lustre und Amazon EFS, Netzwerk- und IAM-Design sowie Automatisierung der Clusterbereitstellung über CloudFormation. Dabei berücksichtigen wir Kostenkontrolle und die Wahl einer EU-Region.

Typische Anwendungsfälle

HPC-Simulationen
Forschung und Wissenschaft
Computer Aided Engineering
Genomik und High Throughput Computing

Technische Spezifikationen

Building blocks Cluster, Compute Node Groups, Queues
Interfaces AWS Management Console, AWS CLI, AWS SDK, AWS CloudFormation
Scheduler Slurm (Controller wird von AWS betrieben)
Storage Amazon EFS und Amazon FSx for Lustre als gemeinsamer Speicher

Häufig gestellte Fragen

Welchen Scheduler nutzt AWS PCS?

AWS PCS nutzt Slurm. Der Slurm-Controller läuft in einem von AWS betriebenen Account, die Rechenknoten laufen als EC2-Instanzen in Ihrem eigenen Account. Anwenderinnen und Anwender arbeiten mit den gewohnten Slurm-Kommandos.

Aus welchen Bausteinen besteht ein PCS-Cluster?

Ein Cluster stellt den Slurm-Controller bereit. Darunter definieren Sie Compute Node Groups, also Gruppen elastisch skalierender EC2-Instanzen, sowie Queues, die Jobs an die Node Groups verteilen. Login-Knoten lassen sich als eigene Node Group einrichten.

Wie wird AWS PCS abgerechnet?

Laut AWS entstehen zwei separate Gebühren: eine stündliche Gebühr für den Cluster-Controller, deren Höhe von der Controller-Größe abhängt, sowie eine stündliche Node-Management-Gebühr für jede EC2-Instanz in Ihren Compute Node Groups. Optionales Slurm Accounting wird gesondert berechnet. Die genutzten EC2-Instanzen, Speicher und Datenübertragung werden zusätzlich zu den Standardtarifen abgerechnet.

Ist AWS PCS in der EU verfügbar?

Ja. Die Dokumentation listet unter anderem Endpunkte in Frankfurt (eu-central-1), Irland (eu-west-1), London (eu-west-2), Mailand (eu-south-1), Paris (eu-west-3), Spanien (eu-south-2) und Stockholm (eu-north-1). Die jeweils aktuelle Liste finden Sie in der offiziellen Dokumentation.

Welchen gemeinsamen Speicher unterstützt AWS PCS?

Die AWS-Tutorials binden Amazon EFS als gemeinsames Home-Verzeichnis und Amazon FSx for Lustre als leistungsstarkes gemeinsames Verzeichnis ein. Weitere Optionen entnehmen Sie der offiziellen Dokumentation.

Hinweis: Alle Produktinformationen auf dieser Seite wurden sorgfältig zusammengestellt, sind jedoch ohne Gewähr und können veraltet oder unvollständig sein. Cloud-Services entwickeln sich schnell weiter — Funktionen, Preise, SLAs und Verfügbarkeit ändern sich laufend. Verbindliche und aktuelle Informationen finden Sie ausschließlich auf der offiziellen Produktseite von AWS (offizielle Dokumentation). Diese Seite stellt kein Angebot von AWS dar.

AWS Cloud Expertise

innFactory ist AWS Reseller mit zertifizierten Cloud-Architekten. Wir bieten Beratung, Implementierung und Managed Services für AWS.

Bereit, mit AWS Parallel Computing Service: Managed HPC mit Slurm zu starten?

Unsere zertifizierten AWS Experten helfen bei Architektur, Integration und Optimierung.

Beratung vereinbaren