Zum Hauptinhalt springen
Cloud / AWS / Produkte / AWS Data Pipeline - Daten-Orchestrierung

AWS Data Pipeline - Daten-Orchestrierung

AWS Data Pipeline orchestriert Datenverarbeitung und -bewegung zwischen AWS-Services und On-Premises-Systemen.

Analytics
Dieser Service ist veraltet oder eingestellt

AWS Data Pipeline befindet sich im Maintenance-Modus (keine Neukunden). Alternativen: AWS Glue, Amazon MWAA oder AWS Step Functions.

Preismodell Bezahlung pro pipeline und activity
Verfügbarkeit Alle wichtigen Regionen
Datensouveränität EU-Regionen verfügbar
Zuverlässigkeit N/A SLA

Hinweis: AWS Data Pipeline befindet sich im Maintenance-Modus. Für neue Datenpipeline-Projekte empfiehlt AWS den Einsatz von AWS Glue, AWS Step Functions oder Amazon MWAA (Managed Workflows for Apache Airflow).

Was ist AWS Data Pipeline?

AWS Data Pipeline ist ein Web-Service zur zuverlässigen Verarbeitung und Verschiebung von Daten zwischen verschiedenen AWS-Services in definierten Intervallen. Der Service orchestriert ETL-Workflows, plant deren Ausführung und handhabt automatisch Fehler und Wiederholungen.

Data Pipeline unterstützt die Datenverarbeitung mit EC2 oder EMR und ermöglicht den Datentransfer zwischen S3, DynamoDB, RDS, Redshift und On-Premises-Systemen. Mit Preconditions und Abhängigkeiten definieren Sie komplexe Workflows, die zuverlässig und wiederholbar ausgeführt werden.

Kernfunktionen

  • Scheduling: Zeitbasierte oder ereignisgesteuerte Ausführung von Datenworkflows
  • Fehlertoleranz: Automatische Wiederholungen, Benachrichtigungen und Failover
  • Datenvalidierung: Preconditions prüfen Datenverfügbarkeit vor der Verarbeitung
  • Hybrid-Support: Verbindung zu On-Premises-Datenquellen über Data Pipeline Agent
  • Templates: Vordefinierte Vorlagen für häufige Szenarien wie S3-zu-RDS-Kopien

Typische Anwendungsfälle

Tägliche Datenexporte: Exportieren Sie täglich Daten aus Produktionsdatenbanken zu S3 für Analysen. Data Pipeline startet den Job automatisch, prüft die Datenverfügbarkeit und benachrichtigt bei Problemen.

EMR-Cluster-Orchestrierung: Starten Sie EMR-Cluster für Batch-Verarbeitung, führen Sie Spark- oder Hadoop-Jobs aus und beenden Sie den Cluster automatisch nach Abschluss. Data Pipeline optimiert so die Kosten für periodische Big-Data-Jobs.

Datenbank-Synchronisation: Replizieren Sie Daten zwischen verschiedenen Datenbanken oder Regionen. Data Pipeline führt inkrementelle Kopien basierend auf Zeitstempeln oder Change Tracking durch.

Vorteile

  • Zuverlässige Ausführung mit automatischen Wiederholungen und Fehlerbehandlung
  • Unterstützung für On-Premises-Datenquellen über den Data Pipeline Agent
  • Keine Serverinfrastruktur zu verwalten (Compute wird automatisch provisioniert)
  • Kostenkontrolle durch zeitgesteuerte Cluster-Provisionierung

Integration mit innFactory

Als AWS Reseller unterstützt innFactory Sie bei AWS Data Pipeline: Workflow-Design, Migration zu modernen Alternativen wie AWS Glue oder Step Functions und Optimierung bestehender Pipelines.

Typische Anwendungsfälle

ETL workflows
Data movement
Scheduled processing
Data transformation

Häufig gestellte Fragen

Was ist AWS Data Pipeline?

AWS Data Pipeline ist ein Web-Service zur zuverlässigen Verarbeitung und Verschiebung von Daten zwischen verschiedenen AWS-Compute- und Storage-Services sowie On-Premises-Datenquellen in definierten Intervallen.

Wie unterscheidet sich Data Pipeline von AWS Glue?

AWS Glue ist serverlos und für ETL-Jobs optimiert, während Data Pipeline mehr Kontrolle über die Ausführungsumgebung (EC2, EMR) bietet. Für neue Projekte empfiehlt AWS häufig AWS Glue oder Step Functions.

Welche Datenquellen unterstützt Data Pipeline?

Data Pipeline unterstützt S3, DynamoDB, RDS, Redshift, EMR und On-Premises-Datenbanken. Sie können auch benutzerdefinierte Aktivitäten mit Shell-Befehlen oder eigenen Scripts ausführen.

Wie funktioniert die Fehlerbehandlung?

Data Pipeline bietet automatische Wiederholungen bei Fehlern, Benachrichtigungen über SNS und detaillierte Logs. Sie können Abhängigkeiten zwischen Aktivitäten definieren und Preconditions für bedingte Ausführung nutzen.

Hinweis: Alle Produktinformationen auf dieser Seite wurden sorgfältig zusammengestellt, sind jedoch ohne Gewähr und können veraltet oder unvollständig sein. Cloud-Services entwickeln sich schnell weiter — Funktionen, Preise, SLAs und Verfügbarkeit ändern sich laufend. Verbindliche und aktuelle Informationen finden Sie ausschließlich auf der offiziellen Produktseite von AWS (offizielle Dokumentation). Diese Seite stellt kein Angebot von AWS dar.

AWS Cloud Expertise

innFactory ist AWS Reseller mit zertifizierten Cloud-Architekten. Wir bieten Beratung, Implementierung und Managed Services für AWS.

Ähnliche Produkte anderer Cloud-Anbieter

Andere Cloud-Anbieter bieten vergleichbare Services in dieser Kategorie. Als Multi-Cloud Partner helfen wir bei der richtigen Wahl.

Azure

Azure Analysis Services: BI-Datenmodelle

Azure Analysis Services bietet Enterprise-BI-Datenmodellierung für schnelle, interaktive Analysen mit Power BI und …

Preismodell Tier-basiert (Developer, Basic, …
SLA 99,9% für Basic- und Standard-Tier; Developer-Tier ohne SLA
Vergleichen →
Azure

Azure Data Explorer - Echtzeitanalyse für Telemetriedaten

Azure Data Explorer ist ein Analytics-Service für Echtzeit-Log- und Telemetriedaten im Petabyte-Bereich, Basis für …

Preismodell Pay-as-you-go nach Cluster-Größe …
SLA SLA gemäß Anbieter (siehe offizielle SLA-Seite)
Vergleichen →
Azure

Azure Data Factory - Cloud ETL und Datenintegration

Azure Data Factory: Vollständig verwalteter ETL-Service für Cloud-basierte Datenintegration und Orchestrierung

Preismodell Pay-per-Pipeline-Run und Datenvolumen
SLA 99,9% für Data Factory V2
Vergleichen →
Azure

Azure Data Lake Storage Gen2 - Skalierbarer Data Lake

Azure Data Lake Storage Gen2 kombiniert hierarchischen Namespace mit Blob Storage für Big-Data-Analytics und Machine …

Preismodell Bezahlung pro GB (nach Access Tier) und …
SLA SLA gemäß Anbieter, abhängig von Redundanzoption (siehe offizielle SLA-Seite)
Vergleichen →
Azure

Azure Data Manager for Energy - OSDU-Datenplattform

Azure Data Manager for Energy ist eine OSDU-konforme, verwaltete Datenplattform für Energie- und Geowissenschaftsdaten …

Preismodell Pro Instanz und Stunde, gestaffelt nach …
SLA SLA gemäß Anbieter (siehe offizielle SLA-Seite)
Vergleichen →
Azure

Azure Data Share - Sichere Datenfreigabe

Azure Data Share: verwalteter Microsoft-Dienst zum sicheren Teilen von Daten mit externen Partnern und Kunden.

Preismodell Bezahlung pro Dataset-Snapshot und …
SLA SLA gemäß Anbieter (siehe offizielle SLA-Seite)
Vergleichen →

39 vergleichbare Produkte bei anderen Cloud-Anbietern gefunden.

Bereit, mit AWS Data Pipeline - Daten-Orchestrierung zu starten?

Unsere zertifizierten AWS Experten helfen bei Architektur, Integration und Optimierung.

Beratung vereinbaren