Was ist Lakehouse for Apache Iceberg?
Lakehouse for Apache Iceberg, bis April 2026 als BigLake bekannt, ist Googles Speicher-Engine für offene Data Lakehouses. Der Service kombiniert das offene Apache-Iceberg-Tabellenformat mit vollständig verwalteter, unternehmenstauglicher Storage-Infrastruktur auf Google Cloud und bietet eine einheitliche Schnittstelle für Analytics und KI-Workloads.
Kern des Produkts ist der Lakehouse Runtime Catalog (früher BigLake Metastore), ein serverloser Metadatenservice, der als zentrale Quelle für Tabellenmetadaten über verschiedene Query-Engines hinweg dient. Damit entfällt die Notwendigkeit, Metadaten zwischen unterschiedlichen Systemen zu synchronisieren. Bestehende BigLake-APIs, Client-Bibliotheken, CLI-Befehle und IAM-Namen bleiben unverändert.
Kernfunktionen
- Offenes Iceberg-Format: Native Unterstützung für Apache Iceberg V2 (GA) und V3 (Preview) Tabellen
- Lakehouse Runtime Catalog: Zentraler, serverloser Metadatenkatalog für konsistente Governance
- Multi-Engine Zugriff: Dieselben Daten mit BigQuery, Apache Spark, Flink, Hive oder Trino abfragen
- Feingranulare Sicherheit: Row-level Security und Column Masking auf Lakehouse-Daten
- Cross-Cloud Lakehouse (Preview): Zugriff auf Iceberg-Daten in AWS S3 oder Azure ohne Datenverschiebung
Typische Anwendungsfälle
Offene Data-Lakehouse-Architektur
Kombination von Data-Lake-Flexibilität mit Data-Warehouse-Funktionen. Iceberg-Tabellen ermöglichen ACID-Transaktionen, Zeitreisen, Schema- und Partitions-Evolution auf Parquet-Daten.
Unified Data Governance
Ein Governance-Framework für alle Iceberg-Daten im Unternehmen. IAM-Policies werden über den Lakehouse Runtime Catalog konsistent durchgesetzt, unabhängig davon, welche Engine auf die Daten zugreift.
Multi-Cloud-Analytics
Mit Cross-Cloud Lakehouse können Analytics- und KI-Workloads auf Iceberg-Daten zugreifen, die in anderen Clouds liegen, ohne ETL-Prozesse oder zusätzliche Kopien.
Vorteile
- Keine Datenverschiebung für Analytics erforderlich
- Vendor-Lock-in vermeiden durch offenes Iceberg-Format
- Konsistente Sicherheit über alle Query-Engines
- Kosteneffizient durch Trennung von Storage und Compute
Integration mit innFactory
Als zertifizierter Google Cloud Partner unterstützt innFactory Sie bei Lakehouse for Apache Iceberg: Lakehouse-Architektur, Migration von Hadoop/Hive oder bestehenden BigLake-Umgebungen, Iceberg-Tabellendesign und Governance-Implementierung. Wir helfen bei der Modernisierung Ihrer Data Platform.
Verfügbare Varianten & Optionen
Lakehouse for Apache Iceberg
- Einheitliche Governance
- Offenes Iceberg-Tabellenformat
- Multi-Engine Zugriff
- Nur Apache Iceberg als Tabellenformat
Typische Anwendungsfälle
Häufig gestellte Fragen
Was ist Lakehouse for Apache Iceberg?
Lakehouse for Apache Iceberg (früher BigLake) ist Googles Speicher-Engine für offene Data Lakehouses. Sie ermöglicht einheitlichen Zugriff auf Iceberg-Tabellen in Cloud Storage über verschiedene Engines wie BigQuery, Spark, Flink, Hive oder Trino.
Welche Tabellenformate werden unterstützt?
Der Service unterstützt Apache Iceberg V2 Tabellen (allgemein verfügbar) und V3 Tabellen (Preview). Frühere Unterstützung für Delta Lake und Apache Hudi ist im aktuellen Produkt nicht mehr Fokus; der Service ist auf Apache Iceberg als offenen Standard ausgerichtet.
Was war BigLake und was ist der Lakehouse Runtime Catalog?
BigLake wurde im April 2026 in Lakehouse for Apache Iceberg umbenannt. Der frühere BigLake Metastore heißt jetzt Lakehouse Runtime Catalog, ein vollständig verwalteter, serverloser Metadatenservice als zentrale Quelle über verschiedene Systeme hinweg. APIs, Client-Bibliotheken und IAM-Bezeichnungen referenzieren weiterhin BigLake.
Wie funktioniert der Multi-Cloud-Zugriff?
Über Cross-Cloud Lakehouse (Preview) können Metadaten aus anderen Cloud-Anbietern wie AWS S3 oder Azure synchronisiert werden, ohne die Daten zu verschieben. Dadurch lassen sich Analysen und KI-Workloads providerübergreifend auf Iceberg-Daten ausführen.
Hinweis: Alle Produktinformationen auf dieser Seite wurden sorgfältig zusammengestellt, sind jedoch ohne Gewähr und können veraltet oder unvollständig sein. Cloud-Services entwickeln sich schnell weiter — Funktionen, Preise, SLAs und Verfügbarkeit ändern sich laufend. Verbindliche und aktuelle Informationen finden Sie ausschließlich auf der offiziellen Produktseite von Google Cloud (offizielle Dokumentation). Diese Seite stellt kein Angebot von Google Cloud dar.
