Managed Data Lakehouse: souverän & Open Source | Stackable
Managed Stackable
Data Lakehouse
Das Enterprise Data Lakehouse als Managed Service mit den etablierten Werkzeugen der Stackable Data Platform:
Souverän · Compliant · Open Source
- Das Ende der Datensilos
- Alle Features für dein Datenmanagement
- Volle digitale Souveränität
- Ein Fundament, viele Use Cases
- Vollständig gemanaged - kein Betriebsaufwand
Stackable - Deine souveräne Datenplattform
Von Datensilos zur zentralen Datenplattform
Das Managed Stackable Data Lakehouse ist für analytische Enterprise-Workloads konzipiert – souveränes Datenmanagement unabhängig von Branche und Unternehmensgröße.
Zentrale Datenplattform
Daten aus verschiedenen Quellsystemen (ERP, CRM, Maschinendaten, Excel-Listen) in einem Lakehouse konsolidieren – für konsistentes Reporting und Self-Service-Analytics statt manueller Excel-Konsolidierung.
Datenbasis für KI- und ML-Projekte
Saubere, konsolidierte Datengrundlage schaffen, auf der Machine-Learning-Modelle oder KI-Anwendungen aufgebaut werden können – ohne teure Parallel-Infrastruktur.
Compliance & Auditierbarkeit
Historische Datenstände nachvollziehbar und revisionssicher vorhalten (z. B. für DSGVO-Auskünfte, Wirtschaftsprüfung oder Zertifizierungen) durch Time-Travel-Funktionen des Lakehouse.
Kunden- und Vertriebsanalyse
Bestellhistorien, Kundenverhalten und Vertriebsdaten zusammenführen, um Cross-Selling-Potenziale und Kundenabwanderung frühzeitig zu erkennen.
Vorausschauende Wartung (Predictive Maintenance)
Maschinen- und Sensordaten auswerten, um Ausfallzeiten und Wartungskosten zu reduzieren – spezialisierte Modelle entwickeln und anwenden, auch in Echtzeit.
Lieferketten-Transparenz
Daten aus Beschaffung, Logistik und Produktion zusammenführen, um Engpässe, Lieferantenabhängigkeiten und Bestandsrisiken frühzeitig zu erkennen.
Das Open-Source-Data-Lakehouse
Alle Module des Stackable Data Lakehouses sind stabil, performant und vollständig gemanaged – natürlich zukunftssicher.
Trino
Schnelle, verteilte SQL-Query-Engine für interaktive Ad-hoc-Analysen direkt auf deinen Data Lakes ohne Datenverschiebung.
Apache Iceberg
Offenes Hochleistungs-Tabellenformat für ACID-Transaktionen, Time-Travel und schemaübergreifende Datenkonsistenz auf S3-Storage.
Apache Superset
Interaktive Dashboards & Ad-hoc-Datenexploration für Fachanwender.
Apache NiFi
Visuelle Datenfluss-Gestaltung für Ingestion, Transformation & Routing.
Apache Spark
Die bewährte, blitzschnelle Berechnungs-Engine für anspruchsvolle Batch-Verarbeitung, ETL-Pipelines und Machine Learning.
Apache Airflow
Skalierbarer Workflow-Manager zur Orchestrierung, Planung und lückenlosen Überwachung aller Datenströme.
OPA & OIDC
Feingranulare Autorisierungsrichtlinien & Single Sign-on über alle Komponenten.
Keycloak & OpenID
Single-Sign-On (SSO) und sichere Nutzer-Authentifizierung.
Konfiguriere deinen Managed Service
Das Stackable Data Lakehouse in verschiedenen Größen: Wähle deine Infrastruktur mit dem passenden Servicepartner.
Stackable Data Platform · Trino · Apache Spark · Apache Iceberg · Apache Airflow · Apache Superset · Apache NiFi
Red Hat OpenShift hinzufügen
Optional: Enterprise-Container-Orchestrierung & Access-Management.
* Die ersten 30 Tage sind kostenlos. Ab dem 31. Tag monatlich 449 € (ohne Support und SLA).
+
+
Individuell
Häufig gestellte Fragen
Hier findest Du schnelle Antworten auf die wichtigsten Fragen rund um unsere flexiblen Multi-Cloud-Kombinationen und managed Infrastrukturen.
Was ist ein Managed Data Lakehouse und für wen eignet es sich?
Ein Managed Data Lakehouse ist eine betriebsfertige Datenplattform, die Data Lake und Data Warehouse verbindet und deren Betrieb ein Partner übernimmt. Es eignet sich besonders für Unternehmen mit großen Datenmengen, die keine eigene Plattform-Ops-Kapazität aufbauen wollen.
Wie vermeidet ein Open-Source-Data-Lakehouse Vendor Lock-in?
Es vermeidet Vendor Lock-in durch offene Formate (Apache Iceberg auf S3) und eine als Code definierte, per GitOps portierbare Plattform aus Open-Source-Modulen. Cloud, Managed Partner und Komponenten können gewechselt werden.
Bleiben meine Daten DSGVO-konform und in Europa?
Ja. Wähle die Infrastruktur selbst, etwa einen Cloud Service Provider mit deutscher Jurisdiktion, eine Private Cloud oder Dein eigenes Rechenzentrum. Alle Hosting-Partner und Rechenzentren sind nach ISO 27001 zertifiziert und arbeiten in voller Konformität mit der europäischen Datenschutz-Grundverordnung (DSGVO). Sichere Zugriffskontrolle erfolgt über Open Policy Agent und Keycloak sowie revisionssichere Historie mit Apache Iceberg unterstützen regulierte Branchen (z.B. DORA im Finanzsektor).
Brauche ich für ein Managed Data Lakehouse ein eigenes Betriebsteam?
Nein. Im Managed-Modell übernimmt der Partner Bereitstellung, Betrieb, Monitoring und Updates auf Kubernetes, während Du dich auf Deine Datenanwendungen konzentrieren kannst.
Müssen Fachanwender für Datenanalysen Kubernetes können?
Nein. Fachanwender arbeiten über das Stackable Cockpit ohne Kontakt zur darunterliegenden Infrastruktur mit Apache Superset mit Dashboards und Ad-hoc-Analysen, Apache Airflow für Orchestrierung, Apache NiFi für Datenpipelines sowie einem Stackable-eigenen Query Editor für Trino und einem S3-Manager.
Was ist im Preis enthalten?
Der Monatspreis bündelt SDP-Subscription, Managed Service und Cloud-Infrastruktur mit SLA-Support. Dieses beinhaltet den Betrieb der Plattform inklusive Konfiguration, Monitoring, Patches und Updates.
Worin unterscheiden sich die Pakete XS, S, M und Individuell?
Die Pakete unterscheiden sich in Rechen- und Speicherkapazität (Nodes, vCPUs, RAM, S3), während der Funktionsumfang gleich bleibt. Reichen die Standardpakete nicht, dimensioniert „Individuell“ die Plattform auf Deinen speziellen Bedarf. Das XS-Paket ist der Einstieg mit minimalen Ressourcen für Tests, Proof-of-Concepts und kleine Workloads ohne Support und SLA. Für den Produktivbetrieb wähle ein bezahltes Paket.
Gibt es garantierte Service Level Agreements (SLAs)?
Ja, wir vereinbaren verbindliche Service Level Agreements, die exakt auf Deine geschäftskritischen Workloads abgestimmt sind. Das beinhaltet Verfügbarkeitsgarantien von bis zu 99,99 % und dedizierten Support (8×5) auf Wunsch auch rund um die Uhr (24×7 mit zusätzlichen Kosten).
Kann ich den Partner oder die Cloud später wechseln?
Ein Wechsel ist dank standardisierter APIs und containerisierter Setup-Strukturen unkompliziert möglich. Wir unterstützen Dich aktiv beim Übergang, um minimale Downtimes und maximale Datensicherheit zu garantieren.
Wie planbar sind die Kosten im Vergleich zu Databricks oder Snowflake?
Du zahlst einen festen Monatspreis für klar definierte Ressourcen, d.h. keine variablen, verbrauchsbasierten Gebühren. So entstehen keine zusätzlichen Kosten durch Query- oder Datenvolumen. Außerdem kannst Du Dein Paket zum Monatsende an Deinen Bedarf anpassen (vergrößern, verkleinern).
Stell deine Kombination zusammen
Wähle deine bevorzugte Cloud – gemeinsam bauen wir die technologische Brücke für deine Enterprise-Workloads. Lass uns die Details in einem kurzen Gespräch klären.