Data Engineer Databricks / Lakehouse (w/m/d)
<div class="show-more-less-html__markup show-more-less-html__markup--clamp-after-5 relative overflow-hidden"> Stellenbeschreibung:<br/><br/> <p>In dieser Rolle gestalten Sie aktiv die Transformation unserer Datenlandschaft hin zu einer modernen, skalierbaren Lakehouse-Architektur auf Databricks. Sie schaffen die Grundlage für datengetriebene Entscheidungen sowie innovative AI-Use-Cases.</p> <ul> <li>Design, Entwicklung und Betrieb moderner ETL-/ELT-Pipelines auf Basis von Python (z. B. PySpark) in Databricks</li> <li>Ablösung bestehender Data-Warehouse- und ETL-Strukturen (MS SQL Server, Stored Procedures, Automic) durch skalierbare Lakehouse-Architekturen</li> <li>Aufbau differenzierter Pipeline-Logiken zur Sicherstellung von Stabilität, SLA-Konformität und Auditierbarkeit</li> <li>Implementierung von Datenqualitätsprüfungen (Validierung, Reconciliation, Quality Checks)</li> <li>Sicherstellung der Datenkonsistenz während der Migration bestehender Systeme</li> <li>Umsetzung von Transformationen, Schema-Mappings und Metadaten-Anreicherung gemäß Zielarchitektur</li> <li>Optimierung von Datenpipelines hinsichtlich Performance, Kosten und Skalierbarkeit</li> <li>Nutzung moderner Databricks-Funktionalitäten (z. B. Delta Lake, Structured Streaming)</li> <li>Monitoring von Pipeline-Laufzeiten, Ressourcennutzung und Systemstabilität</li> <li>Enge Zusammenarbeit mit BI-, Analytics-, Architektur- und Entwicklungsteams sowie Fachbereichen</li> <li>Erstellung und Pflege technischer Dokumentation sowie Sicherstellung von Nachvollziehbarkeit und Governance</li> </ul> <br/><br/>Profilbeschreibung:<br/><br/> <ul> <li>Abgeschlossenes Studium (z. B. Informatik, Data Engineering, Wirtschaftsinformatik oder vergleichbar)</li> <li>Mehrjährige Erfahrung (ca. 3–6 Jahre) im Data Engineering</li> <li>Sehr gute Python-Kenntnisse (insb. PySpark) sowie fundierte Erfahrung mit Apache Spark und idealerweise Databricks</li> <li>Starkes Verständnis von ETL-/ELT-Prozessen, Datenmodellierung und Pipeline-Orchestrierung</li> <li>Erfahrung mit Microsoft SQL Server sowie sehr gute SQL-Kenntnisse</li> <li>Analytische, strukturierte und lösungsorientierte Arbeitsweise</li> <li>Erfahrung mit Databricks Lakehouse, Delta Lake und Structured Streaming</li> <li>Kenntnisse in Orchestrierungstools (z. B. Airflow, Databricks Workflows)</li> <li>Verständnis von Data Governance, Compliance sowie Metadatenmanagement</li> </ul> <br/><br/>Wir bieten:<br/><br/><p>• Attraktives Gehalt<br/>• Starke Gemeinschaft aus Teamplayern<br/>• Vertrauensarbeitszeit mit flexibler Einteilung und der Möglichkeit, bis zu 40% mobil zu arbeiten<br/>• Zahlreiche Weiterbildungsmöglichkeiten on- und offline<br/>• Rabatte auf 1&1 Produkte und für diverse Freizeitangebote<br/>• Betriebseigenes Restaurant<br/>• Kostenlose Getränke und frisches Obst<br/>• Jobrad-Zuschuss</p> </div>