Projektportal
Projektdetails
Data Engineer / Databricks / PySpark / Python (m/w/d)
- Data
- Engine
- PySpark
- Pytho
- Daten
Für ein laufendes Projekt suchen wir kurzfristig einen erfahrenen Data Engineer (m/w/d), idealerweise deutschsprachig, der ab August verfügbar ist und umfangreiche Erfahrung im Bereich Datenintegration, Datenaufbereitung und Datenmodellierung mitbringt.
Aufgaben:
+ Analyse, Verständnis und Refactoring bestehender Databricks-Notebooks
+ Erweiterung und Weiterentwicklung bestehender Datenpipelines
+ Entwicklung und Optimierung von ETL-/ELT-Prozessen
+ Durchführung komplexer Datentransformationen und Joins
+ Erstellung und Pflege von Mapping-Logiken für unterschiedliche Datenquellen
+ Sicherstellung der Datenqualität durch Data Cleansing und Validierungsmaßnahmen
+ Unterstützung bei der Verarbeitung und Integration großer Datenmengen innerhalb einer modernen Data-Plattform
Must:
+ Mehrjährige Erfahrung als Data Engineer
+ Sehr gute Kenntnisse in Databricks
+ Fundierte Erfahrung mit PySpark
+ Sehr gute Python-Kenntnisse
+ Erfahrung im Aufbau, der Optimierung und Wartung von Datenpipelines
+ Erfahrung mit komplexen Datentransformationen, Mapping-Prozessen und Datenqualitätsmanagement
+ Idealerweise deutschsprachige Kommunikation
Nice:
+ Erfahrung mit Delta Tables
+ Kenntnisse im Bereich Product Information Management (PIM)
+ Erfahrung mit BMEcat
+ Gute Kenntnisse in XML
+ Erfahrung mit ECLASS-Klassifizierungen
+ Erfahrung in der Verarbeitung von Produkt- und Stammdaten im elektronischen Handel oder technischen Großhandel