Projektportal

Projektdetails

Zurück zur Übersicht

Data Engineer / Databricks / PySpark / Python (m/w/d)

Projektnummer: 107112
Eckdaten
6 Monate
asap
freiberuflich
D7, Oberkochen / Remote
  • Data
  • Engine
  • PySpark
  • Pytho
  • Daten

Beschreibung

Für ein laufendes Projekt suchen wir kurzfristig einen erfahrenen Data Engineer (m/w/d), idealerweise deutschsprachig, der ab August verfügbar ist und umfangreiche Erfahrung im Bereich Datenintegration, Datenaufbereitung und Datenmodellierung mitbringt.

Aufgaben:
+ Analyse, Verständnis und Refactoring bestehender Databricks-Notebooks
+ Erweiterung und Weiterentwicklung bestehender Datenpipelines
+ Entwicklung und Optimierung von ETL-/ELT-Prozessen
+ Durchführung komplexer Datentransformationen und Joins
+ Erstellung und Pflege von Mapping-Logiken für unterschiedliche Datenquellen
+ Sicherstellung der Datenqualität durch Data Cleansing und Validierungsmaßnahmen
+ Unterstützung bei der Verarbeitung und Integration großer Datenmengen innerhalb einer modernen Data-Plattform


Anforderungen

Must:
+ Mehrjährige Erfahrung als Data Engineer
+ Sehr gute Kenntnisse in Databricks
+ Fundierte Erfahrung mit PySpark
+ Sehr gute Python-Kenntnisse
+ Erfahrung im Aufbau, der Optimierung und Wartung von Datenpipelines
+ Erfahrung mit komplexen Datentransformationen, Mapping-Prozessen und Datenqualitätsmanagement
+ Idealerweise deutschsprachige Kommunikation

Nice:
+ Erfahrung mit Delta Tables
+ Kenntnisse im Bereich Product Information Management (PIM)
+ Erfahrung mit BMEcat
+ Gute Kenntnisse in XML
+ Erfahrung mit ECLASS-Klassifizierungen
+ Erfahrung in der Verarbeitung von Produkt- und Stammdaten im elektronischen Handel oder technischen Großhandel

Jetzt bewerben