Projektportal
Projektdetails
Aufgaben
- Betrieb und Monitoring der Azure- und Databricks-Plattform (Data & AI Plattform)
- Analyse und Behebung von Incidents sowie nachhaltige Ursachenanalyse von Betriebsstörungen
- Aufbau und Weiterentwicklung von Monitoring-, Logging- und Alerting-Lösungen
- Durchführung von Deployments, Releases und Changes in produktiven Umgebungen
- Automatisierung wiederkehrender Betriebsaufgaben mittels Infrastructure as Code und CI/CD
- Erstellen von Security-, Netzwerk- und Berechtigungskonzepten
- Performance- und Kostenoptimierung der Cloud-Plattform (FinOps)
- Erstellung und Pflege von Betriebsdokumentationen, Runbooks und Notfallprozessen
- Unterstützung beim Wissenstransfer und bei der Weiterentwicklung von Betriebsstandards
Anforderungen
Must-haves
- Mehrjährige Erfahrung im Betrieb von Microsoft-Azure-Plattformen
- Erfahrung mit Monitoring-, Logging- und Alerting-Lösungen (Azure Monitor, Log Analytics, Application Insights, Grafana)
- Erfahrung im Incident-, Problem- und Change-Management
- Sehr gute Kenntnisse in Infrastructure as Code (Terraform bevorzugt)
- Erfahrung mit Azure DevOps und CI/CD-Pipelines
- Gute Kenntnisse in Cloud Security, IAM und Netzwerkkonzepten
- Erfahrung im Betrieb produktiver Plattformen und kritischer Anwendungen
- Sehr gute Deutsch- und gute Englischkenntnisse
Nice-to-haves
- Erfahrung mit Databricks, Jupyter Notebooks oder vergleichbaren Analyseumgebungen
- Erfahrung mit Miro, Jira, Confluence oder vergleichbaren Kollaborationswerkzeugen
- Erfahrung in agilen Arbeitsumfelden, z. B. Scrum oder Kanban