Projektportal
Projektdetails
Leistungsblock 1
Zielsetzung:
+ Aufbau und Ausbau der bereits im Aufbau befindlichen, weitgehend automatisierten und reproduzierbar bereitstellbaren Kubernetes-basierten Plattform auf Bare-Metal-Infrastruktur in Vorbereitung des Go-Live.
+ Umsetzung wieder verwendbarer Plattformfunktionen für die Bereitstellung, Konfiguration und Weiterentwicklung von Clustern, Servern und weiteren Infrastrukturkomponenten.
+ Reduzierung manueller Eingriffe durch deklarative Konfiguration, GitOps und controllerbasierte Automatisierung.
+ Verbesserung von Stabilität, Wiederherstellbarkeit, Nachvollziehbarkeit und Sicherheit der Plattform über Cluster- und Schutzzonengrenzen hinweg.
+ Technische Konkretisierung und Umsetzung von Plattformanforderungen in Abstimmung mit dem Platform Domain Architect.
Leistungsumfang:
+ Technische Konkretisierung von Anforderungen und Überführung in umsetzbare Lösungsansätze in Abstimmung mit dem Platform Domain Architect und den beteiligten Fachteams.
+ Konzeption, Implementierung, automatisierter Test und Integration von Kubernetes-Controllern oder -Operatoren, insbesondere für:
Bereitstellung und Lifecycle von Kubernetes-Clustern
Integration von Anwendungen ohne eigene GitOps-Mechanismen
Konfiguration und Lifecycle von Servern, unter anderem für BIOS, Boot-Reihenfolge, NTP und Zertifikate
+ Konfiguration von Netzwerkhardware in Zusammenarbeit mit dem zuständigen Netzwerkteam
+ Weiterentwicklung der automatisierten Bare-Metal- und Kubernetes-Bereitstellung einschließlich Hardware-Lifecycle, Betriebssystembereitstellung, Cluster-Provisioning und Anbindung von BMC- Schnittstellen.
+ Integration externer Systeme und Infrastrukturkomponenten über APIs, deklarative Schnittstellen und controllerbasierte Mechanismen.
+ Weiterentwicklung der GitOps- und Infrastructure-as-Code-basierten Automatisierung sowie der hierfür erforderlichen Test- und Integrationsverfahren.
+ Konzeption und Umsetzung von Observability für Plattform und Anwendungen mit clusterinternen und clusterübergreifenden Sichten sowie einer bedarfsgerechten Trennung von Zugriffen und Informationen zwischen Teams, Clustern und Schutzzonen.
+ Konzeption und Umsetzung automatisierter Backup-, Restore- und Recovery-Verfahren für Plattformkomponenten, Persistent Volumes und Datenbanken einschließlich externer Sicherungsziele und überprüfbarer Wiederherstellungsverfahren.
+ Konzeption und Umsetzung von Maßnahmen für Hochverfügbarkeit und definiertes Verhalten bei Ausfällen.
+ Konzeption und technische Umsetzung von Sicherheitsvorgaben durch Admission Control, richtlinienbasierte Validierung und Mutation von Ressourcen sowie weitere Hardening-Maßnahmen.
+ Planung und Umsetzung technologischer Weiterentwicklungen bestehender Plattformkomponenten zur Umsetzung neuer Plattformanforderungen.
+ Erstellung und Übergabe der für Entscheidungen, Umsetzung und weitere Nutzung erforderlichen technischen Dokumentation.
Leistungsblock 2 Betriebsnahe Unterstützungsleistungen:
Zielsetzung:
+ Sicherstellung der Betriebsfähigkeit und Verfügbarkeit der bereits bereitgestellten Plattformfunktionalitäten.
+ Unterstützung des stabilen und sicheren Betriebs der Kubernetes-basierten Plattform.
Analyse und Behebung von Störungen sowie Unterstützung bei der Wiederherstellung des Regelbetriebs.
+ Durchführung betrieblicher Maßnahmen zur Aufrechterhaltung bestehender Plattformfunktionalitäten.
+ Unterstützung bei der Umsetzung operativer Änderungen und Anpassungen an bestehenden Plattformkomponenten.
+ Sicherstellung der technischen Nutzbarkeit der Plattform im laufenden Betrieb.
+ Unterstützung des Wissenstransfers und der betrieblichen Dokumentation.
Leistungsumfang:
+ Analyse komplexer Fehlerbilder über mehrere technische Schichten hinweg.
+ Unterstützung bei der Behebung von Störungen und Incidents.
+ Durchführung und Begleitung von Wiederanlauf- und Funktionstests.
+ Unterstützung bei Go-Live-, Hypercare- oder vergleichbaren Betriebsphasen.
+ Operative Unterstützung bei Backup-, Restore- und Recovery-Vorgängen.
+ Operative Unterstützung bei Lifecycle-Maßnahmen bestehender Plattformkomponenten.
+ Durchführung von Upgrades, Releases, Patches und erforderlichen Anpassungen bestehender Plattformkomponenten, soweit diese nicht zur Schaffung neuer oder wesentlich erweiterter Plattformfunktionalitäten führen.
+ Pflege und Anpassung bestehender Konfigurationen.
+ Betriebsbegleitende Dokumentation.
+ Wissenstransfer und Unterstützung des Betriebs.
Must-haves
+ mindestens sechs Jahre einschlägige operative Erfahrung in einer Platform-Engineering-Rolle für Kubernetes-basierte Plattformen, bei der Konzeption und technische Umsetzung miteinander verbunden waren
+ praktische Erfahrung mit der Automatisierung von Bare-Metal- und Kubernetes-Plattformen sowie mit GitOps, Infrastructure as Code und der Integration technischer Schnittstellen
+ umfassende praktische Erfahrung in der Implementierung (Entwicklung mittels Programmierung) oder wesentlichen Weiterentwicklung von Kubernetes-Controllern oder -Operatoren
+ Bevorzugt in der Programmiersprache "Go"
Gesucht wird jedoch kein "Go"-Programmierer, sondern Entwickler die Kubernetes-Controller und/oder -Operator (weiter)entwickelt haben die auch in Produktion gegangen sind
+ mindestens drei Jahre Erfahrung mit Kubernetes Day-2 Operations und der Analyse komplexer technischer Störungen sowie mit der Umsetzung daraus abgeleiteter erforderlicher Änderungen
+ Erfahrung mit der plattformweiten Umsetzung von Observability, Backup und Recovery, Hochverfügbarkeit sowie Security und Policy Enforcement
+ breite technische Erfahrungsbasis und die Fähigkeit Ergebnisverantwortung für komplexe, nicht vollständig spezifizierte Aufgaben eigenständig und über mehrere technische Schichten hinweg bis zur produktiv nutzbaren Lösung zu übernehmen, zu bearbeiten und zum Ergebnis zu führen
+ Erfahrung in der Energiewirtschaft, kritischen Infrastruktur oder einem vergleichbar regulierten beziehungsweise sicherheitskritischen Umfeld