▹ Betrieb und Wartung von On-Premises-Datacenter-Infrastruktur, einschließlich physischer und virtueller Server, Linux-Systeme, Virtualisierungsplattformen, Storage und Netzwerk-Infrastruktur
▹ Administration von Linux-Serverumgebungen, einschließlich Konfiguration, Patching, Services, Storage, Networking, Performance und Fehleranalyse im Produktivbetrieb
▹ Verwaltung virtualisierter Infrastruktur und Cluster, einschließlich Provisionierung, Ressourcenmanagement, Migrationen, Storage-Integration und Hochverfügbarkeitsbetrieb
▹ Unterstützung von Kubernetes/RKE2- und containerisierten Umgebungen bei Cluster-Setup, Workloads, Networking und Plattformbetrieb
▹ Automatisierung von Infrastruktur-Konfigurationen und wiederkehrenden Aufgaben mit Ansible und Shell-Skripting zur Verbesserung von Konsistenz und Reduktion manueller Arbeit
▹ Bereitstellung und Betrieb interner Webanwendungen und Plattformservices über Entwicklungs-, Test- und Produktionsumgebungen hinweg
▹ Konfiguration und Wartung von Apache- und Nginx-Webinfrastruktur, Reverse Proxies, Zertifikaten und internen PKI-nahen Services
▹ Pflege von Monitoring und Alerting mit Checkmk sowie Analyse von Verfügbarkeits-, Performance- und Kapazitätsproblemen
▹ Verantwortung für Backup- und Recovery-Prozesse einschließlich Restore-Validierung für operative Einsatzbereitschaft
▹ Fehleranalyse über Linux-, Virtualisierungs-, Netzwerk-, Storage-, Applikations- und Container-Ebenen hinweg mithilfe von Logs, Monitoring-Daten und Diagnosetools
▹ Entwicklung interner Webanwendungen und operativer Tools, die kontrollierte Schnittstellen zu Backend-Infrastruktur und Services bereitstellen
▹ Umsetzung von Zugriffskontrollen, Berechtigungen, Firewall-Richtlinien und operativen Schutzmaßnahmen zur Verbesserung von Sicherheit und Stabilität
▹ Zusammenarbeit mit externen Dienstleistern und technischen Beratern bei Datacenter-, Kubernetes-, Infrastruktur- und Plattformprojekten
▹ Testen von Infrastrukturänderungen, Upgrades und Deployments vor dem Produktiv-Rollout sowie Unterstützung bei Incident-Untersuchungen und Root-Cause-Analysen
▹ Erstellung und Pflege technischer Dokumentation, Betriebsanweisungen, Runbooks und Infrastruktur-Guides für den täglichen Betrieb und Wissenstransfer