> Markdown version of [/jobs/ext/3245717-senior-site-reliability-engineer-distributed-cloud-stackit](https://www.wearedevelopers.com/jobs/ext/3245717-senior-site-reliability-engineer-distributed-cloud-stackit). Every page supports `.md` or `Accept: text/markdown`. Links point to the HTML versions so they work for humans too. Agent guide: [/agents.md](https://www.wearedevelopers.com/agents.md). --- # (Senior) Site Reliability Engineer / Distributed Cloud - STACKIT - **Company:** Schwarz Unternehmenskommunikation GmbH & Co. KG - **Location:** Bad Friedrichshall, Germany - **Experience:** Expert - **Contract:** Permanent contract - **Skills:** Cloud Computing, DevOps, Markdown, Software Engineering, Ceph (Software), Data Logging, Kubernetes, Information Technology, Golang - **Published:** September 21, 2026 - **Apply:** https://www.indeed.com/viewjob?jk=98c18a6207cc0234 ## About the Role * Du hast ein abgeschlossenes Studium in Informatik oder einem verwandten Fachgebiet. * Mindestens 2 Jahre aktive Erfahrung als SRE/DevOps Engineer, wo du gelernt hast, dass 'Works on my machine' keine Antwort ist. * Fundierte Erfahrung im Betrieb von Cloud-Infrastrukturen mit Kubernetes und/oder Virtualisierungstechnologien. * Du hast gute Kenntnisse in der Softwareentwicklung mit Golang oder einer vergleichbaren Systemsprache und nutzt diese, um Abläufe zu automatisieren und eigene Tools zu bauen. ## Description * Du betreibst und optimierst unsere hochkomplexen Plattformen (Kubernetes, KubeVirt, Cilium, Ceph, Talos) sowie die zugrundeliegende Infrastruktur mit dem Fokus auf End-to-End-Stabilität, Skalierbarkeit und Kosten. * Du entwickelst und pflegst unsere Monitoring- und Logging-Systeme (Metrics, Logs, Traces), um jederzeit tiefgreifende Einblicke in den Systemzustand zu gewährleisten und proaktiv Engpässe zu erkennen. * Du implementierst konsequentes Synthetic Monitoring und Tracetests, um die End-to-End-Funktionalität kritischer Services kontinuierlich zu validieren. * Du definierst und überwachst klare Service Level Objectives (SLOs) und reduzierst 'Toil' konsequent durch Code. Runbooks sind für dich nur die letzte Verteidigungslinie. * Du dokumentierst deine Arbeit nachvollziehbar, denn das beste System ist wertlos ohne ein gutes Markdown.